-

GLM-5.3-Flash: Vom anonymen Ox-Alpha-Debüt zum Open-Source-Release
GLM-5.3-Flash lief erst anonym als Ox Alpha bei OpenRouter, jetzt hat Z.ai die Gewichte freigegeben. Was Sparse Attention und lineare Aufmerksamkeit an Rechenaufwand sparen.
-

Warum langlebige Agenten an ihrer Erinnerung scheitern
Lang laufende Agenten-Sessions faulen von innen heraus, sagt Tom Tunguz. Warum ein täglicher Reset und kurzlebige Helfer besser sind als ein ewig wachsender Kontext.
-

Warum KI-Coding-Agenten einen Kontextgraphen brauchen
Coding-Agenten scheitern in großen Codebasen nicht am Modell, sondern am fehlenden Kontext. Warum Postman einen Kontextgraphen aus APIs, Ownership und Governance für die Antwort hält.
-

Wie viel Internet ist inzwischen von KI geschrieben?
Pew Research Center hat 490.000 Webseiten mit Open Pangram analysiert: Auf .com-Domains zeigen fast zehn Prozent KI-Spuren, auf .edu und .gov kaum. Was das über…
-

Wachstum ohne Werbung: Lazyweb erreicht 50.000 KI-Agenten
Lazyweb erreichte 50.000 Anmeldungen ohne Marketingbudget – ein Blick auf erfolgreiche und gescheiterte Wachstumsexperimente des MCP-Servers.
-

Gemini Omni 1.1 Flash: Mehr Kontrolle für generative Videoproduktion
Mit Omni 1.1 Flash erweitert Google DeepMind seine generative Video-API um Szenenverlängerung, Frame-Interpolation, 360p-Previews und 4K-Upscaling.
-

Abgestufte Autonomie: So schließen Teams die Vertrauenslücke bei KI-Agenten
Abgestufte Autonomie schließt die Vertrauenslücke bei KI-Agenten: ein Framework aus sechs Schichten, das Vertrauen misst, durchsetzt und laufend neu verdient.
-

So sparte Cloudflare 100 Terabyte Arbeitsspeicher durch Optimierung des 1.1.1.1-DNS-Caches
Cloudflare hat den DNS-Cache hinter 1.1.1.1 so umgebaut, dass pro Eintrag über 50 Prozent Speicher wegfallen. Das sparte 100 Terabyte RAM.
-

KI-Umsatzwachstum: OpenAI und Anthropic auf Rekordkurs
OpenAI und Anthropic wachsen so schnell wie kein Technologieunternehmen zuvor. Wir analysieren, was hinter dem Rekordwachstum steckt – und was es für die Branche bedeutet.
-

KI-gestützte Code-Migration: Wie Asana, Airbnb und Uber ihre Testframeworks modernisieren
KI-gestützte Code-Migration macht jahrelange Projekte in Wochen machbar: Asana, Airbnb und Uber zeigen, wie LLMs Testframeworks modernisieren.
-

Harness Engineering: Wie KI-Code dauerhaft korrekt bleibt
Harness Engineering hält KI-generierten Code stabil: Kontext, Architektur-Constraints und Aufräumen – erklärt für Teams, die KI-Assistenten produktiv nutzen.
-

Kleine KI-Modelle sind angekommen
Kleine Sprachmodelle wie gpt-5.6-luna und GLM 5.3 senken die Token-Kosten drastisch. Das ermöglicht neue Consumer-Apps und verändert die KI-Ökonomie für Unternehmen.
-

Agenten-Schwärme als verteiltes Systemproblem
KI-Agenten arbeiten zunehmend parallel an gemeinsamen Wissensbeständen. Chromas Foundation zeigt, warum klassische Transaktionen scheitern und wie Fission teure Abbrüche vermeidet.
-

KI-Agenten steuern physische Welt: Anthropics neuer Hardware-Standard MHS
Anthropics Model Hardware Standard (MHS) schafft eine einheitliche Schnittstelle zwischen KI-Agenten und physischen Geräten. So könnten Labore und Fabriken künftig in Minuten statt Wochen automatisiert…
-

Agentic Engineering für Coding Agents: Definition, Unterschiede und ein erprobter Workflow
Agentic Engineering verlagert Vertrauen vom Modell auf das System. Der Artikel erklärt Definition, Unterschied zu Vibe Coding und einen erprobten Workflow mit Review und Validierung.
-

Quantisierung von LLMs: So werden Modelle klein genug für den Laptop
Quantisierung macht LLMs viermal kleiner und doppelt so schnell – bei minimalem Genauigkeitsverlust. Wir erklären das Prinzip von Grund auf.
-

Die Zukunft des Internets mit IPv6: Erkenntnisse von der IETF 126
Die IETF 126 zeigt: IPv6 und DNS werden im KI-Zeitalter zum Fundament. Der Bericht erklärt, wie Agenten-Discovery und Adressierung die Internetzukunft prägen.
-

Enterprise-Managed Auth für den Supabase MCP Server: Zugriffskontrolle im KI-Zeitalter
Supabase Enterprise Auth für den MCP Server: Zentrale Zugriffskontrolle über Okta, rollenbasierte Berechtigungen für Claude und SCIM auf der Roadmap.
-

LLM-Evaluierung vor dem Produktionseinsatz: Was zählt, ist die Produktionsrealität
Benchmarks allein genügen nicht: Wer LLMs produktiv einsetzen will, muss die Evaluierung am Produktionsziel ausrichten. Ein Erfahrungsbericht zeigt, wie.
-

Apple M6 und M5 Ultra: Der große Sprung bei Leistung und KI-Rechenkraft
Apple bringt mit dem M6 den ersten 2-nm-Chip in den Mac mini, während der M5 Ultra mit Quad-Die-Architektur neue Maßstäbe für KI-Arbeit setzt.