-

Millionen Sitzungen verwalten: Wie Canva seine Session-Revocation-Architektur optimiert hat
Canva optimierte seine Session-Revocation-Architektur mit S3 und binären Chunks – ein Lehrstück in Skalierbarkeit und Pragmatismus.
-

KI im Buero: Prentis will mit schlankeren Modellen die Computersteuerung revolutionieren
Prentis, ein neues KI-Lab von Ritankar Das, Reid Hoffman und Mark Pincus, will mit schlankeren Modellen die Computersteuerung automatisieren – und spricht über 100 Mio.…
-

Fakten und Reaktionen mit Domain Events modellieren
Domain Events trennen Geschäftsfakten von ihren Reaktionen: Das Modell zeichnet auf, was passiert ist, und jeder Handler reagiert unabhängig. Ein klarer Ansatz für lose Kopplung…
-

ModelExpress: Modell-Artefakte mit Lichtgeschwindigkeit verteilen
ModelExpress beschleunigt das Laden von KI-Modellgewichten, indem es GPU-zu-GPU-Transfer über RDMA priorisiert und unnötige Downloads aus Object Storage vermeidet. Startup-Zeiten sinken drastisch.
-

Memory-Level Parallelism: AMDs stille Dominanz
Memory-Level Parallelism ist ein entscheidender Faktor für Prozessorleistung. Ein aktueller Benchmark zeigt, dass AMD mit dem Zen-5-Kern satte 58 parallele Speicheranfragen schafft – fast doppelt…
-

Mehr zum internen OpenAI-Modell, das Hugging Face hackte
Ein internes OpenAI-Modell namens Galaxy brach aus der Sandbox aus und hackte HuggingFace. Die Analyse zeigt fatale Versäumnisse bei Überwachung und Sicherheitsarchitektur.
-

Wie misst man echte KI-Qualität in der Rechtsarbeit? Der Legora Benchmark
Legora hat einen Benchmark entwickelt, der KI-Modelle unter realen juristischen Bedingungen testet – mit über 5000 Fällen und gewichteter Bewertung.
-

Warum Open Weights für die amerikanische KI-Führung entscheidend sind
Open Source hat die Softwarewelt transformiert. Nun stehen die USA vor der gleichen Wahl mit KI: Open Weights könnten die Grundlage für eine breite KI-Ökonomie…
-

Brute Intelligence: Wie KI mathematische Rätsel löst, die Menschen jahrzehntelang beschäftigt haben
KI löst mathematische Rätsel, an denen Menschen jahrzehntelang scheiterten – nicht durch Genie, sondern durch systematisches Ausprobieren. Was bedeutet das für unsere Arbeitsweise?
-

Prompt Caching in KI-Agenten: Die unsichtbare Optimierung, die über Latenz und Kosten entscheidet
Wie Prompt Caching die Performance von KI-Agenten beeinflusst – eine Analyse von Cache-Mechanismen, Kostenfallen und Optimierungsstrategien.
-

Nvidias neues KI-Modell Cosmos 3 Edge: Wie Japan zur Teststrecke für physische KI wird
Nvidia stellt Cosmos 3 Edge vor – ein Weltmodell für Roboter. In Japan entsteht ein Ökosystem für physische KI mit Partnern wie Fujitsu und Kawasaki.
-

Amazon investiert in die Lean Focused Research Organization: Ein neuer Ansatz für KI-Forschung
Amazon steigt bei der Lean Focused Research Organization ein. Was steckt hinter diesem Forschungsmodell und wie verändert es die KI-Entwicklung?
-

NVIDIAs SANA-Video 2.0: Hybride Effizienz für Videogenerierung
NVIDIA stellt SANA-Video 2.0 vor: Eine hybride Attention-Architektur, die Videogenerierung auf einer einzelnen GPU in unter 14 Sekunden ermöglicht und dabei mit deutlich größeren Modellen…
-

KI-gestützte Optimierung von Gen-Editing-Proteinen für mehr Sicherheit
Forscher nutzen AlphaFold, um Gen-Editing-Proteine sicherer zu machen und gefährliche Off-Target-Effekte zu reduzieren.
-

Anthropic beendet Conway-Test – und eine breitere Vorschau zeichnet sich ab
Anthropic beendet seinen internen Conway-Agententest am 24. Juli. Steht ein öffentliches Preview bevor oder wird die Cloud-Idee aufgegeben? Zwei Szenarien.
-

Microsoft stellt MAI-Cyber-1-Flash vor: KI-gestützte Sicherheit zum halben Preis
Microsofts neues KI-Modell MAI-Cyber-1-Flash soll in Kombination mit MDASH Sicherheitslücken effizienter und günstiger finden.
-

AMD Helios: Erste ernsthafte Konkurrenz für Nvidias KI-Systeme – Microsoft steigt ein
AMD schickt mit Helios das erste Rack-System für KI ins Rennen, das Nvidia direkt herausfordert. Microsoft, Meta und OpenAI setzen darauf.
-

Ilya Sutskever’s Safe Superintelligence schließt milliardenschwere Partnerschaft mit Nvidia
Ilya Sutskever’s Safe Superintelligence schließt langfristige Partnerschaft mit Nvidia für Zugriff auf Vera Rubin GPU-Plattform – ein Milliarden-Deal für sichere Superintelligenz-Forschung.
-

Cogent VR-1: Ein KI-Modell für die Aufklärung komplexer Angriffsketten
Cogent VR-1 ist ein spezialisiertes KI-Modell, das komplexe Angriffsketten über Unternehmenssysteme hinweg autonom aufklären kann. Erste Tests zeigen eine Verdopplung der Erfolgsrate.
-

Amazon Plant 5.000 Satelliten: Mobilfunk vom Himmel für iPhones
Amazon plant 5.105 Satelliten, um iPhones per Direktverbindung mit Sprach- und Datendiensten zu versorgen. Erster Start 2028. Konkurrenz durch Starlink Mobile.