-

sPTC: Wie vorzeitige Tool-Aufrufe die Latenz von LLM-Agenten senken
Speculative Programmatic Tool Calling startet Tool-Aufrufe, während die LLM-Generierung noch läuft. Ein Ansatz, der Latenz spart und Agenten schneller macht.
-

Wenn das LLM die Kontrolle über seine Host-Maschine übernimmt
Kann ein Sprachmodell die Maschine übernehmen, auf der es läuft? Der Essay zeigt Angriffe über vLLM und Parser-Bugs – und mögliche Gegenmaßnahmen.
-

Ein einzelnes KI-Ergebnis ist ein Beispiel, keine Bewertung
Ein einzelner KI-Output beweist nichts. Erst wiederholte Tests mit repräsentativen Eingaben und Konfidenzintervallen zeigen, wie zuverlässig ein KI-System wirklich ist.
-

KI-Intelligenz richtig bewerten: Warum Maschinen anders denken als wir
Melanie Mitchell sieht KI als fremde Intelligenz. Warum wir neue Methoden brauchen, um maschinelles Denken zu messen – und was wir von Babys lernen können.
-

Unsloth Dynamic 3.0 GGUFs: Was die neue Quantisierungsmethode fuer Qwen3-8 leistet
Unsloth Dynamic 3.0 GGUFs fuer Qwen3.8-27B: bis zu 10 Prozent mehr Genauigkeit bei gleicher Dateigroesse, neue Divergence-300-Metrik und ehrliche Ueberanpassungspruefung.
-

KI-Versicherung: Der blinde Fleck der Unternehmensabsicherung
KI-Versicherung: Warum bestehende Policen KI-Risiken ausschließen, was die neue Deckung abdeckt und wie Unternehmen sich bis 2030 absichern können.
-

GPU-Kosten: Die Rechnung zeigt, was KI-Infrastruktur wirklich kostet
GPU-Rechnungen explodieren, weil Teams in Stunden statt in Requests denken. Ein Cloud-Anbieter erklärt, wie sich KI-Infrastruktur-Kosten senken lassen.
-

turbovec: Vektorsuche mit einem Achtel des Speichers – und ohne Trainingslauf
Ein Korpus aus 10 Millionen Dokumenten belegt als Float32-Vektoren 31 Gigabyte RAM – mit turbovec sind es 4. Wie die Rust-Bibliothek Quantisierung ohne Trainingslauf mit…
-

OpenAI vor dem Börsengang 2027: Was CFO Sarah Friar den Mitarbeitern verspricht
OpenAI plant laut CFO Sarah Friar den Börsengang 2027, möglicherweise früher. Was die Aussagen über Strategie, Bewertung und den Wettbewerb mit Anthropic verraten.
-

Half-Day: Warum 0-Days im Zeitalter der KI ein Verfallsdatum haben
Margin-Research-CEO Claudia d’Antoine prägt einen Begriff für Exploits, die technisch 0-Days sind, deren Wissensvorsprung aber schon beim Fund zu schmelzen beginnt. Was das für Markt,…
-

FreeToken: Wenn grosse KI-Modelle auf dem Schreibtisch laufen statt im Rechenzentrum
FreeToken verschiebt grosse MoE-Modelle vom Rechenzentrum auf persoenliche Geraete. Das Paper zeigt, wie ein einheitliches Serving-System aus Laptop und Workstation echte Inferenz-Plattformen macht.
-

Fool’s Gold: Wie sich Safety-Removal-Angriffe auf Open-Weight-Modelle täuschen lassen
0,51 bis 0,90 der Antworten nach Abliteration sind falsch: Microsofts Fool’s Gold setzt auf defensive Täuschung gegen Safety-Removal-Angriffe.
-

Ein Angreifer, zwei Plattformen: Die City Forum Kampagne gegen Salesforce und ServiceNow
Ein Angreifer scrape seit 2025 systematisch Salesforce- und ServiceNow-Portale. Die City Forum Kampagne nutzt überprivilegierte Gastnutzer. So erkennt und stoppt ihr sie.
-

Was neun Monate AI-Overview-Daten über Googles KI-Suche verraten
Neun Monate, 51.000 getrackte AI-Overview-Events: Die Daten zeigen, wie KI-Zusammenfassungen Klicks, Sichtbarkeit und SEO beeinflussen.
-

KI-Konsistenz wird zur neuen Latenz
Warum Datenkonsistenz bei autonomen KI-Agenten wichtiger wird als minimale Antwortlatenz und welche Replikationsmodelle wirklich helfen.
-

Ein Entwickler schlägt Alarm: Warum Prompt Injection Würmer zur ersten großen KI-Katastrophe werden könnten
Ein Entwickler skizziert, wie Prompt Injection Würmer 2026 zum ersten KI-Großangriff werden könnten – und was Organisationen jetzt tun sollten.
-

Wann sich das Wiederholen von Domänendaten beim LLM-Pretraining lohnt
Wie oft dürfen hochwertige Domänendaten im LLM-Pretraining wiederholt werden, ohne dass Overfitting einsetzt? Eine neue Studie liefert überraschend klare Antworten und zeigt, dass kleine Proxy-Modelle…
-

Open-Source-KI: Zwischen Nvidia-Strategie und wirtschaftlicher Schwerkraft
Ein Beitrag erklärt, warum Open-Source-KI von Nvidias Strategie abhängt und welche zwei Zukünfte für offene Modelle möglich sind.
-

Groq, Nvidia und die große Frage hinter der 3,5-Milliarden-Bewertung
Groq sammelt 350 Millionen Dollar ein – doch die Bewertung sinkt von 6,9 auf 3,5 Milliarden. Der Nvidia-Deal hat das Geschäftsmodell radikal verändert.
-

Was heute noch vor KI-Angriffen schützt – und warum dieser Schutz bröckelt
KI-Angriffe nehmen zu. Erfahre, welche Schutzschichten heute noch wirken, warum sie brüchig werden und wie du dein Unternehmen jetzt absichern kannst.