Kategorie: KI-News

  • Canva Code 2.0: Wie Vibe Coding für alle zugänglich wird

    Canva Code 2.0: Wie Vibe Coding für alle zugänglich wird

    Stell dir vor, du sitzt vor deinem Laptop und hast eine Idee für eine kleine Webseite – für ein Nebenprojekt, einen Verein oder dein Portfolio. Du hast keine Ahnung von HTML, CSS oder JavaScript. Also suchst du nach einer Lösung. Vielleicht hörst du von etwas namens „Vibe Coding“. Du beschreibst auf Deutsch, was du brauchst, und eine KI erzeugt Code. Klingt verlockend? Einfach „Mach mir eine Startseite mit drei Kacheln“ sagen und loslegen.

    Doch die Ernüchterung folgt schnell. Das Ergebnis ähnelt tausend anderen KI-Webseiten: blaue Leiste oben, weißer Block in der Mitte, Standardschrift. Und vor allem: Änderungen – eine andere Farbe, ein eigenes Bild, ein anderer Satz – erfordern Code-Eingriffe. Du stehst wieder vor Zeichen, die dir nichts sagen. Genau hier setzt Canva Code 2.0 an.

    Was ist Canva Code 2.0?

    Canva kennen viele als Design-Tool für Social-Media-Grafiken, Präsentationen und Flyer. Mit Canva Code lassen sich seit einiger Zeit auch Webseiten und kleine Apps bauen – KI-gestützt. Version 2.0, jetzt für alle verfügbar, kombiniert KI-Code-Erzeugung mit den vertrauten Design-Werkzeugen von Canva. Entscheidend: Du wechselst nicht mehr zwischen Code-Editor und Design-Programm. Alles an einem Ort.

    Der Einstieg ist einfach. Du startest mit einer kurzen Beschreibung deines Projekts – einem Prompt. Oder wählst aus über 50 Vorlagen: Restaurant, Portfolio, Blog, Online-Shop. Wer HTML-Code hat, importiert ihn und arbeitet in Canva weiter. Du bekommst einen funktionierenden Entwurf, ohne eine Zeile Code zu schreiben.

    Der entscheidende Unterschied: Design-Freiheit

    Das wirklich Neue ist nicht die KI allein. Andere Tools machen das auch: prompt „Landingpage“, KI produziert etwas. Aber dann? Kaum Kontrolle über das Aussehen. Canva Code 2.0 lebt im Canva-Editor – genau dem, den du von Flyern und Präsentationen kennst. Du fügst Fotos per Drag & Drop ein, wählst Farben aus der Markenpalette, änderst Schriftarten, schreibst Text per Klick um. Alles ohne Code.

    Oder du bleibst im Chat: „Mach den Hintergrund hellgrau“, „Setz das Logo links oben“. Die KI passt an. Deine Änderungen bleiben im Kontext. Keine neuen Prompts, die alles durcheinanderbringen. Und durch den Zugriff auf dein Brand Kit – Farben, Logos, Schriftarten – sieht das Ergebnis individuell aus, nicht nach Kopie.

    Ein Bild: Du bestellst bei einem Schreiner ein Regal. Du sagst: „Ein Regal, 1 Meter breit, drei Fächer.“ Der Schreiner liefert ein Regal – aus heller Kiefer, mit Metallgriffen. Du wolltest Eiche und weiße Griffe. Bisher konntest du nur anrufen und hoffen – oder selbst zur Säge greifen. Canva Code 2.0 ist wie ein Schreiner, der das Regal bringt und sagt: „Hier, nimm den Katalog, such Farbe, Holz, Griffe – ich baue es um.“ Du musst kein Handwerker sein, hast aber Kontrolle.

    Genau das meint der Entwickler: „weniger einschüchternd“. Es nimmt die Angst vor Code, ohne dir die Gestaltung zu nehmen. Du passt das visuelle Ergebnis Schritt für Schritt an – in Echtzeit.

    Gemeinsam bauen und veröffentlichen

    Ein weiteres Merkmal: die Zusammenarbeit. Teile das Projekt mit deinem Team, alle arbeiten gleichzeitig, hinterlassen Kommentare – direkt im Editor. Nützlich bei mehreren Beteiligten: Texter, Designer, Entscheider. Früher Dateien hin- und herschicken oder separates Tool. Jetzt alles an einem Ort.

    Fertig? Sofort veröffentlichen. Canva bietet Domains zum Kauf oder kostenlose Subdomains. Für interne Projekte: privat halten. Ideal für Intranets, Projektseiten, Schulungsmaterial. Der gesamte Weg von der Idee zur Live-Seite in Canva – kein Hosting, FTP, Servereinstellungen.

    Für wen ist das gedacht?

    Canva Code 2.0 ist für alle, die eine Webseite oder App brauchen, ohne Programmierkenntnisse. Kleinunternehmer, Kreative, Freelancer, Vereinsmitglieder, Lehrer. Auch Agenturen nutzen es für schnelle Prototypen, die Entwickler später übernehmen. Es ersetzt keine komplexe, maßgeschneiderte Software. Für Datenbanken, individuelle Logik, besondere Performance braucht es Profis. Für die täglichen 80 Prozent – Unternehmensseite, Event-Seite, Portfolio – reicht es.

    Die Stärke: Demokratisierung. Bisher war Vibe Coding ein Hype für Leute, die sich mit Code auskennen. Sie nutzen KI für mehr Tempo. Für Laien oft frustrierend: Ergebnis passt nicht, keine Anpassungsmöglichkeit. Canva Code 2.0 schließt die Lücke: visuelle Gestaltung steht im Vordergrund. Kein Wissen über Frameworks oder APIs nötig. Nur die Vorstellung, wie die Seite aussehen soll.

    Einordnung: Was bedeutet das konkret?

    Canva Code 2.0 ist kein Wunderwerkzeug. Keine bahnbrechenden Innovationen, kein Ersatz für komplexe Web-Apps. Aber es ist ein Schritt, KI-gestützte Code-Erstellung für Normalnutzer erfahrbar zu machen. Statt nur ein weiterer AI Code Generator mit austauschbaren Ergebnissen setzt Canva auf Integration und Design. Der entscheidende Unterschied.

    Für alle, die eine Webseite wollten, aber vor Code zurückschreckten, ist das eine Erleichterung. Selbst Hand anlegen, ohne eine neue Sprache zu lernen. Und später: Code exportieren und von Profis erweitern lassen. Kein Endpunkt, sondern eine Einstiegshilfe.

    Probier es aus, wenn dir „mal schnell eine Webseite“ zu kompliziert erscheint. Starte mit einem Prompt, wähle eine Vorlage, füge eigene Bilder hinzu. Du wirst überrascht sein, wie viel du gestalten kannst – ohne Code. Das ist Vibe Coding, wie es sein sollte: nicht einschüchternd, sondern hilfreich.

    Quelle: digitaltrends.com

  • OpenAI tritt mit der Codex Micro Tastatur in den Hardwaremarkt ein

    OpenAI tritt mit der Codex Micro Tastatur in den Hardwaremarkt ein

    Du sitzt an deinem Schreibtisch und steuerst eine Flotte von KI-Agenten, die selbstständig Code schreiben und ausführen. Bisher ging das über Smartphone oder Desktop-App – umständlich und unübersichtlich. OpenAI will das mit der Codex Micro ändern, einer 230 Dollar teuren Tastatur für den KI-Coding-Assistenten Codex. Co-designt mit Work Louder, soll sie als physische Kommandozentrale für agentische Arbeit dienen.

    Die Tastatur ist beleuchtet und hat sogenannte Agent Keys, die den Status deiner KI-Agenten anzeigen. Leuchten sie grün, läuft alles. Bei Rot musst du eingreifen. Dazu gibt es Command Keys, programmierbare Tasten für wiederkehrende Aktionen, einen Joystick zum Starten von Workflows und einen Drehregler für die Reasoning-Stufe – also wie viel Rechenzeit ein Agent in eine Aufgabe investieren soll. Das erinnert an ein Cockpit: Statt über Bildschirme und Mausklicks navigierst du live und fühlst physische Rückmeldungen. Ein klarer Ansatz, der KI greifbar macht.

    Der Tech-Journalist Lucas Ropek beschreibt die Codex Micro bei TechCrunch als limitierte Kollaboration. OpenAI selbst bezeichnet sie als „Novelty-Item“ – ein glänzendes Spielzeug, weniger für den Massenmarkt, sondern als Türöffner für die Hardware-Strategie. Die Tastatur ist über die ChatGPT-Desktop-App steuerbar und anpassbar. Für knapp 230 Euro bekommst du ein spezialisiertes Werkzeug, das sichtbar macht, wohin die Reise geht. Die eigentliche Hardware-Offensive von OpenAI steckt noch in den Startlöchern.

    Laut einem Bloomberg-Bericht arbeitet OpenAI an einem weiteren Gerät: einem tragbaren, bildschirmlosen Smart Speaker mit ChatGPT-Integration und mechanischen Elementen, die sich eigenständig bewegen können. Ein Lautsprecher ohne Bildschirm, der interagiert und sich physisch verändert. Die Entwicklung wird von ehemaligen Apple-Ingenieuren vorangetrieben – ein heikler Punkt. Apple verklagt OpenAI wegen des Vorwurfs des Diebstahls von Geschäftsgeheimnissen. OpenAI soll vertrauliche Informationen aus Apple abgeschöpft haben, um die eigene Hardware-Entwicklung zu beschleunigen. OpenAI weist die Vorwürfe zurück. Die Klage zeigt, wie ernst der Hardware-Rechtsstreit geworden ist.

    Warum der Aufwand um eine Tastatur? Auf den ersten Blick wirkt die Codex Micro überteuert und nischig. 230 Dollar sind kein Pappenstiel, und viele Entwickler nutzen ihre normale Tastatur. Aber dahinter steckt ein Muster: OpenAI möchte verändern, wie wir mit KI interagieren. Bisher war das meist textbasiert: Du tippst einen Prompt ein, der Agent arbeitet und liefert ein Ergebnis. Die Codex Micro macht diesen Prozess physisch erfahrbar. Du siehst, welcher Agent arbeitet, passt die Arbeitslast über den Drehregler an und startest Workflows mit dem Joystick – alles ohne den Blick vom Code zu nehmen. Ein Werkzeug für Produktivität und die Verbindung von Mensch und Maschine.

    Eine Tastatur allein macht noch keinen Paradigmenwechsel. Das zweite Gerät, der bildschirmlose Speaker, verspricht mehr. Wenn OpenAI ein portables Gerät mit beweglichen Teilen auf den Markt bringt, das Sprache und physische Interaktion vereint, betreten wir Neuland. Stell dir vor, du unterhältst dich mit einem Gerät, das sich dir zuwendet, nickt oder die Lautstärke durch eine Drehung anpasst. Eine neue Schnittstelle – intuitiv, fast menschlich. Das Gerät steckt laut Bloomberg noch in der Entwicklung und kann sich ändern. OpenAI äußert sich nicht dazu.

    Für Entwickler und Tech-Enthusiasten ist die Codex Micro ein Statement. OpenAI nimmt Hardware ernst, experimentiert aber noch. Der Preis von 230 Dollar ist hoch, aber für ein Spezialwerkzeug nicht ungewöhnlich. Die Frage ist, ob die Tastatur hält, was sie verspricht: eine echte Produktivitätssteigerung oder ein Lifestyle-Accessoire? Lucas Ropek deutet an, dass es sich um ein begrenztes Modell handelt – vielleicht ein Signal an die Konkurrenz. Die Apple-Klage wirft einen Schatten auf diese Pläne, aber vielleicht treibt der Druck die Innovation voran.

    Was bedeutet das konkret für dich? Wenn du viel mit KI-Coding-Agenten arbeitest, könnte die Codex Micro deine Arbeit flüssiger machen. Wenn du gelegentlich einen Prompt tippst, investierst du das Geld besser in Rechenzeit. Der wahre Wert liegt möglicherweise in der Entwicklungsumgebung insgesamt: OpenAI bereitet sich darauf vor, nicht nur Software, sondern auch Hardware zu liefern. Die Tastatur ist der erste Schritt, der Speaker der nächste. Der Rechtsstreit mit Apple erinnert daran, dass dieser Weg nicht ohne Konflikte verläuft.

    Quelle: techcrunch.com

  • Regen: Open-Source-Alternative zu PagerDuty mit KI-Post-Mortems

    Regen: Open-Source-Alternative zu PagerDuty mit KI-Post-Mortems

    Der Alarm geht los – schon wieder. Dein Team hat Dutzende Benachrichtigungen, kaum eine ist wirklich kritisch. Oncall-Schichten sind ein Flickwerk aus manuellen E-Mails und veralteten Kalendern. Nach dem Incident fehlt die Zeit für eine ordentliche Post-Mortem-Analyse. Bisher kostete eine Lösung zwischen 20 und 50 Euro pro Nutzer und Monat: PagerDuty, incident.io oder ähnliche Dienste. Und der Quellcode bleibt verschlossen.

    Regen ist eine Open-Source-Plattform des Teams von FluidifyAI. Sie deckt das gesamte Oncall-Management ab: Alarmaufnahme, Incident-Tracking, KI-gestützte Post-Mortems. Du hostest sie selbst. Deine Daten bleiben bei dir. Du bestimmst die KI-Modelle – OpenAI, Anthropic oder Ollama. Regen übernimmt den Rest. Es geht um Kontrolle und Flexibilität. Die Architektur wächst mit deinem Team, ohne Nachlizenzierung.

    Die Kernfunktionen: Ein vollständiger Incident-Lebenszyklus mit unveränderlicher Timeline. Jeder Schritt wird protokolliert. Eskalationsrichtlinien mit mehrstufigen Timeouts benachrichtigen die richtigen Personen in der richtigen Reihenfolge. Die Alarmaufnahme versteht Prometheus, Grafana, AWS CloudWatch und einen generischen Webhook – egal ob Cloud oder on-premises.

    Integrationen: Slack und Microsoft Teams sind vollständig eingebunden. Channels, Bot-Befehle, synchronisierte Timeline. Der Wechsel von Grafana OnCall oder PagerDuty erfolgt per 1-Klick-Import für Zeitpläne, Eskalationsrichtlinien und Konfigurationen. Es gibt keine künstlichen Limits: unbegrenzt Incidents, Oncall-Schichten und KI-Funktionen – ohne Zusatzkosten.

    Bei den KI-Features bringst du deinen eigenen API-Key mit – lokales Ollama-Modell oder kommerzielle Dienste. Regen generiert Incident-Zusammenfassungen, Post-Mortem-Berichte und Übergabeprotokolle für Schichtwechsel. Die Ergebnisse werden automatisch in Slack oder Teams synchronisiert.

    Stabilität und Sicherheit: FluidifyAI hat Regen für Produktionsumgebungen entwickelt. Benchmarks auf einem Apple M2 mit Colima zeigen p99-Latenzen unter 10 Millisekunden (Ziel 200 ms). Der Spitzendurchsatz liegt bei knapp 4.000 Requests pro Sekunde ohne 5xx-Fehler. PostgreSQL-Ausfälle werden über Patroni und HAProxy mit 11 Sekunden Wiederherstellungszeit abgefangen (Ziel unter 60 Sekunden). Redis Sentinel bewältigt Primary-Ausfälle in 5 Sekunden. Rolling-Deployments verlieren keine laufenden Requests – die App wartet, bis Verbindungen abgeschlossen sind.

    Die Sicherheitsarchitektur: Passwörter mit bcrypt (Cost 12) und timing-sicherem Vergleich. Nach fünf fehlgeschlagenen Logins wird das Konto vorübergehend gesperrt. Session-Cookies sind HTTP-only und SameSite=Strict. GORM verwendet parametrisierte Queries – keine SQL-Injection. Webhook-Anfragen von Slack werden per HMAC-SHA256 verifiziert, inklusive Replay-Schutz. Teams nutzt RSA/OIDC, CloudWatch RSA mit SSRF-sicherer Zertifikatsprüfung. Rate-Limiting über Redis-Lua-Skripte: 10 Requests/Minute auf Auth-Endpunkten, 120 für unauthentifizierte, 600 für authentifizierte Anfragen. Die Container laufen als nicht-root (UID 1001) mit read-only Filesystem und ohne unnötige Linux-Capabilities. Das Frontend enthält keine Secrets – der Session-Token ist für JavaScript unzugänglich.

    Der schnelle Start: Docker Compose ausführen – Repository klonen, Umgebungsvariablen setzen (Slack-Token, KI-Key etc.), make start. Läuft auf localhost:8080. Für produktive Einsätze gibt es Helm-Charts, eine vollständige Installationsanleitung und Health-Checks. Wer das Hosting nicht selbst übernehmen möchte, kann einen Service buchen. Die Basis bleibt die selbstbestimmte Open-Source-Version unter AGPLv3. SSO über SAML 2.0 ist in der kostenlosen Edition enthalten.

    Konkret heißt das: Du hast eine Alternative zu etablierten Kostenfallen. Incident-Management, Eskalation, Alert-Aggregation, KI-Assistenz, Chat-Integrationen, unbegrenzte Nutzung – alles in einem Open-Source-Paket. Du bestimmst, ob du es auf eigenem Server, in der Cloud mit Kubernetes oder hybrid betreibst. Deine Incident-Daten bleiben deine Daten. Eigene Lasttests sind jederzeit möglich: make load-test und make chaos-db. Regen ist ein Werkzeug für Teams, die Oncall professionalisieren wollen, ohne das Budget zu sprengen.

    Wer die Verantwortung für Betrieb und Sicherheit seiner Infrastruktur trägt, sollte die Werkzeuge kontrollieren können. Regen löst nicht alle Probleme – aber es gibt dir die Flexibilität, deinen Oncall-Prozess so zu gestalten, wie er für dein Team funktioniert. Mit oder ohne KI, mit Slack oder Teams, mit 10 oder 1000 Nutzern – die Plattform skaliert ohne Lizenzkosten.

    Quelle: github.com

  • Manus Auto-Publish: Die letzte manuelle Hürde fällt

    Manus Auto-Publish: Die letzte manuelle Hürde fällt

    Stell dir vor, du arbeitest an einer Website. Du hast eine klare Vorstellung, tippst Änderungen ein, und nach wenigen Sekunden erscheint eine neue Version. Dann öffnest du das Menü, prüfst die Einstellungen und klickst auf „Veröffentlichen“. Bei fünfzehn kleinen Anpassungen sind das fünfzehn manuelle Schritte. Die Auto-Publish-Funktion von Manus macht diesen letzten Schritt überflüssig. Der Entwickler, ein Anbieter KI-gestützter Website-Erstellung, hat einen Schalter eingebaut, der das manuelle Veröffentlichen ersetzt.

    Die Idee ist simpel. Legst du den Schalter im Veröffentlichungs-Popover um, wird jeder erfolgreiche Build automatisch auf deine Live-URL ausgeliefert. Keine Bestätigung, kein manuelles Eingreifen. Deine Seite bleibt synchron mit der letzten von dir akzeptierten Version. Bisher war die Veröffentlichung ein eigener Schritt, der Aufmerksamkeit erforderte. Mit Auto-Publish wird sie zum Nebenprodukt des Bauens. Du änderst etwas, der Build läuft, und sobald er erfolgreich ist, ist die Änderung live. Kein Warten, kein extra Klick.

    Der Schalter ist standardmäßig ausgeschaltet. Das ist Absicht. Nicht jede Iteration ist für die Öffentlichkeit bestimmt. Vielleicht experimentierst du mit einem Layout, das du noch nicht zeigen willst, oder testest eine Farbpalette. Auto-Publish ist für die Momente gedacht, in denen du genau weißt, wohin die Reise geht, und die Distanz zwischen „sieht gut aus“ und „es ist live“ Null sein soll. Du schaltest es jederzeit im selben Popover wieder aus. Dein bisheriger Workflow ändert sich nicht, solange du nicht aktiv zustimmst.

    Ein Beispiel: Ein Freiberufler baut eine Portfolio-Seite für eine Fotografin. In der ersten Session entsteht die Struktur: eine Galerie, eine Über-mich-Seite, ein Kontaktformular. Er veröffentlicht manuell und teilt den Link. Über Nacht kommt Feedback. Am nächsten Morgen sitzt er mit einer Liste da: Schriftart austauschen, Kundenstimmen ergänzen, Bilder komprimieren, Footer mit Social Links aktualisieren, den mobilen Nav-Breakpoint anpassen. Er ist nicht mehr im Experimentiermodus, sondern im Fertigstellungsmodus. Jetzt schaltet er Auto-Publish ein. Jede Änderung, die Manus abschließt, geht sofort live. Die Fotografin kann die Seite zwischen seinen Nachrichten aktualisieren und die Entwicklung in Echtzeit verfolgen. Die Seite ist fertig und veröffentlicht – ohne einen einzigen Besuch des Publizier-Menüs.

    Die Funktion entfernt die Zeremonie des Veröffentlichens. Statt nach jedem kleinen Schritt innezuhalten, konzentrierst du dich auf das Wesentliche. Das ist praktisch in agilen Arbeitsabläufen mit vielen kleinen Änderungen. Der Arbeitsfluss wird flüssiger, die Feedback-Schleife kürzer. Du bleibst im Gespräch mit deinem Kunden oder Team, während die Seite parallel wächst.

    Die Bedienung ist einfach. Öffnest du dein WebDev-Projekt, klickst oben rechts auf „Veröffentlichen“, scrollst im Popover nach unten und legst den Schalter „Auto publish when it’s ready“ um. Ab dann wird jeder erfolgreiche Build automatisch auf deine öffentliche URL ausgespielt. Zum Deaktivieren öffnest du dasselbe Popover und schaltest sie wieder aus. Der nächste Build wartet dann wieder auf manuelle Bestätigung. Die Funktion ist auf Web, iOS und Android verfügbar.

    Ein Detail: Du kannst Änderungen in eine Warteschlange stellen, während Manus noch am aktuellen Build arbeitet. Kombiniert mit Auto-Publish bedeutet das: Du schreibst deine To-Do-Liste in den Chat, schließt den Laptop, und kommst zu einer fertigen, live geschalteten Seite zurück. Manus verarbeitet die Anfragen der Reihe nach, erstellt die neue Version und veröffentlicht sie – alles ohne dein Zutun. Das ermöglicht einen asynchronen Arbeitsstil.

    Natürlich tauchen Fragen auf. Ist Auto-Publish standardmäßig aktiv? Nein, du musst es explizit einschalten. Können Kunden während des Bauens halbfertige Arbeit sehen? Nein, nur erfolgreiche Builds werden veröffentlicht. Fehlgeschlagene oder laufende Builds beeinflussen die Live-Seite nicht – sie bleibt auf der letzten stabilen Version. Kann man eine laufende Veröffentlichung abbrechen? Ja, die Oberfläche bietet während des Deployments eine Abbruch-Option. Funktioniert das auch auf dem Smartphone? Ja, auf iOS und Android ist der Schalter im selben Popover verfügbar.

    Mit Auto-Publish entfernt Manus die letzte manuelle Hürde zwischen Erstellung und Auslieferung. Der Nutzer muss nicht mehr zwischen Bauen und Veröffentlichen wechseln. In der Summe vieler kleiner Iterationen spart das Zeit und kognitive Belastung. Die Technologie tritt in den Hintergrund und macht den Weg frei für die Arbeit selbst. Für alle, die schon wissen, was sie wollen, wird das Veröffentlichen zum unsichtbaren Teil des Prozesses.

    Quelle: manus.im

  • Mantis von Google: Ein Toolkit für automatisierte Sicherheitsüberprüfungen mit KI

    Mantis von Google: Ein Toolkit für automatisierte Sicherheitsüberprüfungen mit KI

    Du übernimmst ein großes Open-Source-Projekt. Tausende Zeilen Code, dutzende Contributor. Manuelle Code-Reviews sind gründlich, aber zeitaufwendig. Automatisierte Scanner finden oft nur bekannte Muster. Ein neues Toolkit von Google setzt genau hier an: Mantis. Es ist ein modulares Set von Fähigkeiten – Skills – für KI-gesteuerte Coding-Agenten. Diese Agenten finden Schwachstellen, reproduzieren sie und erstellen Patches. Die richtige Anwendung ist entscheidend.

    Mantis ist kein einfaches Sicherheitstool. Es ist ein Baukasten, ein Rahmenwerk, das du an deine Umgebung anpassen kannst – für Webanwendungen, Hardware-Beschreibungen in SystemVerilog, Cloud-Infrastruktur oder kompilierte Binärdateien. Es ist als „entkoppelt, sequenziell und sicherheitsfokussiert“ konzipiert. Du kannst einzelne Schritte gezielt ausführen, musst nicht die gesamte Pipeline nutzen, und die Sicherheit hat oberste Priorität. Denn Mantis generiert und führt autonom Code aus – Code, der potenziell instabil oder schädlich sein kann.

    Wichtig: Google stellt klar, dass dieses Toolkit nur in isolierten, restriktiven Umgebungen verwendet werden darf. Niemals auf Maschinen mit Zugriff auf Produktionssysteme, sensible Daten oder interne Netzwerke. Die Verantwortung liegt bei dir. Jeder Fund muss von einem Sicherheitsexperten manuell überprüft werden. KI kann halluzinieren oder falsche Patches generieren. Massenhaft ungeprüfte Reports an Maintainer zu schicken, ist nicht nur unprofessionell, sondern potenziell schädlich.

    Mantis funktioniert wie eine Sicherheitsfirma: Jeder Mitarbeiter hat eine spezielle Aufgabe, und sie arbeiten in einer definierten Reihenfolge zusammen. Insgesamt besteht die Pipeline aus sechzehn Komponenten: einem Supervisor und fünfzehn Ausführungsstufen. Der Supervisor – das Meta-Agent – startet die Schleife, überwacht den Fortschritt, behandelt Fehler und archiviert die Ergebnisse zwischen den Durchläufen. Das geschieht in einem kontinuierlichen Kreislauf, sodass das System aus vorherigen Analysen lernen kann.

    Die erste Stufe ist optional und analysiert die Versionsgeschichte des Repositorys. Sie extrahiert vergangene Schwachstellen, Sicherheitsfixes und Muster. Diese Informationen werden in einer JSONL-Datei gespeichert. Danach kommt der Summarizer, der für jedes Verzeichnis eine Zusammenfassung erstellt – wiederum optional, aber hilfreich für die Planung. Der Knowledge Base Architect untersucht den Code und baut eine permanente, verknüpfte Wissensdatenbank auf. Sie enthält Entitäten, Datenflüsse und historische Schwachstellenklassen. Diese Wissensdatenbank ist das Gedächtnis der Pipeline.

    Anschließend erstellt der Threat Modeler ein Bedrohungsmodell. Es identifiziert Vertrauensgrenzen und Angreiferprofile. Der Strategist, genannt Mantis Plan, scannt die Workspace-Grenzen und liest die Indizes der Wissensdatenbank, um eine gezielte Review-Strategie zu entwerfen. Diese wird in einer JSON-Datei gespeichert. Jetzt beginnt die eigentliche Suche: Der Researcher führt eine dateiweise Triage und tiefgehende Sicherheitsanalysen durch. Er erstellt für jeden Hotspot eine separate JSON-Datei im Findings-Ordner.

    Duplikate werden vom Deduplicator zusammengeführt. Der Validator filtert falsch-positive Ergebnisse mit strengen pragmatischen Einschränkungen. Der Critic überprüft, ob ein Fund in einem Release-Build reproduzierbar ist – Debug-Asserts zählen nicht. Der Reproducer schreibt Proof-of-Concept-Skripte und führt sie in isolierten Umgebungen wie gVisor oder virtuellen Maschinen aus. Das ist der Moment, in dem die Gefahr am größten ist: Der Code wird tatsächlich ausgeführt. Deshalb betont Google die „No-Host-Run“-Regel – Skripte laufen nur im Sandkasten.

    Danach analysiert der Chainer einzelne Funde und kombiniert sie zu komplexen Angriffsketten. Der Patcher generiert und wendet Code-Fixes an, gefolgt von Validierungstests. Der Risk Calibrator berechnet einen numerischen Risikoscore von 1 bis 10 für jeden Fund. Der Reflector schließlich parst die Ausführungspfade der Agenten und extrahiert falsche Annahmen, Werkzeugfehler und Erfolge. Diese Erkenntnisse fließen zurück in die Lernschleife. Der Reporter erstellt am Ende einen menschenlesbaren Sicherheitsbericht im Markdown-Format.

    Mantis ist komplex, aber du musst nicht alle Schritte auf einmal ausführen. Du kannst interaktiv vorgehen, Schritt für Schritt, mit menschlicher Bestätigung vor jeder kritischen Aktion. Google empfiehlt den „Interaktiven Modus“ für Einsteiger. Dabei startest du die CLI normal und gibst die Slash-Befehle einzeln ein. Das System pausiert dann und fragt nach Erlaubnis, bevor es Sandbox-Befehle ausführt oder Dateien schreibt. So hast du die Kontrolle.

    Die möglichen Anwendungen gehen weit über generische Web-Schwachstellen hinaus. Du kannst Mantis anpassen für Hardware-Reviews von RTL-Designs, für Infrastructure-as-Code wie Terraform oder Kubernetes RBAC, für Data-Pipelines mit Modell-Serialisierungsformaten wie Pickle, oder sogar für kompilierte Binärdateien im Gray-Box-Stil. Dabei emulieren die Tools einen externen Forscher, der nur die veröffentlichten Binaries hat. Das zeigt dir genau, welche Schwachstellen ein Angreifer ohne Quellcode finden könnte.

    Ein entscheidender Punkt ist die Lernschleife. Mantis speichert Erkenntnisse aus jedem Durchlauf in einer learnings.jsonl-Datei. Der Reflector fügt strukturierte Einsichten hinzu – was hat funktioniert, was nicht. Diese Informationen werden im nächsten Zyklus von der Architektur- und Planungsstufe gelesen. So passt sich das System an, vermeidet redundante Analysen und wird mit der Zeit effizienter. Das ist kein statischer Scanner, sondern ein lernendes System.

    Was bedeutet das konkret für dich? Wenn du in der Sicherheitsforschung oder im DevSecOps-Bereich arbeitest, eröffnet Mantis neue Möglichkeiten. Du kannst große Codebasen systematisch und wiederholbar prüfen, ohne jedes Mal von Null zu beginnen. Die Automatisierung übernimmt die mühsame Arbeit des Suchens und der ersten Reproduktion. Aber die letzte Verantwortung bleibt beim Menschen. Du musst die Ergebnisse validieren, patchen und entscheiden, ob ein Fund relevant ist. Kein Tool der Welt ersetzt fundierte Sicherheitskenntnisse.

    Die Modelle sind nicht deterministisch, sie können halluzinieren, Fehler machen. Mantis ist ein Werkzeug, kein Wundermittel. Es erfordert Disziplin, Isolation und eine kritische Haltung. Wer das beachtet, erzielt echte Mehrwerte – vor allem in Umgebungen, die manuell kaum noch zu bewältigen sind.

    Die Zukunft der Sicherheitsanalyse wird automatischer, bleibt aber auf menschliches Urteilsvermögen angewiesen. Mantis zeigt, wie das modular und lernend aussehen kann. Der Fokus liegt auf sicherer Ausführung. Verantwortungsvoller Einsatz ist entscheidend.

    Quelle: github.com