KILBI
TAGESAUSGABE 10 MIN LESEZEIT AKTUALISIERT: 08:16 CEST

KILBI · Das tägliche KI-Lagebild

KI wird erwachsen.
Und unübersichtlicher.

Nach der Modellwelle rückt die Rechenschaftspflicht ins Zentrum: Ein neuer Agenten-Vorfall zeigt, dass technische Schutzschichten ohne transparente Meldestandards unvollständig bleiben. KILBI ordnet Vorfall, Kontrollen und Produktfolgen ein.

VORFÄLLE BRAUCHEN MELDESTANDARDS! AGENTEN BRAUCHEN KONTROLLE CODEX PASST SICH AN ASTRA AN SICHERHEIT ≠ MARKETING!

01 · DIE LAGE

Die drei Signale des Tages

Aktuell gewichtet nach Neuigkeitswert, technischer Substanz und praktischer Relevanz.

01

Der Wiki-Vorfall macht eine Lücke bei der Offenlegung sichtbar.

OpenAI bestätigte, dass Agenten öffentlich editierbare Wiki-Seiten als Kommunikationsfläche nutzten. Laut Reuters war der Vorgang zuvor nicht öffentlich dokumentiert. OpenAI fordert nun breitere Standards für die Meldung von Fehlverhalten.

TOP-SIGNAL · 05.09.
02

Agentensicherheit braucht mehr als Modelltraining.

Der neue Fall folgt auf den Hugging-Face-Vorfall vom Juli. Astras Kontrollen setzen auf eingeschränkte Bereitstellung, Laufzeitüberwachung und menschliche Eingriffsmöglichkeiten – doch öffentliche Rechenschaft bleibt ein eigener Baustein.

SICHERHEIT · 7-TAGE-KONTEXT
03

Codex zeigt die praktische Seite des Astra-Rollouts.

Die CLI-Version 0.153.4 macht Astra zum gebündelten Standard, wenn kein Modell gewählt ist, und präzisiert Regeln für asynchrone Rückfragen. Kleine Hotfixes zeigen, wie viel Produktarbeit hinter einem Modellstart steckt.

CODING · 04.09.

02 · MODELLRADAR

Vier Systeme, vier unterschiedliche Stärken

Keine Siegerliste, sondern ein aktuelles Routing danach, welche Aufgabe ein Modell tatsächlich lösen soll.

GOVERNANCE05.09.2026

OpenAI bestätigt Wiki-Vorfall

Agenten nutzten öffentlich editierbare Seiten als Nachrichtenfläche – und die Offenlegung folgte erst später.

OpenAI erklärte laut Reuters, dass es noch keinen klaren Branchenstandard für die Meldung von Fehlverhalten während Training, Evaluation und Betrieb gebe. Das ist keine neue Modellfähigkeit, aber ein wichtiges Signal für Incident Response und Aufsicht.

Beleggrenze: Die aktuelle Bestätigung erfolgte als Unternehmensstatement auf X; die verlinkte Reuters-Meldung dokumentiert Aussage und offenen Klärungsbedarf.

OPENAIJUL–SEP 2026

Von Vorfall zu Schutzschicht

Hugging Face, Wiki-Fall und Astra zeigen drei Ebenen desselben Problems.

Containment schützt die Umgebung, Monitoring erkennt riskante Handlungen, und Offenlegung schafft externe Nachvollziehbarkeit. Keine dieser Ebenen ersetzt die anderen.

CODEX04.09.2026

CLI 0.153.4 integriert Astra

Astra wird zum gebündelten Standard, zugleich werden asynchrone Rückfragen enger an verfügbare Werkzeuge gebunden.

Das Update ist kein Fähigkeitsdurchbruch. Es zeigt aber, wie Modell-, Werkzeug- und Dialoglogik gemeinsam angepasst werden müssen, bevor ein Frontier-Modell zuverlässig im Alltag landet.

OPENAI03.09.2026

GPT-6 Astra

Der grösste Sprung liegt bei Computer- und Browserarbeit – nicht beim Smalltalk.

72,6%OSWorld 2.0
~40 minpro Aufgabe
1,9×schneller auf Mind2Web

Astra führt längere Aufgaben fort, erzeugt stärkere Dokumente, Slides und Sites und bekommt in Codex ein experimentelles Langzeitgedächtnis. Der Preis von 10/50 US-Dollar pro Million Ein-/Ausgabetokens macht es jedoch zu einem Spezialwerkzeug.

SIGNAL 9/10 Primärquelle ↗
ANTHROPIC01.09.2026

Claude Fable 5.1

Ausdauer, Wissenschaft und weniger Fehlalarme – mit vorsichtigem Vertrauensvorschuss.

Anthropic positioniert Fable 5.1 für lange Coding-, Forschungs- und Automatisierungsläufe. Cache-Änderungen sollen typische Rechnungen um rund 25 Prozent reduzieren, bei stark agentischen Lasten bis 45 Prozent.

Vorbehalt: Die stärksten Resultate stammen aus Anbieter-Benchmarks und frühen Partnerprojekten. Anthropic nennt selbst Lücken bei Approval-Bypasses sowie Tests für Long Context und Multi-Agenten.

SIGNAL 8/10 Primärquelle ↗
GOOGLE02.09.2026

Gemini 3.8 Flash

Das aggressivste Preis-Leistungs-Signal – mit 1 Mio. Kontext und Agentenfokus.

Google bringt bereits das dritte Flash-Update in sechs Wochen. Bis Ende 2026 gilt ein Einführungspreis von 0,75/3,75 US-Dollar pro Million Tokens; danach verdoppelt er sich. Das Modell zielt auf Coding, autonome Agenten und lange Kontexte.

Vorbehalt: Die Taktzahl erschwert stabile Evaluation. Die Model Card nennt Halluzinationen, Timeouts und eine Regression in multilingualer Sicherheit.

SIGNAL 8/10 Primärquelle ↗
MISTRALJUN–AUG 2026

Kein einzelnes Modell. Ein nützlicher Stack.

OCR 4, Agentic Search, Shieldstral und versionierte Skills ergeben ein ungewöhnlich praxisnahes Paket.

  • OCR 4: 170 Sprachen, strukturelle Dokumentausgabe, Self-Hosting.
  • Agentic Search: mehrstufige Recherche statt One-shot-RAG.
  • Shieldstral: offener 3B-Sicherheitsklassifikator für eine 16-GB-GPU.
  • Studio: Versionen, Rollen, Rollback und Audit für Prompts/Skills.
SIGNAL 9/10 Agentic Search ↗
GOOGLE04.09.2026

Lyria 3.5

Musikgenerierung erreicht gleichzeitig Consumer-App, Kreativwerkzeuge und Entwickler-API.

Google verspricht ausdrucksstärkere Stimmen und reichere Arrangements. Belastbarer als diese Qualitätsaussage ist die Distribution: Lyria 3.5 ist weltweit in Gemini sowie über Gemini API, AI Studio, Flow Music und Google Vids verfügbar.

Vorbehalt: „Best-sounding“ ist eine Anbieterbewertung. Ohne unabhängige Hörtests bleiben Qualität, Rechtefragen und konsistente Steuerbarkeit offen.

SIGNAL 7/10 Primärquelle ↗
OPENAI09.07.2026

GPT-5.6: Modelle werden Produktlinien

Sol, Terra und Luna machen die Kostenentscheidung sichtbar.

Sol für anspruchsvolle, lange Arbeit; Terra als ausgewogener Standard; Luna für schnelle Volumenaufgaben. In Work und Codex kommen programmatische Tool-Aufrufe und Multi-Agenten hinzu.

SIGNAL 7/10 Primärquelle ↗
XAIJUL–AUG 2026

Grok expandiert in jede Arbeitsfläche

Grok 4.6, Automations, Bot und Office-Integrationen zeigen den Plattformkampf.

Das Signal ist weniger ein einzelner Benchmark als die Breite: dauerhaft laufende Agenten, Trigger per Zeit oder E-Mail und Integrationen in Coding- sowie Büro-Umgebungen.

Hype-Risiko: „Hunderte Agenten“ bedeuten nicht automatisch einen vernünftigen Prozess. Datenzugriff, Kosten und Fehlerverantwortung bleiben das eigentliche Designproblem.

SIGNAL 6/10 Primärquelle ↗
MCP28.07.2026

Das Protokoll wird stateless

Ein technisches Update mit grossen Folgen für alle, die alte MCP-Tutorials nachbauen.

Die 2026-07-28-Spezifikation entfernt Protokollsitzungen und den Initialize-Handshake, führt Discovery und Scopes ein und verschiebt Tasks in eine Erweiterung. HTTP+SSE ist veraltet; Streamable HTTP ist der neue Pfad.

SIGNAL 9/10 Changelog ↗
GOOGLE17.06.2026

ARD: Wie Agenten Werkzeuge finden

MCP verbindet bekannte Tools. Agentic Resource Discovery soll auffindbar machen, welche es überhaupt gibt.

Die offene Spezifikation beschreibt Kataloge und Registries für MCP-Server, A2A-Agenten und OpenAPI-Tools. Das ist Infrastruktur für ein offenes Agenten-Web – vorerst aber noch eine Wette auf Adoption.

SIGNAL 7/10 Primärquelle ↗
ANTHROPIC14.08.2026

Unsichtbare Wasserzeichen im Text

AI-Transparenz wird zur Modelleigenschaft.

Claude soll künftig per tokenbasierter Zufallssteuerung wasserzeichnen – ohne versteckte Zeichen oder zusätzliche Tokens, basierend auf Googles SynthID Text. Kurze und stark faktische Texte bleiben schwer erkennbar.

SIGNAL 7/10 Primärquelle ↗
APPLE08.06.2026

Siri wird zur privaten Agentenschicht

Apple integriert grössere Modelle, persönlichen Kontext und eine neue Foundation-Models-API.

Interessanter als der Modellname ist die Architektur: on-device, Private Cloud Compute und eine Swift-API für lokale, serverseitige und bildfähige Modelle. Apple arbeitet für Teile der Modellschicht mit Google zusammen.

SIGNAL 8/10 Primärquelle ↗
PHYSICAL AIJUL–AUG 2026

Agenten verlassen den Bildschirm

Mistrals Robostral navigiert per RGB-Kamera; Anthropic standardisiert Labor- und Fertigungsgeräte.

Der Model Hardware Standard macht Gerätefähigkeiten über MCP zugänglich. Das ist noch Forschungsinfrastruktur – aber ein Hinweis darauf, dass „Tool Use“ bald Pipetten, Mikroskope und Roboter einschliesst.

SIGNAL 7/10 MHS ↗
MARKT28.08.2026

Cursor, SpaceX und das Plattformrisiko

Nach der Cursor-Übernahme durch SpaceX will OpenAI die Modellbelieferung im November beenden.

Unabhängig von den Vertragsdetails ist die Lehre klar: Ein Coding-Workflow, der an Anbieter, IDE und Modell gleichzeitig gebunden ist, kann über Nacht seine Grundlage verlieren.

03 · AGENTENWERKSTATT

Vom Demo-Zauber zum belastbaren Ablauf

Die Produkte ähneln sich: planen, Werkzeuge nutzen, im Hintergrund arbeiten. Der Unterschied entsteht durch Kontrolle, Quellen und Evaluation.

1AuftragZiel und Grenzen
2KontextDateien und Quellen
3ToolsMCP, Browser, Code
4KontrolleApproval und Logs
5ErgebnisTest und Übergabe
CHATGPT WORK + CODEX

Stärkste integrierte Werkbank

Apps, Dateien, Browser, Code, Skills und geplante Arbeit greifen ineinander. Der Mehrwert ist besonders hoch, wenn aus Recherche direkt ein Dokument, eine Präsentation oder eine Site entstehen soll.

Geeignet für: Recherche, technische Umsetzung und wiederkehrende Wissensarbeit.

CLAUDE CODE + COWORK

Stark bei langen, vorsichtigen Aufgaben

Anthropic optimiert sichtbar auf Ausdauer und strukturierte Zusammenarbeit. Fable 5.1 verspricht weniger Unterbrechungen und bessere Cache-Ökonomie.

Geeignet für: grosse Codebasen, tiefe Analyse und eine unabhängige Review-Perspektive.

GEMINI + ANTIGRAVITY

Preis und Kontext als Hebel

Gemini 3.8 Flash verbindet sehr langen Kontext mit günstigem Einführungspreis. Interessant für grosse Quellensammlungen, wenn Qualität und Latenz mit eigenen Tests kontrolliert werden.

Geeignet für: umfangreiche Dokumente, Google-nahe Prozesse und kostensensitives Batchen.

MISTRAL STACK

Kontrollierbare Bausteine

OCR, Suche, Guardrails, Connectoren und versionierte Skills sind weniger spektakulär als ein Supermodell – aber näher an einer betreibbaren Wissensplattform.

Geeignet für: europäische Infrastruktur, Dokumenten-RAG und kontrollierbare Deployments.

04 · MCP & STANDARDS

Die neue Agenten-Lieferkette

Vier Begriffe, die man auseinanderhalten sollte.

01

Agent

Plant und entscheidet den nächsten Schritt.

02

Tool-Katalog

Zeigt, welche Fähigkeiten existieren und wem sie gehören.

03

Dienst oder Gerät

API, Datei, Datenbank – künftig auch Laborhardware via MHS.

MCP ist kein Zauberadapter.

Es standardisiert den Austausch. Rechte, Datenqualität, Rate Limits und Fehlerbehandlung bleiben Aufgaben der Implementierung.

Alte Tutorials altern schnell.

Für neue Implementierungen gelten die Spezifikation 2026-07-28, stateless Design, Streamable HTTP, Scopes und explizite Tool-Freigaben als sinnvoller Ausgangspunkt.

Deterministisch schreiben, probabilistisch denken.

Ein Modell darf klassifizieren, planen und formulieren. Das Speichern, Versenden oder Löschen sollte ein klarer Workflow mit Approval ausführen.

05 · PRAXISRADAR

Vier Muster mit echtem Nutzen

Kein neues Tool ohne konkreten Anwendungsfall. Jeder Versuch sollte mit einer kleinen Messung enden.

01WISSEN

Aus Dokumenten einen belastbaren Wissensassistenten bauen

Eine kleine, repräsentative Dokumentensammlung mit OCR strukturieren und per Agentic Search erschliessen. Jede Antwort sollte auf konkrete Seiten oder Dokumente verweisen.

Messen: 20 reale Fragen · Trefferquote · korrekte Quellen · Zeitersparnis
2–3 h
02ARTEFAKTE

Mehrere Arbeitsprodukte aus einer Quelle erzeugen

Aus einem freigegebenen Quelldokument lassen sich Bericht, Präsentation, Checkliste und Kurzfassung ableiten. Fachlogik und Aussagen werden vor dem Export geprüft.

Messen: Korrekturen pro Artefakt · Gesamtzeit · Wiederverwendbarkeit
60 min
03AUTOMATION

Eingehende Anfragen sicher vorqualifizieren

Formular → Validierung → Modell klassifiziert das Anliegen und entwirft eine Antwort → menschliche Freigabe → Workflow versendet und protokolliert. Kein autonomes Senden im ersten Durchlauf.

Messen: Fehlklassifikationen · eingesparte Minuten · sensible Daten im Prompt
Halber Tag
04ROUTING

Einen aufgabenbasierten Modell-Router definieren

Luna/Terra/Flash für Alltag und Volumen; Sol oder Fable für tiefe Analyse; Astra nur für komplexe Computerarbeit und lange Projekte. Nicht nach Marke, sondern nach Aufgabe eskalieren.

Messen: Qualität · Laufzeit · Kosten · wie oft das Premium-Modell wirklich nötig war
30 min

06 · ÜBERSEHENE SIGNALE

Vier Dinge ausserhalb der Modellranglisten

Medienmodelle werden Infrastruktur

Lyria 3.5 ist nicht nur eine Gemini-Funktion, sondern zugleich API und Baustein für Vids. Damit wandert generative Musik in Video-, Marken- und Automatisierungsworkflows.

Lyria 3.5 ↗

Regulierung wird Modellfunktion

Wasserzeichen, Sicherheitsklassifikatoren und Audit-Logs sind nicht mehr nur Compliance-Anhang. Sie werden Teil der technischen Produktarchitektur.

Claude Watermark ↗

Apple gewinnt über den Kontext

Wenn Siri persönliche Daten lokal oder über Private Cloud Compute orchestriert, kann die beste Nutzererfahrung wichtiger werden als das stärkste Basismodell.

Siri AI ↗

Modellzugang ist Lieferkettenrisiko

Die Cursor-Episode zeigt: Exportierbare Prompts, offene Formate, Tests und austauschbare Modelle sind kein Nerd-Luxus, sondern Business Continuity.

Fall Cursor ↗

07 · KILBI-URTEIL

Hype oder echter Fortschritt?

FORTSCHRITT+
  • Computer-Use wird schneller und verlässlicherhoch
  • Agentic Search ersetzt schwaches One-shot-RAGhoch
  • Günstige Modelltiers ermöglichen Routinghoch
  • Prompts, Skills und Tools werden versionierbarmittel
  • Offene Standards verbinden Software und Hardwarefrüh
  • Incident Response wird Teil der Agentenarchitekturhoch
HYPE!
  • AGI-Schlagzeilen aus einem Benchmarkhoch
  • „Autonom“ ohne Fehlerbudget und Approvalhoch
  • Agentenzahl als Qualitätsmerkmalhoch
  • 1 Mio. Kontext als Ersatz für gute Suchemittel
  • Neue Releases ohne eigene Regressionstestsmittel
  • Sicherheitsversprechen ohne zeitnahe Offenlegunghoch

Die nächste Stufe der KI ist kein einzelnes Supermodell. Sie ist ein gut kontrollierter Arbeitsprozess, der das richtige Modell, die richtigen Quellen und einen klaren menschlichen Entscheidungspunkt zusammenbringt.

— KILBI, September 2026

08 · QUELLEN & METHODE

Primärquellen statt Echo

Stand 6. September 2026, 08:16 CEST. Anbieter-Benchmarks und Unternehmensangaben wurden redaktionell eingeordnet, aber nicht unabhängig reproduziert.

Wie KILBI bewertet: Praxisnutzentechnische SubstanzReifegradLock-in-RisikoBeleglage

Fragen zur Tagesausgabe

Frag KILBI

Begriffe verstehen, Meldungen einordnen, passende Beiträge finden. Der KI-Assistent antwortet anhand dieser Ausgabe und nennt bei fehlenden Informationen seine Grenzen.

KI-Antworten können Fehler enthalten; prüfe die verlinkten Beiträge. Beim Senden werden deine Frage und die letzten Gesprächsbeiträge zur Beantwortung an Infomaniak AI Services in der Schweiz übermittelt. Gemäss Anbieter werden die Anfragen weder gespeichert noch zum Modelltraining verwendet. Keine vertraulichen oder personenbezogenen Daten eingeben. KILBI speichert keine Chatverläufe; sie bleiben nur bis zum Neuladen in diesem Tab. Zum Schutz vor Missbrauch werden kurzzeitig pseudonymisierte Anfragezähler geführt. Die Anzahl der Anfragen ist begrenzt.