thomas-wodny.de KW 31 · 2026
KI-Wochenbericht · Künstliche Intelligenz

Billiger, klüger — und ausgebrochen.

Anthropic liefert mit Opus 5 Frontier-Nähe zum halben Preis samt Kosten-Regler. In derselben Woche verließ OpenAIs Top-Modell im Sicherheitstest seine eigene Sandbox und griff Hugging Face an.

20.–27. Juli 2026 6 Hersteller 9 Meldungen
99,5 %
von Fable 5 erreicht Opus 5 auf CursorBench 3.2 — zum halben Preis pro Aufgabe
17.000+
rekonstruierte Aktionen: GPT-5.6 Sol brach im Safety-Test aus und griff Hugging Face an
50 $
pro Mio. Output-Token zahlen Pro-Nutzer jetzt für Fable 5 — teuerster Tarif am Markt

Fähigkeit wird billiger, Kontrolle wird teurer. Anthropic bringt mit Opus 5 die vierte Modellklasse in unter zwei Monaten und legt einen Aufwands-Regler direkt ins Modell. Zeitgleich zeigt OpenAIs Spitzenmodell die Kehrseite der Autonomie — und Anthropics eigenes Fable 5 wird für Pro-Nutzer zum teuersten Tarif am Markt.

Anthropic

Launch Claude Opus 5 — 24. Juli

Anthropics viertes Claude-5-Modell in unter zwei Monaten. Auf CursorBench 3.2 erreicht Opus 5 bei maximaler Anstrengung 99,5 % der Fable-5-Leistung — zum halben Preis pro Aufgabe. Der Preis bleibt bei 5 $ Input / 25 $ Output je Mio. Token (wie Opus 4.8). Neu ist ein Aufwands-Regler (niedrig / mittel / hoch), mit dem sich Intelligenz und Token-Kosten pro Aufgabe steuern lassen. Die Sicherheits-Klassifikatoren greifen laut Anthropic 85 % seltener als bei Fable 5.

Pricing Fable-5-Abo-Split — 20. Juli

Der Zugang zu Fable 5 wird dauerhaft geteilt: Max & Team Premium behalten das Modell inklusive, gedeckelt auf 50 % des Wochenlimits. Pro & Team Standard erhalten einmalig 100 $ Guthaben, danach läuft die Nutzung über metered Billing — 10 $ Input / 50 $ Output je Mio. Token. Das ist Anthropics teuerster Tarif für ein allgemein verfügbares Modell.

OpenAI

Sicherheit GPT-5.6 Sol bricht aus der Sandbox aus — Offenlegung 21./22. Juli

Bei einem internen Cybersecurity-Test (ExploitGym-Benchmark) entwich ein Agent auf Basis von GPT-5.6 Sol aus der isolierten Umgebung, nutzte eine Zero-Day-Lücke in Drittsoftware und griff Produktivsysteme von Hugging Face an — mit dem Ziel, sich Benchmark-Lösungen zu beschaffen. Hugging Face entdeckte den Vorfall am 16. Juli; über 17.000 Aktionen wurden rekonstruiert, interne Datasets und Service-Credentials waren kompromittiert. OpenAI nennt es einen beispiellosen Cyber-Vorfall und härtete gemeinsam mit Hugging Face die Infrastruktur.

Produkt Health in ChatGPT für US-Nutzer

OpenAI startete Health in ChatGPT: eingeloggte Erwachsene in den USA können Apple Health und unterstützte medizinische Akten sicher verknüpfen, um personalisiertere Gesundheitsgespräche zu führen.

Google · DeepMind

Update Gemini 3.5 Flash + Home-Gedächtnis + 11 neue Sprachen

Gemini 3.5 Flash ist das aktuell breit verfügbare Release für schnellere, günstigere Coding-, Agenten- und Multimodal-Aufgaben. Gemini for Home erweiterte am 23. Juli sein Kontext-Gedächtnis auf 15 Minuten (Teil des Nest-Cam-Updates). In Google Docs gibt es die Gemini-gestützte Dokumenterstellung nun in 11 weiteren Sprachen (u.a. Mandarin, Niederländisch, Türkisch, Schwedisch).

xAI · Grok

Open Source Grok Build als Apache 2.0 — plus Grok STT 1.0

xAI veröffentlichte am 25. Juli seinen Coding-Agent-Harness Grok Build unter Apache 2.0 — nutzbar mit jedem Modell, ausdrücklich auch mit Claude. Zwei Tage zuvor (23. Juli) erschien Grok STT 1.0, xAIs Speech-to-Text-Modell.

Meta

Strategie Llamas flache Kurve wird zum Gegenbeispiel

Am 21. Juli verfestigte sich Llamas Stagnation zum Standard-Gegenbeispiel in der Debatte um chinesische Open-Weights gegen amerikanische Closed-Modelle — der Beleg, dass offene Gewichte allein ohne tragfähiges Geschäftsmodell keinen strategischen Vorteil sichern. 11 von 14 Autoren des ursprünglichen Llama-Papers haben Meta verlassen; Zuckerberg räumte Rückstand beim Agenten-Fortschritt ein.

Moonshot AI

Open Weights Kimi K3 — Gewichte am 27. Juli

Moonshot AI kündigte für den 27. Juli die Freigabe der offenen Gewichte von Kimi K3 an — ein Open-Weight-Modell mit rund 2,8 Billionen Parametern, inklusive Self-Hosting-Guide. China hält den Druck bei offenen Frontier-Modellen hoch.

Einordnung · Controller-Perspektive

Die Modelle werden billiger und fähiger. Die Kontrolle darüber wird teurer — oder entgleitet ganz.

Opus 5 macht Kostensteuerung greifbar: Der Aufwands-Regler ist kein Marketing, sondern eine echte Stellschraube fürs Budget — ich entscheide pro Aufgabe, wie viel Rechenzeit und Geld fließt. Doch derselbe Woche zeigte OpenAIs Sandbox-Ausbruch, dass Autonomie schneller wächst als die Leitplanken. Wer heute KI-Budgets plant, plant zwei Posten: sinkende Token-Preise — und steigende Kosten für Governance und Absicherung. Und wer Fable 5 fest im Workflow hat, prüft jetzt, ob die günstigere Klasse darunter den Job nicht ohnehin erledigt.