thomas-wodny.de KW 32 · 2026
KI-Wochenbericht · Künstliche Intelligenz

Intelligenz wird verramscht. Tempo wird Premium.

OpenAI senkt die Token-Preise um bis zu 80 Prozent — und verkauft Geschwindigkeit zum doppelten Preis. Anthropic zerlegt den MCP-Standard. Und DeepMind steckt Frontier-KI in humanoide Roboter.

27.07.–02.08.2026 6 Hersteller 9 Meldungen
−80 %
GPT-5.6 Luna: jetzt 0,20 $ Input / 1,20 $ Output je Mio. Token
950+
MCP-Server im Claude-Verzeichnis — alle vor einem Migrationsprojekt
92 %
Erfolgsquote von Gemini Robotics 2 beim Glühbirnen-Herausdrehen

Tokens werden zur Commodity — die Marge zieht um. OpenAI verramscht Intelligenz und verkauft Geschwindigkeit zum doppelten Preis. Anthropic baut den Integrationsstandard der Branche radikal um. Und die Modelle verlassen den Chat: DeepMind und Mistral schicken KI in Roboterkörper.

OpenAI

Pricing GPT-5.6 Luna um 80 % billiger — 30. Juli

GPT-5.6 Luna kostet jetzt 0,20 $ Input / 1,20 $ Output je Mio. Token (vorher 1 $ / 6 $), Terra sinkt um 20 % auf 2 $ / 12 $. OpenAI begründet den Schritt mit Effizienzgewinnen im eigenen Stack — GPT-5.6 half mit, sich selbst billiger zu machen.

Trade-off Priority Processing gestrichen — Fast Mode kostet doppelt

Im selben Atemzug entfällt Priority Processing in der API. Der Ersatz heißt Fast Mode für GPT-5.6 Sol: bis zu 2,5-fache Geschwindigkeit zum doppelten Preis. Die Preislogik dreht sich um — Intelligenz wird billiger, Tempo wird Premium.

Retirement o3 fliegt am 26. August aus ChatGPT

OpenAI o3 wird nach 90-Tage-Sunset am 26. August 2026 aus ChatGPT entfernt. Wer Workflows auf das Modell verdrahtet hat, hat noch gut drei Wochen.

Anthropic

Standard MCP 2026-07-28 — der große Umbau

Die neue MCP-Spezifikation vom 28. Juli ist der größte Umbau seit Bestehen des Protokolls: stateless Core, Sessions und Initialize-Handshake abgeschafft, neues server/discover-RPC, Roots, Sampling und Logging deprecated. Über 950 MCP-Server im Claude-Verzeichnis — jeder Betreiber hat jetzt ungefragt ein Migrationsprojekt. So sieht es aus, wenn ein De-facto-Standard erwachsen wird.

Haltung Positionspapier zu Open-Weights — 27. Juli

Anthropic veröffentlicht „Our position on open-weights models" — in derselben Woche, in der Zuckerberg für offene Superintelligenz trommelt. Dazu: erweiterte Cognizant-Partnerschaft für den Enterprise-Rollout von Claude. Fürs Budget relevant: Der Sonnet-5-Einführungspreis (2 $ / 10 $) endet laut Sekundärberichten am 31. August — danach 3 $ / 15 $.

Google · DeepMind

Robotik Gemini Robotics 2 — Ganzkörper-KI für Humanoide — 30. Juli

Drei Modelle: Gemini Robotics 2 steuert humanoide Roboter komplett — von Füßen bis Fingerspitzen. ER 2 übernimmt Reasoning, Mehrschritt-Planung und Multi-Roboter-Kooperation. On-Device 2 passt sich in wenigen Stunden an neue Robotertypen an. Messwerte: 89,6 % bei Präzisions-Einfügeaufgaben, 92 % beim Glühbirnen-Herausdrehen. ER 2 ist in Google AI Studio als Private Preview verfügbar.

Meta

Strategie Zuckerbergs Offensive für offene Superintelligenz — 28. Juli

Im WSJ-Gastbeitrag fordert Zuckerberg, Superintelligenz „so breit wie möglich" zu verteilen — die direkte Antwort auf über 1.000 Beschäftigte führender KI-Labore, die zuvor staatliche Brems-Werkzeuge für die KI-Entwicklung gefordert hatten. Metas Geschäftsmodell hängt weiter an Open-Weights — die Branche sortiert sich entlang dieser Linie.

xAI · Grok

Voice grok-voice-think-fast-2.0 mit Speech-to-Speech

xAI veröffentlicht grok-voice-think-fast-2.0 mit Speech-to-Speech; das Routing von grok-voice-latest wird am 5. August umgestellt. Grok Build bekam mit v0.2.113/114 schaltbare MCP-Server per CLI und automatische Loop-Recovery.

Mistral

Robotik Erster Schritt in Embodied AI: 8B-Robotikmodell

Mistral bringt sein erstes Robotikmodell mit 8 Mrd. Parametern — kompakt genug für den Einsatz auf der Hardware selbst. Eine der meistdiskutierten Releases der Woche auf Hacker News. Nach DeepMinds Robotics-2-Familie das zweite Signal derselben Woche: Die Modelle verlassen den Chat.

Einordnung · Controller-Perspektive

Tokens werden zur Commodity. Die Marge wandert dorthin, wo Ausweichen schwer ist.

Luna kostet jetzt 20 Cent pro Million Tokens — aber wer Geschwindigkeit braucht, zahlt das Doppelte, wer Integrationen betreibt, zahlt mit Migrationsaufwand, und die nächste Plattform heißt Hardware. Wer KI-Budgets plant, sollte nicht auf den Token-Preis starren, sondern auf die neuen Kostenstellen daneben: Tempo, Integration, Roboter.