Daniel Szabo

Start / DIE KI-Revolution / KW 28/2026

DIE KI-Revolution KW 28/2026

Ausgabe 69Von Daniel Szabo

In dieser Ausgabe: Claude Sonnet 5: Agenten-Leistung nahe am Spitzenmodell für 2 Dollar pro Million Token; Das Ende des Token-Rausches; GPT-5.6 startet nur mit Erlaubnis aus Washington.

  1. Claude Sonnet 5: Agenten-Leistung nahe am Spitzenmodell für 2 Dollar pro Million Token
  2. Das Ende des Token-Rausches
  3. GPT-5.6 startet nur mit Erlaubnis aus Washington
  4. Export-Kontrolle für KI-Modelle: Mythos 5 teilweise zurück, Fable 5 bleibt gesperrt
  5. EU AI Act: Hochrisiko-Regeln verschoben, Kennzeichnungspflicht kommt trotzdem
  6. Five Eyes warnen vor KI-Cyberangriffen in Monaten, nicht Jahren
  7. Google verliert vier Top-Forscher und 270 Milliarden Dollar Börsenwert
  8. OpenAI sammelt 122 Milliarden Dollar ein, die größte Privatrunde der Geschichte
  9. OpenAI baut jetzt eigene Chips: Jalapeño soll Inferenz-Kosten halbieren
  10. 35 Prozent erwarten, dass KI in zwölf Monaten den Großteil ihrer Arbeit übernimmt

1. Claude Sonnet 5: Agenten-Leistung nahe am Spitzenmodell für 2 Dollar pro Million Token

Anthropic macht sein neues Mittelklasse-Modell zum Standard für alle Nutzer und senkt gleichzeitig den Preis.

Anthropic hat Claude Sonnet 5 am 30. Juni 2026 veröffentlicht. Seit dem 1. Juli ist es das Standard-Modell für alle Free- und Pro-Nutzer weltweit. Bis 31. August kostet es über die API 2 Dollar pro Million Input-Token und 10 Dollar für Output, danach 3 und 15 Dollar. Auf dem Kommandozeilen-Benchmark Terminal-Bench 2.1 springt es von 59,7 auf 80,4 Prozent, bei Büroarbeits-Tests schlägt es erstmals sogar das Flaggschiff Opus 4.8.

Darum zählt es: Der eigentliche Schritt ist nicht das Modell, sondern der Preis. Firmen haben im zweiten Quartal ihre KI-Budgets gesprengt, Anthropic reagiert und verlagert Agenten-Fähigkeit in die günstige Preisklasse. Wer Agenten bisher wegen der Kosten nicht produktiv einsetzen konnte, bekommt jetzt ein neues Rechenmodell. Vorsicht beim Umstieg: Der neue Tokenizer erzeugt bis zu 35 Prozent mehr Token aus demselben Text, die Ersparnis fällt real kleiner aus als das Preisschild suggeriert.

Was kann ich jetzt machen: Lassen Sie einen wiederkehrenden Mehrschritt-Prozess (Angebotserstellung, Reporting, Datenabgleich) mit Sonnet 5 als Agent durchrechnen. Vergleichen Sie Kosten pro erledigter Aufgabe, nicht Kosten pro Token.

2. Das Ende des Token-Rausches

Firmen stoppen ungebremste KI-Ausgaben und wechseln zu Kostendisziplin, CNBC nennt es das Ende des "Tokenmaxxing".

Uber hat sein Jahres-KI-Budget in vier Monaten verbrannt und deckelt jetzt auf 1.500 Dollar pro Mitarbeiter und Monat. Das Startup Lindy hat seinen kompletten Datenverkehr von Claude auf das chinesische Modell DeepSeek umgestellt und spart Millionen. Rund 95 Prozent der Firmen-Nutzung läuft weiter auf teuren Spitzenmodellen, obwohl Routing auf günstige Modelle 70 bis 90 Prozent der Kosten sparen kann.

Darum zählt es: Die Wachstumsraten von OpenAI und Anthropic sind heute so hoch wie nie wieder, sagt Analyst Gil Luria, das ist schlicht Mathematik. Wenn Kunden auf Effizienz umstellen, wackelt die Umsatzstory hinter den Billionen-Bewertungen, ausgerechnet vor den geplanten Börsengängen. Für Anwender dreht sich die Machtverhältnis: Nicht mehr der Modellanbieter setzt den Preis, sondern der Kunde mit der besten Routing-Architektur.

Was kann ich jetzt machen: Prüfen Sie Ihre KI-Rechnung nach dem Uber-Muster. Definieren Sie, welche Aufgaben ein günstiges Modell erledigen darf und wo das teure Spitzenmodell wirklich nötig ist.

3. GPT-5.6 startet nur mit Erlaubnis aus Washington

OpenAI zeigt seine neue Modellfamilie Sol, Terra und Luna, aber nur rund 20 von der US-Regierung geprüfte Partner dürfen sie nutzen.

OpenAI hat am 26. Juni GPT-5.6 vorgestellt: Sol als Spitzenmodell, Terra für den Alltag zum halben Preis, Luna für Massenaufgaben. Sol erreicht im Ultra-Modus 91,9 Prozent auf Terminal-Bench 2.1, neuer Bestwert. Breiter Zugang für ChatGPT und API soll "in den kommenden Wochen" folgen, ein Datum gibt es nicht. Terra kostet 2,50 Dollar Input und 15 Dollar Output pro Million Token.

Darum zählt es: Zum ersten Mal entscheidet eine Regierung mit, wer ein Spitzenmodell wann nutzen darf. Grundlage ist eine Executive Order vom 2. Juni, die Frontier-Modelle vor Veröffentlichung zur Sicherheitsprüfung anfordert. Die Terra-Preissetzung zielt präzise auf Anthropics Sonnet-Klasse, OpenAI kauft sich mit dem Regierungs-Schulterschluss zugleich politisches Wohlwollen vor dem Börsengang. Wer Produktpläne auf GPT-5.6 baut, plant ab jetzt mit einer politischen Variable.

Was kann ich jetzt machen: Pinnen Sie Ihre Produktiv-Systeme auf versionierte Modell-Endpunkte statt auf "latest". Bauen Sie einen zweiten Anbieter als Ausweichroute ein, bevor Sie ihn brauchen.

4. Export-Kontrolle für KI-Modelle: Mythos 5 teilweise zurück, Fable 5 bleibt gesperrt

Die US-Regierung erlaubt Anthropics stärkstes Cybersecurity-Modell wieder, aber nur für rund 100 US-Organisationen mit kritischer Infrastruktur.

Seit dem 12. Juni waren Anthropics Topmodelle Mythos 5 und Fable 5 per Notfall-Direktive exportgesperrt. Am 27. Juni kam die Teilfreigabe: Mythos 5 darf wieder an US-Betreiber kritischer Infrastruktur, etwa Energie, Finanzen und Telekommunikation. Alle anderen Kunden, auch alle API-Entwickler außerhalb der USA, brauchen weiterhin eine Exportlizenz. Fable 5 bleibt komplett gesperrt.

Darum zählt es: KI-Spitzenmodelle werden jetzt behandelt wie Rüstungsgüter, nicht wie Software. Für europäische Firmen heißt das konkret: Der Zugriff auf die stärksten US-Modelle hängt künftig an Genehmigungen aus Washington. Das ist das stärkste Argument seit Jahren, europäische und Open-Weight-Alternativen als Absicherung zu qualifizieren, nicht als Ideologie, sondern als Lieferketten-Management.

Was kann ich jetzt machen: Behandeln Sie Modell-Zugang wie jede kritische Lieferantenbeziehung. Dokumentieren Sie, welche Prozesse an welchem Modell hängen, und testen Sie eine Ausweichlösung pro Kernprozess.

5. EU AI Act: Hochrisiko-Regeln verschoben, Kennzeichnungspflicht kommt trotzdem

Der EU-Rat beschließt am 29. Juni eine Vereinfachung des AI Acts und verschiebt die Hochrisiko-Pflichten um bis zu 16 Monate.

Eigenständige Hochrisiko-Systeme müssen erst zum 2. Dezember 2027 konform sein, eingebettete Systeme in regulierten Produkten sogar erst zum 2. August 2028. Unverändert bleibt die Transparenzpflicht aus Artikel 50: Ab 2. August 2026 müssen KI-generierte Texte, Bilder, Audio und Video gekennzeichnet werden. Neue Verbote, etwa für KI-generierte intime Inhalte ohne Einwilligung, greifen schon im Dezember 2026.

Darum zählt es: Die Verschiebung ist Aufschub, kein Freifahrtschein, und sie betrifft nur den Hochrisiko-Teil. Die Kennzeichnungspflicht in vier Wochen trifft dagegen fast jedes Unternehmen, das KI-Inhalte veröffentlicht, vom Marketing-Bild bis zum generierten Produkttext. Wer jetzt Compliance-Projekte komplett stoppt, verwechselt die verschobene Baustelle mit der akuten.

Was kann ich jetzt machen: Inventarisieren Sie bis Ende Juli, wo in Ihrer Firma KI-Inhalte nach außen gehen. Klären Sie mit Marketing und Vertrieb, wie Sie ab August kennzeichnen.

6. Five Eyes warnen vor KI-Cyberangriffen in Monaten, nicht Jahren

Die Geheimdienst-Allianz aus USA, Großbritannien, Kanada, Australien und Neuseeland veröffentlicht eine seltene gemeinsame Warnung.

Das Papier vom 22. Juni trägt den Titel "The AI Shift in Cyber Risk" und stammt von NSA, CISA, GCHQ und Partnern. Kernsatz: Frontier-Modelle werden Erwartungen übertreffen, der Zeithorizont sind Monate, nicht Jahre. Die US-Behörde CISA verkürzt Patch-Fristen für Bundesbehörden auf drei Tage. Passend dazu fand Anthropics Modell Mythos 5 im Programm Glasswing über 23.000 Schwachstellen in 1.000 Open-Source-Projekten, in einem Monat.

Darum zählt es: Dieselbe Technik greift an und verteidigt, und die Verteidiger-Seite ist bereits messbar produktiv: Mythos fand einen 29 Jahre alten Fehler im Squid-Proxy, den jedes menschliche Audit übersehen hatte. Die Botschaft der Dienste an Geschäftsführungen ist unbequem: Cybersecurity wird Chefsache mit persönlicher Verantwortung, keine IT-Abteilungsfrage. Wer heute Wochen für Patches braucht, ist gegen KI-beschleunigte Angreifer strukturell zu langsam.

Was kann ich jetzt machen: Fragen Sie Ihren IT-Leiter nach der aktuellen Zeit von Schwachstellen-Meldung bis Patch. Liegt sie über einer Woche, machen Sie die Verkürzung zum Q3-Ziel mit Budget.

7. Google verliert vier Top-Forscher und 270 Milliarden Dollar Börsenwert

In einer Woche wechseln vier führende DeepMind-Forscher zu Anthropic, darunter Nobelpreisträger John Jumper.

Mit Jumper gehen Jonas Adler, Alexander Pritzel und Arthur Conmy, drei davon Kernautoren von AlphaFold. Parallel wechselt Transformer-Mitautor Noam Shazeer zu OpenAI. Alphabet verlor über zwei Handelstage mehr als 270 Milliarden Dollar Börsenwert. Gemini 3.5 Pro verpasst den zugesagten Juni-Termin und soll nun im Juli kommen.

Darum zählt es: Das ist keine Serie von Einzelentscheidungen, sondern eine Team-Migration: Die AlphaFold-Führung zieht geschlossen dorthin, wo ihr Leiter hingeht. Der Treiber ist Vor-Börsengang-Equity bei Anthropic und OpenAI, gegen dieses Angebot kommt selbst Google-Vergütung nicht an. Laut SignalFire wechseln DeepMind-Ingenieure elfmal häufiger zu Anthropic als umgekehrt. Talent folgt Momentum, und der Markt bepreist Talent jetzt sichtbar in der Aktie.

Was kann ich jetzt machen: Das Muster gilt auch im Mittelstand: Ihre besten Digital-Leute bekommen gerade Angebote. Prüfen Sie, ob Ihre Schlüsselkräfte einen Grund zum Bleiben haben, der über Gehalt hinausgeht.

8. OpenAI sammelt 122 Milliarden Dollar ein, die größte Privatrunde der Geschichte

OpenAI schließt eine Finanzierung über 122 Milliarden Dollar bei einer Bewertung von 852 Milliarden Dollar ab.

Anker sind Amazon, Nvidia und SoftBank, Microsoft bleibt beteiligt. Amazon wird exklusiver dritter Cloud-Partner und steuert 50 Milliarden Dollar bei. Am 1. Juli zahlte SoftBank die zweite 10-Milliarden-Tranche eines 30-Milliarden-Pakets. Parallel berichtet die Financial Times am 2. Juli über Gespräche, der US-Regierung bis zu 5 Prozent der Anteile zu übertragen, rund 42,6 Milliarden Dollar, über einen "Public Wealth Fund".

Darum zählt es: Die Runde ist weniger Finanzierung als Kriegskasse für Rechenzentren, das Geld fließt fast vollständig in Compute. Der mögliche Regierungsanteil ist der bemerkenswertere Teil: OpenAI kauft sich politische Rückendeckung in einer Phase, in der Washington über Modellzugang entscheidet (siehe Meldung 3). Gleichzeitig plant OpenAI 14 Milliarden Dollar operativen Verlust für 2026, die Rechnung setzt jahrelanges ungebremstes Wachstum voraus, genau das stellt der Effizienz-Trend aus Meldung 2 in Frage.

Was kann ich jetzt machen: Für Ihre Planung zählt eine Ableitung: Die Preise für Spitzen-KI bleiben politisch und strategisch subventioniert. Nutzen Sie das Zeitfenster, statt auf noch günstigere Konditionen zu warten.

9. OpenAI baut jetzt eigene Chips: Jalapeño soll Inferenz-Kosten halbieren

OpenAI und Broadcom stellen mit Jalapeño den ersten eigenen KI-Chip vor, entworfen in nur neun Monaten.

Der Chip ist ein reiner Inferenz-Prozessor, gebaut um die Anforderungen großer Sprachmodelle statt vom Allzweck-Beschleuniger abgeleitet. OpenAI nutzte die eigenen Modelle im Chipdesign. Broadcom-Chef Hock Tan nennt 50 Prozent Kostenersparnis als Ziel. Einsatz ab Ende 2026 in kleinem Maßstab, Gigawatt-Ausbau ab 2027 geplant.

Darum zählt es: Neun Monate bis zum Tape-out war bisher undenkbar, KI verkürzt jetzt die Entwicklungszyklen ihrer eigenen Hardware. Strategisch ist das ein Angriff auf die Nvidia-Abhängigkeit: Wer Inferenz auf eigenem Silizium halbiert, kann Preise senken, wenn der Wettbewerb es nicht kann. Interessant ist die Gegenwette: Das Startup Sail bekam in derselben Woche 80 Millionen Dollar für Software, die dieselbe Effizienz auf vorhandenen Chips verspricht, ohne neue Hardware.

Was kann ich jetzt machen: Kalkulieren Sie KI-Anwendungsfälle, die heute an den Kosten scheitern, mit halbierten Inferenz-Preisen für 2027 neu. Einige davon werden wirtschaftlich.

10. 35 Prozent erwarten, dass KI in zwölf Monaten den Großteil ihrer Arbeit übernimmt

Anthropics sechster Economic Index verknüpft erstmals Umfragedaten von 9.700 Nutzern mit realem Nutzungsverhalten.

Über 35 Prozent erwarten, dass KI binnen zwölf Monaten die meisten ihrer Arbeitsaufgaben erledigt. In rund 49 Prozent der Berufe läuft bereits mindestens ein Viertel der Aufgaben über Claude. In professionellen API-Anwendungen hat Vollautomatisierung die Zusammenarbeit als dominanten Modus überholt.

Darum zählt es: Die spannendste Zahl ist die Lücke: Beschäftigte schätzen das KI-Risiko für Junior-Rollen auf 40 Prozent, ihr eigenes deutlich niedriger. Genau diese Selbstüberschätzung kennt die Forschung aus jeder Automatisierungswelle, die am stärksten Betroffenen unterschätzen sich am meisten. Zweiter Befund: Erfahrene Nutzer, die KI als Kollegen behandeln statt Arbeit abzuwerfen, erzielen messbar bessere Ergebnisse. Der Vorsprung früher Anwender wächst, er schrumpft nicht.

Was kann ich jetzt machen: Bauen Sie Einarbeitung neuer Mitarbeiter um Urteilsvermögen herum, nicht um Routinetätigkeit, die KI ohnehin übernimmt. Und messen Sie, wer in Ihrem Team KI erfahren nutzt, diese Leute sind Ihre Multiplikatoren.

Jetzt am Puls der KI bleiben

Diese Woche hat sich entschieden, dass Modellzugang politisch wird und Kostendisziplin die neue Währung ist. Beides trifft jede Firma, nicht nur die Tech-Branche.

Abonnieren Sie DIE KI-Revolution, und gestalten Sie die Zukunft Ihres Geschäfts.habe auch einen UX-Agenten, der nochmal jeden einzelnen Screen anschaut und gegebenenfalls überarbeitet.

Auf LinkedIn teilen · ·

Verwandte Inhalte

So zitieren: Szabo, Daniel (6. Juli 2026): „DIE KI-Revolution KW 28/2026“. szabo.digital, https://szabo.digital/ki-revolution/kw-28-2026/

Jede Woche neu.

DIE KI-Revolution erscheint wöchentlich auf LinkedIn. Zehn Meldungen, jeweils eingeordnet, mit einem konkreten nächsten Schritt.

Auf LinkedIn abonnieren

Ursprünglich veröffentlicht auf LinkedIn.