Die letzten 24 Stunden in der KI-Welt standen im Zeichen zweier Parallel-Launches: OpenAI und Anthropic brachten am selben Tag neue Modelle und senkten am selben Tag die Preise – der Preiskrieg ist offiziell eröffnet. Metas hochprivilegierter Assistent sorgte derweil für eine Sicherheitsmeldung. Hier die 8 Meldungen im Schnelldurchlauf.
OpenAI bringt GPT-6 Sol und Luna – API-Preise halbiert
Am 22. September kündigte OpenAI in seinem offiziellen Blog zwei neue Mitglieder der GPT-6-Familie an. GPT-6 Sol ist für komplexes Coding und agentische Workflows gedacht und kostet 2 US-Dollar pro Million Input-Token und 10 US-Dollar pro Million Output-Token; das leichtere GPT-6 Luna liegt bei 0,10 bzw. 0,50 US-Dollar – halb so viel wie der Aktionspreis von GPT-5.6. Beide Modelle sind in ChatGPT Work, Codex und über die API verfügbar; Luna steht auch Free- und Go-Nutzern in der Desktop-App offen.
Die Botschaft: Token-Rechnungen für Agenten werden spürbar schlanker – Sol zielt auf hochfrequente Aufrufe, Luna auf einfache Aufgaben mit hohem Volumen wie Dokumentenzusammenfassungen oder Informationsextraktion. Da Anthropic am selben Tag ebenfalls senkte, erleben Entwickler einen seltenen Käufermarkt.
Anthropic kontert am selben Tag mit Claude Opus 5.5 – 40 % günstiger
Anthropic stellte am 22. September in einer offiziellen Mitteilung Opus 5.5 vor, das erste Modell der Claude-5.5-Reihe: 40 % niedrigere Kosten als Opus 5 bei typischen Workloads, Input und Output runter auf 4 bzw. 20 US-Dollar pro Million Token, über 30 % schnellere Ausgabe. Es führt bei Agenten-Coding- und Knowledge-Work-Benchmarks wie Terminal-Bench 4.0 und steht an der Spitze des Artificial Analysis Intelligence Index. Claude Code erschien am selben Tag in Version v2.1.280 und schaltet das Standard-Opus-Modell auf 5.5 um.
Dass beide Giganten am selben Tag launchen und senken, ist kein Zufall: Der Wettbewerb der Frontier-Modelle hat sich von „wer ist schlauer" zu „wer ist billiger und schneller" verlagert. Der direkte Vorteil für Nutzer: Die Fünf-Stunden-Limits der Pro-, Max- und weiterer Abo-Stufen steigen ebenfalls.
OpenAI verbessert Prompt-Caching für GPT-6 – bis zu 90 % Rabatt auf Cache-Reads
Ebenfalls am 22. September veröffentlichte OpenAI ein verbessertes Prompt-Caching-System samt Diagnose-Tools für GPT-6: höhere Cache-Trefferraten, schnellere Antworten und 90 % Rabatt auf gelesene gecachte Input-Token. Zusammen mit der Preissenkung werden lange Dialoge und häufig wiederholte Agenten-Workflows noch einmal deutlich billiger. Für Entwickler lohnt ein Blick auf das neue Caching-Dashboard in der Konsole, um zu prüfen, ob die eigenen Aufrufmuster den Rabatt wirklich mitnehmen.
Qwen bringt die Sprachmodellreihe Qwen-Audio-3.1 – mit kräftigen Preissenkungen
Am 23. September kündigte Qwen offiziell die Qwen-Audio-3.1-Serie an: ASR, TTS und Realtime wurden komplett überarbeitet, dazu kommen die zwei neuen Modelle TTS-Next und ASR-Next. Die Preise fallen quer durch die Bank – TTS um rund 70 %, Realtime um rund 85 %, ASR um bis zu 95 %. Auch im Voice-Segment tobt der API-Preiskrieg; unser AI-News-Kanal hat die Veröffentlichung heute bereits ausführlich behandelt, daher hier nur in Kürze.
Qwen-Image-2.1 erklimmt Platz 1 der Open-Source-Rangliste von Alibabas AI Arena
Am 23. September meldete Qwen, dass Qwen-Image-2.1 auf der hauseigenen Evaluierungsplattform AI Arena Platz 1 unter den Open-Source-Modellen für Bildbearbeitung und Text-zu-Bild belegt. Zu beachten: Es handelt sich um eine vom Anbieter betriebene Rangliste, unabhängige Drittbewertungen sind noch rar – für ein Urteil zur Praxisreife sollte man weitere Blindtests abwarten. Fest steht jedenfalls: Chinesische Open-Source-Bildmodelle klettern die öffentlichen Ranglisten rasant nach oben.
Zero-Day in Metas Muse – Hotfix bereits verteilt
Am 22. September meldete Ars Technica zuerst: Der macOS-Sicherheitsforscher Patrick Wardle hat in Metas neuem KI-Assistenten Muse eine Zero-Day-Lücke gefunden – jede lokale App konnte ohne besondere Rechte undokumentierte Muse-Einstellungen ändern, den Transkriptions-Endpunkt der Spracheingabe auf einen Angreifer-Server umleiten und so das gesamte Muse-Konto kapern. Wardles Proof-of-Concept zeigte u. a. stilles Schreiben von Dateien und das Auslösen der Kamera. Meta hat einen Hotfix verteilt und betont, es habe sich um lokale Rechteausweitung, nicht um Remote-Angriff gehandelt. Am selben Tag bestätigte Amazon, Meta aufgefordert zu haben, Einkäufe auf Amazon.com nicht länger über Muse abzuwickeln.
Bemerkenswert ist weniger die Lücke als die Architektur: Ein persönlicher Agent, der jede Berechtigung verlangt, wird bei Designschwächen weit gefährlicher als eine normale App. Metas Launch-Narrativ von der „sicheren VM" wurde damit gleich zu Beginn hart auf die Probe gestellt.
Pentagon-Untersuchung: Übermäßiges Vertrauen in Palantirs Maven-KI trug zu Schulangriff bei
Am 22. September berichtete Gizmodo unter Berufung auf eine Bloomberg-Recherche: Eine interne Pentagon-Prüfung ergab, dass veraltete Geheimdienstinfos, alte Satellitenbilder und das übermäßige Vertrauen von Personal des US Central Command in Palantirs Maven Smart System zu den Ursachen des Angriffs auf eine Schule in Minab, Iran, am 28. Februar gehörten – 123 Kinder starben. Ermittler zufolge gingen manche Bediener fälschlich davon aus, das System würde abgelaufene oder widersprüchliche Informationen automatisch markieren. Palantir entgegnete, für die zugrunde liegenden Daten nicht verantwortlich zu sein, und es gebe keine Belege für ein Verschulden der Software.
Es ist das erste Mal, dass KI-gestützte Entscheidungsfindung auf so verheerende Weise in den Fokus militärischer Rechenschaftspflicht rückt: Das Problem war nicht ein dummes Modell, sondern Menschen, die eine Prüfung, die sie selbst hätten vornehmen müssen, an das System ausgelagert haben.
OpenRouter veröffentlicht Guide zu den besten Embedding-Modellen 2026
Am 23. September veröffentlichte OpenRouter in seinem offiziellen Blog einen Guide zu den besten Embedding-Modellen 2026 mit 37 Verzeichniseinträgen. Teams, die RAG- oder Semantic-Search-Modelle auswählen, können ihn als Spickzettel nutzen, statt jede Dokumentation einzeln zu wälzen.