ToolNavs KI-Tools entdecken
Tool einreichen Anmelden
Zurück zu KI-Pressekonferenz
24-Stunden-KI-Briefing: MiMo-V2.6 führt offene Rangliste an, OpenAI von B.C. verklagt

24-Stunden-KI-Briefing: MiMo-V2.6 führt offene Rangliste an, OpenAI von B.C. verklagt

KI-Pressekonferenz Admin 2 Aufrufe

Der AI-Überblick für heute (22. September): Xiaomi hat MiMo-V2.6 als Open Source veröffentlicht — die Pro-Version erreicht 46 Punkte im Artificial Analysis Intelligence Index und ist damit das beste Open-Weight-Modell. xAIs Grok 4.7 wurde am selben Tag gebenchmarkt: ebenfalls 46 Punkte, der Coding-Agent-Wert kletterte auf 56. Die kanadische Provinz British Columbia verklagt OpenAI wegen eines Schul-Amoklaufs — das Sicherheitsteam habe riskante Chats erkannt, aber nie die Polizei alarmiert. Und Linear hat offengelegt, wie es seinen CI-Engpass im Zeitalter des KI-Codings umgebaut hat.

Xiaomi veröffentlicht MiMo-V2.6 als Open Source: Pro erreicht 46 Punkte im Intelligence Index und führt die offene Rangliste an

Am 21. September kündigte Xiaomi in seinem offiziellen Blog die MiMo-V2.6-Serie an: zwei nativ multimodale Modelle, Pro und Flash, dazu Distill-Qwen-9B, über 7.000 RL-Task-Umgebungen und den Trainingscode — alles als Open Source.

MiMo-V2.6-Pro erreicht 46 Punkte (genau 46,32) im Artificial Analysis Intelligence Index und überholt Kimi K3 sowie Qwen3.8 Max als bestes Open-Weight-Modell; zu geschlossenen Spitzenmodellen wie Claude Fable 5.1 und GPT-6 Astra bleibt jedoch Abstand. Besonders auffällig: das „6-tägige livestreamte RL-Training" — Pro und Flash absolvierten je 30 Schritte mit rund 750.000 Trajektorien zu Kosten von etwa 2,62 Mio. bzw. 0,85 Mio. US-Dollar; die Out-of-sample-Werte von DeepSWE v1.1 stiegen um rund 17 bzw. 14 Punkte. Die API-Preise bleiben auf V2.5-Niveau, neu ist die Hosting-Stufe Pro-UltraSpeed mit bis zu 20-facher Ausgabegeschwindigkeit.

Weiterlesen: 小米发布 MiMo-V2.6:全模态双版本,把 Agent 执行层做进模型里 (/article/2026-xiaomi-released-mimo-v26-dual-versions-of-full-modality-integrating-the-agent-ex)

Grok 4.7 im Benchmark: 46 Punkte katapultieren xAI unter die Top-4-Labore, Coding-Agent erreicht 56

xAI hat Grok 4.7 am 21. September veröffentlicht; Artificial Analysis vergab sofort 46 Punkte im Intelligence Index — 2 mehr als Grok 4.6, womit xAI zu den vier besten Laboren des Index aufsteigt, aber noch 7 Punkte hinter Claude Fable 5.1 und GPT-6 (53) liegt.

Das Highlight ist Coding: Zusammen mit xAIs eigenem Coding-Agenten Grok Build erreicht das Modell 56 Punkte im Coding Agent Index, 9 mehr als 4.6, überholt GPT-5.6 Sol und landet in nativen Harness-Konfigurationen auf Platz vier. Elon Musk behauptete auf X, xAI liege beim agentischen Coding auf Rang drei — hinter nur Anthropic und OpenAI. Bei langlaufenden realen Berufstasks (AA-Briefcase) erreicht es 1657 Elo, 111 mehr als die Vorgängergeneration und nahe an Claude Opus 5; GDPval-AA liegt bei 1695 Elo (+90). Die Preise bleiben unverändert bei 2 US-Dollar Input / 6 US-Dollar Output pro Million Tokens.

British Columbia verklagt OpenAI: Sicherheitsteam erkannte riskante Chats, rief aber nie die Polizei

Am 21. September verklagte die Regierung der kanadischen Provinz British Columbia OpenAI und CEO Sam Altman vor dem US-Bundesbezirksgericht für den nördlichen Bezirk Kaliforniens (zuerst berichtet von Reuters). Auslöser ist der Schul-Amoklauf von Tumbler Ridge im Februar, bei dem 9 Menschen starben, die meisten davon Kinder.

Die Klageschrift wirft OpenAI vor: Der Täter Jesse Van Rootselaar wurde vom Sicherheitsteam als hochriskant eingestuft, nachdem er in ChatGPT-Gesprächen über Waffengewalt gesprochen hatte — doch das Unternehmen leitete die Warnung nie an die Strafverfolgungsbehörden weiter. Die Provinz hält die Tragödie für vermeidbar, fordert Schadenersatz unter anderem für Schulwiederaufbau und psychische Versorgung sowie eine gerichtliche Anordnung, die OpenAI zur Reform seines Umgangs mit potenziell gewalttätigen Gesprächen zwingt. Mehr als 30 Opferfamilien hatten bereits zuvor vor kalifornischen Bundesgerichten geklagt; ein OpenAI-Sprecher nannte den Fall eine „unsagbare Tragödie" und versprach Kooperation mit den Ermittlern.

Weiterlesen: 不列颠哥伦比亚省起诉 OpenAI:内部标记风险账号却未报警 (/article/2031-british-columbia-sues-openai-risk-account-flagged-internally-police-never-alerte)

Linear legt CI-Umbau offen: Je schneller die KI codet, desto teurer wird die Verifikation

Am 21. September veröffentlichte Linear im offiziellen Engineering-Blog eine Retrospektive seines CI-Umbaus — der Titel „CI costs are high" ist wörtlich aus dem Issue zitiert, das CTO Tuomas Artman zugewiesen hatte.

Die Kernthese trifft ins Mark: KI-Coding hat das Schreiben von Code exponentiell beschleunigt, doch jeder PR muss weiterhin durch die CI — die Verifikation wird zum neuen Engpass, treibt die Infrastrukturkosten hoch und lässt Entwickler wie Agenten auf Feedback warten. Nach dem Umbau ist die Test-Suite seit Jahresbeginn fast viermal so groß, die PR-Wartezeit sank trotzdem von über 6 auf knapp über 5 Minuten, die Unit-Test-Runner-Zeit halbierte sich. Das Rezept: Infrastruktur und Toolchain aufrüsten, blockierende Jobs optimieren, redundantes Setup streichen, Testausführung beschleunigen. Der Beitrag betont, dass diese Optimierungen auch jenseits von TypeScript für andere Sprachen und Toolchains gelten.

Dieses Briefing enthält 4 Meldungen, jede anhand einer offiziellen Quelle der letzten 24 Stunden verifiziert (offizielle Blogs, offizielle Ankündigungen, Artificial-Analysis-Benchmarks, Reuters-Exklusivbericht). Vier weitere Hinweise wurden ausgeschlossen: die Kimi-Browser-Erweiterung (die „WebBridge-Umbenennung" fand tatsächlich am 17. September statt), GGUF-Support in transformers (langjährige bestehende Funktion, kein neues Release), NVIDIA Nemotron 3.5 Lightning (Release vom 11. August) und Step 5 Preview (Release vom 18. September, außerhalb des 24-Stunden-Fensters).

Empfohlene Tools

Mehr