ToolNavs Outils IA à découvrir
Proposer Connexion
Retour à Point d’information sur l’IA
Briefing IA 24h : MiMo-V2.6 domine le classement ouvert, OpenAI poursuivi par la C.-B.

Briefing IA 24h : MiMo-V2.6 domine le classement ouvert, OpenAI poursuivi par la C.-B.

Point d’information sur l’IA Admin 2 vues

Le récap IA d'aujourd'hui (22 septembre) : Xiaomi a publié MiMo-V2.6 en open source — la version Pro obtient 46 points à l'Artificial Analysis Intelligence Index, devenant le meilleur modèle à poids ouverts. Le benchmark de Grok 4.7 de xAI est sorti le même jour : 46 points également, et son score d'agent de code grimpe à 56. La province canadienne de la Colombie-Britannique poursuit OpenAI au sujet d'une fusillade en milieu scolaire — l'équipe de sécurité aurait détecté des conversations à risque sans jamais alerter la police. Et Linear a dévoilé comment il a repensé son CI face au goulot d'étranglement de l'ère du code généré par l'IA.

Xiaomi publie MiMo-V2.6 en open source : la version Pro atteint 46 points à l'Intelligence Index et domine le classement ouvert

Le 21 septembre, Xiaomi a annoncé sur son blog officiel la série MiMo-V2.6 : deux modèles nativement multimodaux, Pro et Flash, plus Distill-Qwen-9B, plus de 7 000 environnements de tâches RL et le code d'entraînement — le tout en open source.

MiMo-V2.6-Pro obtient 46 points (46,32 précisément) à l'Artificial Analysis Intelligence Index, devant Kimi K3 et Qwen3.8 Max, devenant le premier modèle à poids ouverts ; il reste toutefois en retrait des fleurons fermés comme Claude Fable 5.1 et GPT-6 Astra. Le détail qui frappe : « 6 jours d'entraînement RL diffusés en direct » — Pro et Flash ont chacun accompli 30 étapes et environ 750 000 trajectoires, pour un coût d'environ 2,62 M$ et 0,85 M$ ; les scores hors échantillon de DeepSWE v1.1 progressent d'environ 17 et 14 points. Les tarifs API restent au niveau de la V2.5, et un nouveau palier d'hébergement Pro-UltraSpeed offre une vitesse de sortie jusqu'à 20 fois supérieure.

Pour aller plus loin : 小米发布 MiMo-V2.6:全模态双版本,把 Agent 执行层做进模型里 (/article/2026-xiaomi-released-mimo-v26-dual-versions-of-full-modality-integrating-the-agent-ex)

Benchmark de Grok 4.7 : 46 points propulsent xAI parmi les quatre meilleurs laboratoires, l'agent de code atteint 56

xAI a lancé Grok 4.7 le 21 septembre, et Artificial Analysis lui a aussitôt attribué 46 points à l'Intelligence Index — 2 de plus que Grok 4.6, ce qui propulse xAI parmi les quatre meilleurs laboratoires de l'indice, mais encore 7 points derrière Claude Fable 5.1 et GPT-6 (53).

Le point fort, c'est le code : associé à l'agent de code maison Grok Build, le modèle atteint 56 points au Coding Agent Index, en hausse de 9 par rapport à 4.6, devant GPT-5.6 Sol, et se classe quatrième en configuration harness native. Elon Musk a affirmé sur X que xAI se classe troisième du code agentique, derrière Anthropic et OpenAI seulement. Sur les tâches professionnelles réelles de longue haleine (AA-Briefcase), il atteint 1657 Elo, 111 de plus que la génération précédente, proche de Claude Opus 5 ; GDPval-AA monte à 1695 Elo (+90). Les tarifs sont inchangés : 2 $ en entrée / 6 $ en sortie par million de tokens.

La Colombie-Britannique poursuit OpenAI : l'équipe de sécurité avait détecté les conversations à risque, sans prévenir la police

Le 21 septembre, le gouvernement de la Colombie-Britannique (Canada) a poursuivi OpenAI et son PDG Sam Altman devant la cour fédérale du district nord de la Californie (révélé en premier par Reuters). L'affaire fait suite à la fusillade de l'école de Tumbler Ridge en février, qui a fait 9 morts, pour la plupart des enfants.

La plainte allègue que le tireur, Jesse Van Rootselaar, avait été classé à haut risque par l'équipe de sécurité d'OpenAI après avoir évoqué la violence armée dans des conversations ChatGPT — mais que l'entreprise n'a jamais transmis l'alerte aux forces de l'ordre. La province estime que la tragédie aurait pu être évitée, réclame des dommages-intérêts couvrant notamment la reconstruction de l'école et les soins de santé mentale, ainsi qu'une ordonnance judiciaire contraignant OpenAI à réformer son traitement des conversations potentiellement violentes. Plus de 30 familles de victimes avaient déjà porté plainte devant les tribunaux fédéraux californiens ; un porte-parole d'OpenAI a qualifié l'affaire de « tragédie indicible » et promis de coopérer avec les enquêteurs.

Pour aller plus loin : 不列颠哥伦比亚省起诉 OpenAI:内部标记风险账号却未报警 (/article/2031-british-columbia-sues-openai-risk-account-flagged-internally-police-never-alerte)

Linear dévoile sa refonte du CI : plus l'IA code vite, plus la vérification coûte cher

Le 21 septembre, Linear a publié sur son blog d'ingénierie officiel une rétrospective de sa refonte du CI — le titre « CI costs are high » reprend mot pour mot l'issue assignée par le CTO Tuomas Artman.

La thèse centrale fait mouche : le code généré par l'IA a rendu l'écriture de code exponentiellement plus rapide, mais chaque PR doit toujours passer par le CI — la vérification devient le nouveau goulot, fait grimper les coûts d'infrastructure et laisse développeurs et agents attendre le retour. Après la refonte, la suite de tests a presque quadruplé depuis le début de l'année, et pourtant le temps d'attente des PR est passé de plus de 6 minutes à un peu plus de 5, tandis que le temps des runners de tests unitaires a été divisé par deux. La recette : moderniser l'infrastructure et la chaîne d'outils, optimiser les tâches bloquantes, supprimer les configurations redondantes, accélérer l'exécution des tests. L'article souligne que ces optimisations valent aussi au-delà de TypeScript, pour d'autres langages et chaînes d'outils.

Ce briefing comprend 4 sujets, chacun vérifié auprès d'une source officielle des dernières 24 heures (blogs officiels, annonces officielles, benchmarks d'Artificial Analysis, exclusivité Reuters). Quatre autres pistes ont été écartées : l'extension navigateur de Kimi (le « renommage WebBridge » date en réalité du 17 septembre), le support GGUF dans transformers (fonctionnalité existante de longue date, pas une nouveauté), NVIDIA Nemotron 3.5 Lightning (sortie du 11 août) et Step 5 Preview (sorti le 18 septembre, hors de la fenêtre de 24 heures).

Outils Recommandés

Plus