ToolNavs Outils IA à découvrir
Proposer Connexion
Retour à Point d’information sur l’IA
Briefing IA du 7 octobre : DeepSeek vise 80 milliards de yuans, le nouveau modèle phare de Mistral en préversion

Briefing IA du 7 octobre : DeepSeek vise 80 milliards de yuans, le nouveau modèle phare de Mistral en préversion

Point d’information sur l’IA • Admin • • 1 vues

Le briefing IA du 7 octobre résume l'essentiel des dernières 24 heures : l'argent et les modèles accélèrent en même temps. La nouvelle levée de DeepSeek atteindrait au moins 80 milliards de yuans, Mistral a mis son modèle phare d'un billion de paramètres en préversion publique, et Google, OpenAI et Anthropic ont chacun avancé sur les modèles d'embedding, la recherche en mathématiques et la collaboration bureautique. Les sept informations ci-dessous ont été publiées ou rapportées les 6 et 7 octobre 2026 et peuvent être retracées jusqu'à leurs sources d'origine.

DeepSeek lèverait au moins 80 milliards de yuans, avec Tencent et CATL

Bloomberg a rapporté le 6 octobre, suivi le même jour par Reuters, que DeepSeek est proche de boucler au moins 80 milliards de yuans (environ 11,9 milliards de dollars), au-dessus de son objectif initial d'environ 50 milliards, avec un montant final qui pourrait approcher 100 milliards. Tencent et le fabricant de batteries CATL figureraient parmi les plus gros contributeurs, et les articles évoquent aussi des préparatifs d'introduction en bourse sur le marché intérieur. Aucune des trois entreprises n'a confirmé publiquement ces chiffres, qui proviennent de personnes informées et peuvent encore évoluer avant la clôture. Le niveau de la course au financement entre les principaux concepteurs chinois de modèles n'en a pas moins monté d'un cran.

Mistral Large 4 en préversion publique, les poids à la fin du mois

Mistral a lancé le 6 octobre la préversion publique de son modèle phare Mistral Large 4, surnommé Le Chonk : environ un billion de paramètres au total, 49 milliards activés par token, multimodal natif, testable dès maintenant via l'API Mistral et OpenRouter, avec des poids ouverts prévus fin octobre. Arena a publié le 7 octobre son résultat en Code Arena WebDev, 1534 points et 45e place, en nette progression par rapport à la génération précédente. Les équipes qui veulent l'héberger elles-mêmes devront attendre les poids ; la préversion sert surtout à mesurer les performances réelles, par exemple en programmation.

EmbeddingGemma 2 : la recherche multimodale dans la poche

Google DeepMind a publié EmbeddingGemma 2 le 6 octobre sur son blog officiel : bâti sur l'architecture Gemma 4, avec 740 millions de paramètres et diffusé sous licence Apache 2.0, il projette texte, code, images, vidéo et audio dans un même espace d'embedding. Une fois quantifiée, la version multimodale complète ne demande qu'environ 567 Mo de mémoire vive sur un téléphone, et le contexte passe à 8K tokens. Pour les développeurs qui construisent de la recherche locale et du RAG hors ligne, c'est l'une des rares options d'embedding multimodal qui tournent directement sur l'appareil.

OpenAI publie des résultats de mathématiques d'un modèle frontière interne

OpenAI a publié le 7 octobre, sur son site officiel, un ensemble de nouveaux résultats mathématiques produits par un modèle frontière interne, diffusés sous forme de dépôt GitHub avec des règles de révision et de citation ; de nombreuses preuves sont formalisées en Lean et donc vérifiables par ordinateur. L'entreprise a aussi partagé des résumés de raisonnement et des estimations de calcul, un résultat moyen équivalant à environ trois heures de réflexion de ChatGPT Pro. Le modèle lui-même n'est pas encore publié : cette diffusion ressemble à une démonstration vérifiable de capacité de recherche.

Anthropic lance deux nouveautés : Claude entre dans Google Workspace

Anthropic a ouvert le 6 octobre la bêta publique de Claude for Google Workspace : une seule installation place Claude dans une barre latérale de Docs, Sheets et Slides, où il peut lire le fichier ouvert et modifier le texte, écrire des formules et créer des diapositives directement, en demandant confirmation par défaut avant chaque changement. Le guide des sessions cloud de Claude Code, publié le même jour, déplace les tâches de programmation vers le cloud : chaque tâche dispose de sa propre machine virtuelle et de sa propre branche, plusieurs peuvent avancer en parallèle, et le travail continue même ordinateur fermé. Les abonnés Pro et Max disposent aussi d'un crédit bonus à durée limitée, à réclamer jusqu'au 7 octobre.

ChatGPT gagne un plug-in Meetings qui assure le suivi

Un membre de l'équipe OpenAI a annoncé le 6 octobre la bêta du plug-in Meetings de ChatGPT : il prend des notes de réunion, puis exploite le contexte de travail de l'utilisateur pour produire des résumés personnalisés et des étapes suivantes, enregistrés dans un ChatGPT Space, en privé ou partagés avec l'équipe, et peut mettre à jour des plans de projet ou rédiger des relances. Il est d'abord proposé aux utilisateurs Pro et Business, l'offre Enterprise suivra. La concurrence des outils de réunion passe de la transcription à la capacité de faire avancer l'étape suivante.

GitHub reconstruit son infrastructure Git, les agents multiplient les commits

GitHub a révélé le 6 octobre sur son blog d'ingénierie que les événements Git mensuels ont atteint 473,3 milliards en août 2026, plus du double du niveau précédent ; septembre a compté 7,38 milliards de commits et 4,9 fois plus de pushes qu'un an plus tôt, les lectures et écritures simultanées des agents devenant le nouveau goulot d'étranglement. GitHub reconstruit son infrastructure Git en séparant le stockage durable du calcul, avec des bancs d'essai internes montrant un débit d'écriture jusqu'à 35 fois supérieur. Pour les équipes qui s'appuient fortement sur les agents de programmation, c'est la couche plateforme qui est refondée pour un développement à l'échelle des agents.

Outils Recommandés

Plus