Le briefing IA du 8 octobre résume les dernières 24 heures : baisse des prix des modèles et agents sur l'appareil ont avancé en même temps. Anthropic a sorti un Haiku 5.5 moins cher et des crédits API pour ses abonnés, NVIDIA et Microsoft ont intégré l'environnement d'exécution des agents aux PC Windows, et un rapport sur des outils de pénétration IA contre des banques sud-coréennes rappelle que la défense doit suivre. Les sept informations ci-dessous ont été publiées ou rapportées les 7 et 8 octobre 2026 et remontent à leurs sources d'origine ; les sujets déjà traités en article séparé aujourd'hui, comme la version chat de GPT-6 et les modèles d'embedding de Perplexity, ne sont pas répétés.
Anthropic publie Claude Haiku 5.5 : contexte d'un million, prix au plus bas
Anthropic a mis en ligne Claude Haiku 5.5 le 7 octobre via la release GitHub de Claude Code v2.1.293, devenu le Haiku par défaut de l'API Anthropic : contexte d'un million de tokens, 0,10 dollar par million de tokens en entrée et 0,50 en sortie, puis 0,50 et 2,50 au-delà de 100 000 tokens de prompt. Le même jour, les comptes officiels ont annoncé deux baisses : la lecture de cache de Claude Sonnet 5.5 passe à 0,10 dollar par million de tokens, soit, selon l'entreprise, environ 20 % de coût en moins sur les longues tâches ; Claude Max et Team gagnent un crédit API Platform mensuel - 100 dollars pour Max 5x, 200 pour Max 20x, jusqu'à 500 partageables en Team - valable pour tous les modèles, Haiku 5.5 inclus. Économie directe pour les gros consommateurs, quota programmable en plus pour les abonnés individuels.
NVIDIA et Microsoft lancent RTX Spark : des PC Windows pensés pour les agents
NVIDIA a annoncé le 7 octobre sur son blog officiel construire avec Microsoft des PC Windows pour agents. La nouvelle plateforme RTX Spark associe un GPU Blackwell RTX jusqu'à 6 144 cœurs et un CPU Grace jusqu'à 20 cœurs, jusqu'à 128 Go de mémoire unifiée et environ un pétaflop en FP4. Les portables sont en précommande pour le 16 octobre, les desktops compacts suivront en novembre, chez Acer, ASUS, Dell, HP, Lenovo, Microsoft, MSI et Gigabyte. Côté logiciel, les conteneurs d'exécution Microsoft MXC sont disponibles, permettant aux agents de tourner en arrière-plan sous contrôle du système. Une DGX Station pour Windows a aussi été présentée, avec puce GB300, 748 Go de mémoire cohérente et jusqu'à 20 pétaFLOPS, de quoi faire tourner localement des modèles à l'échelle du billion de paramètres. Le terrain des agents se déplace du cloud vers le bureau.
Rapport : un attaquant seul aurait visé des banques sud-coréennes avec des outils IA
The Decoder a rapporté le 8 octobre, en citant CrowdStrike, qu'entre fin septembre et début octobre 2026, un attaquant présumé agissant seul aurait utilisé ARTEX, un outil open source de test de pénétration assisté par IA, contre plusieurs institutions financières sud-coréennes et volé de gros volumes de données ; pour la seule Shinhan Bank, plus de 25 000 dossiers avec noms, contacts, revenus et plafonds de crédit auraient été exfiltrés. Le régulateur financier a tenu une réunion d'urgence et le président a exigé une enquête complète. Ces outils trouveraient les failles automatiquement, permettant à une personne seule ce qui exigeait autrefois une équipe. Les détails reposent sur l'entreprise de sécurité et la presse, la confirmation complète des établissements reste attendue, mais le rythme des attaques bancaires a changé avec l'IA.
Des systèmes Nemotron affinés au niveau or à l'IOI et à l'IMO
L'équipe Nemotron de NVIDIA a publié le 7 octobre sur Hugging Face que ses systèmes bâtis sur Nemotron 3, avec affinage supervisé, apprentissage par renforcement et inférence guidée par retours, ont obtenu 535,4 points sur 600 à l'olympiade d'informatique IOI 2026 - au-dessus du seuil d'or et du meilleur score humain, lors d'une exécution non officielle dans les mêmes conditions - et 30 points sur 42 à l'olympiade de mathématiques IMO 2026, au-dessus du seuil officiel d'or de 29, avec des preuves notées par les correcteurs officiels. Modèles, données et recettes sont ouverts sur Hugging Face. Pour l'écosystème ouvert, la leçon est claire : données de domaine et boucle générer-vérifier-corriger au moment de l'inférence peuvent porter un modèle général au plus haut niveau sans réentraîner la base.
Microsoft Research ouvre Agent Lightning v1.0
Microsoft Research Asia a publié Agent Lightning v1.0 le 7 octobre sur son blog de recherche officiel, environ 3 500 lignes de code. L'idée : faire participer à l'entraînement par renforcement le harnais même qui exécute les agents en production, au lieu de réécrire leur logique dans un cadre d'entraînement. Cela réduit le coût d'ingénierie pour entraîner en continu de vrais agents métiers, et convient aux équipes qui exploitent déjà des produits d'agents. Le cadre est open source et volontairement léger.
Google ouvre le portail SynthID Detector
Google a présenté le 7 octobre via son compte officiel le portail SynthID Detector : l'utilisateur téléverse une image, une vidéo ou un audio, et le portail recherche les filigranes SynthID de Google ou de ses partenaires pour indiquer une éventuelle génération par IA. Il vérifie un filigrane, pas la vérité elle-même - l'absence de filigrane ne prouve pas une création humaine -, mais rédaction, modération et marques y gagnent un premier contrôle officiel et rapide de provenance.
GPT-6 Luna Decisions arrive sur OpenRouter
OpenRouter a annoncé le 7 octobre la disponibilité de GPT-6 Luna Decisions : une interface de décision pour applications qui accepte texte, JSON ou images et renvoie des choix typés avec probabilités, pour arbitrer entre modèles, outils ou actions. Tarif : 0,10 dollar par million de tokens en entrée, sortie gratuite, contexte d'un million ; selon OpenRouter, citant le compte développeur d'OpenAI, la décision serait jusqu'à dix fois plus rapide qu'en passant par la Responses API avec GPT-6 Luna. Les applications qui font beaucoup de routage et de classification ont intérêt à mesurer latence et précision sur un petit trafic avant de basculer.