Le 14 septembre 2026, Anthropic a révélé sur le blog officiel de Claude l’expérience d’expansion de son système interne d’intégration continue (CI) : Claude a participé à la rédaction d’environ 80 % du code, les équipes d’ingénierie ont livré en moyenne huit fois la quantité de code livrée chaque trimestre par rapport à 2021-2025, le nombre de tests a été décuplé et les tâches CI ont été multipliées par vingt en seulement six mois. Ce cas rappelle aux équipes déployant des agents de codage : après une augmentation de la vitesse de développement, les premiers sous pression ne seront peut-être pas les modèles ou les éditeurs, mais la sélection des tests, les files d’attente et le stockage d’état.
Pourquoi l’expansion temporaire échoue-t-elle si rapidement ?
Anthropic a essayé de passer à des machines plus grandes, de fragmenter par paquet, puis de redémarrer automatiquement après des échecs de processus. Les grandes machines ne duraient qu’environ 70 jours de plus, le sharding atteignait de nouveau son pic après environ 29 jours, et les redémarrages perdaient leur efficacité en moins d’une journée. La raison était que l’ancien système stockait l’historique des tests au sein d’un seul processus : les auditeurs recevaient les résultats et calculaient quels tests étaient liés aux modifications de code. À mesure que la charge de travail augmentait rapidement, le calcul, la mémoire et la récupération d’état se restreignaient mutuellement, et tout déploiement ou plantage continu amplifiait l’arriéré.
L’objectif de la reconstruction ne se limite pas à continuer à empiler les machines
L’équipe a ensuite divisé l’architecture en auditeurs sans état, stockage de données mémoire et processus de consommation de logs. Les écouteurs peuvent évoluer horizontalement, n’enregistrant que les résultats des tests ; Les consommateurs indépendants organisent les événements en historiques de maintenance de tests, et les sélectionneurs décident quels tests exécuter en fonction des résultats historiques et des corrélations de paquets. Anthropic a indiqué que le nouveau système est resté stable après le basculement, et un ingénieur a utilisé Claude pour compléter ce qui était auparavant près d’un quart en environ trois semaines.
Qu’est-ce que cela signifie pour les équipes d’adopter des agents de codage ?
- Conçu pour une croissance extrême : Anthropic recommande que les leaders de l’infrastructure anticipent une croissance de la charge de 25 fois sur deux trimestres, mais cela provient de leur propre entreprise et ne doit pas être appliqué mécaniquement comme une prévision industrielle unifiée.
- Découplage de l’état et du calcul : Laisser l’historique clé en dehors du processus permet d’éviter de perdre le contexte lors de l’expansion ou du redémarrage du nœud travailleur.
- Surveillez d’abord les entrées et sorties : un délai de 20 minutes dans les événements de test peut signifier des dizaines de milliers de mises à jour manquantes ; Le délai de file d’attente, le taux de réussite de sélection et le nombre d’exécutions en double devraient tous être des indicateurs clés.
- Économies de recalcul : Les agents génèrent du code plus rapidement, mais augmentent aussi les coûts de test, de mise en cache et de hachage, donc se concentrer uniquement sur la production de développement peut facilement surestimer les rendements nets.
Effectuer un exercice de capacité avant la mise en œuvre
Les entreprises n’ont pas besoin d’attendre que l’IC soit complètement congestionné avant d’agir. Vous pouvez d’abord compter le nombre de tests déclenchés par chaque fusion, la durée maximale de la file d’attente, le temps historique de récupération d’état et le coût par modification, puis simuler la concurrence 5x, 10x et 25x. Si le système dépend encore de la mémoire à nœud unique ou de redémarrages manuels pour le maintenir, la priorité doit être donnée à la modification des couches d’observabilité et d’état. Les chiffres d’Anthropic ne prouvent pas que toutes les équipes seront confrontées à la même courbe, mais ils envoient un signal clair : les plans d’approvisionnement pour les agents de codage doivent être revus en même temps que les budgets de l’infrastructure de livraison logicielle.