TPU
Nous expliquons la puce IA maison de Google : la feuille de route des TPU, de Trillium aux nouvelles générations, et leur rôle réel dans l'entraînement et l'inférence cloud des grands modèles.
Le TPU est la puce IA dédiée de Google : lancée en 2016 puis déclinée jusqu'à Trillium et aux architectures récentes, elle entraîne des modèles comme Gemini et fournit du calcul via Google Cloud. Optimisée en profondeur pour le calcul matriciel, elle porte l'infrastructure IA de Google — et Project Suncatcher doit l'éprouver en orbite. Nous suivons son évolution architecturale, ses performances mesurées, sa disponibilité cloud et sa vraie confrontation avec les GPU NVIDIA.