ToolNavs Outils IA à découvrir
Proposer Connexion
Retour à Informations sur l’IA
DeepSeek a officiellement publié la version 4.1 Flash : Native Vision, avec la nouvelle architecture à partir de petits modèles

DeepSeek a officiellement publié la version 4.1 Flash : Native Vision, avec la nouvelle architecture à partir de petits modèles

Informations sur l’IA Admin 14 vues

DeepSeek a officiellement publié DeepSeek-V4.1-Flash. Officiellement défini comme le plus petit modèle de la nouvelle série d’architectures, supportant nativement la compréhension visuelle multimodale, avec des objectifs fondamentaux de capacité supérieure, d’inférence plus rapide, de débit plus élevé et d’évolutivité vers des modèles plus grands. Flash n’est plus seulement une « version bon marché » mais devient le premier lieu pour les architectures de nouvelle génération.

La nouvelle architecture est d’abord mise en œuvre sous forme de petits modèles

Dans les benchmarks officiels, la version Flash V4.1 a obtenu GPQA Diamond 90.9, Codeforces 3471, Terminal-Bench 2.1 90.6 et DeepSWE v1.1 74.2. BabyVision (avec outils) lié à Vision (avec outils) a obtenu 89,6, et Chartography (avec outils) 78,9.

Ces résultats proviennent des tests officiels de DeepSeek et ne peuvent pas être directement assimilés à une validation indépendante par un tiers. Mais la direction est claire : DeepSeek tente de condenser l’inférence, le code, les agents et les capacités de vision en un seul modèle à haut débit, plutôt que de continuer à diviser plusieurs points d’entrée dédiés.

Flash commença à prendre en charge les tâches de Pro

DeepSeek V4.1 Flash a maintenant lancé son API, et les noms de modèles ont été changés en deepseek-flash. La génération précédente de V4 Flash et V4 Flash Vision Exp ont été retirées ; les anciens noms de modèles restent compatibles pour le moment, et le routage est unifié vers la version V4.1 Flash.

Plus important encore, la gamme Pro. DeepSeek a déclaré qu’après de nombreux tests, la version Flash V4.1 surpasse la V4 Pro en termes de performances, de coût, de rapidité et de temps total. À partir de 12h00 le 14 septembre, avant la sortie de la V4.1 Pro, deepseek-v4-pro requêtes seront traitées par la version Flash 4.1 et facturées aux prix de Flash.

Le coût de l’inférence continue de diminuer

Les spécifications API reflètent également la priorité de l’efficacité d’inférence de l’IA : la version Flash V4.1 prend en charge 1 million de contexte, jusqu’à 384K de sortie, et a une limite de concurrence API de 2500 ; Pour comparaison, le V4 Pro actuel a une limite de concurrence de 500.

Pendant les périodes de pointe, le prix d’entrée par million de jetons mis en cache est de 0,003 $, le cache manqué est de 0,15 $, la sortie de 0,6 $, et le prix double pendant les périodes de pointe. La capacité se rapproche de Pro, et les prix restent au niveau Flash — ce sont les signaux commerciaux les plus directs pour cette mise à niveau.

La version Flash V4.1 ressemble davantage à une version pionnière de la nouvelle architecture de DeepSearch : d’abord utiliser de petits modèles pour vérifier la vision native, le haut débit et l’efficacité d’inférence, puis l’adaptation à des modèles plus grands. L’essentiel est ensuite de savoir jusqu’où V4.1 Pro va dépasser la limite supérieure des capacités de cette architecture.

Outils Recommandés

Plus