Anthropic a annoncé le lancement de Claude Opus 4.5, une nouvelle génération de grands modèles de langage, en tant que version phare de la série Claude 4.5, axée sur des scénarios de travail à haute intensité tels que la génération de code, l’orchestration d’agents et l’utilisation générale de l’ordinateur. Les responsables le décrivent comme l’un des modèles Claude les plus puissants disponibles, mettant l’accent sur des améliorations significatives de performance par rapport à la génération précédente d’Opus 4.1 dans les tâches bureautiques complexes, le traitement de texte long et les applications professionnelles.
En termes de fonctionnalités techniques, Claude Opus 4.5 améliore la profondeur du raisonnement et les capacités de mémoire longue portée, optimise pour des tâches professionnelles telles que l’ingénierie logicielle, la modélisation de tables et l’analyse financière, et ajoute des paramètres d'« effort » ajustables pour faciliter l’équilibre entre le détail de la réponse et le coût en puissance de calcul. Les données de benchmark publiques montrent que le modèle obtient de très bons résultats en codage et en évaluations d’agents tels que SWE-bench Verified, surpassant ses prédécesseurs Opus 4.1 et Sonnet 4.5 en termes d’opérations de terminal, d’appels d’outils et de tâches d’environnement informatique, tout en abaissant encore le seuil d’utilisation des capacités de niveau phare en termes de prix.
Actuellement, Claude Opus 4.5 a été ouvert aux utilisateurs via les propres applications et API d’Anthropic, et a été connecté à des clouds et plateformes de développement grand public telles que Microsoft Foundry (incluant la version payante GitHub Copilot et Copilot Studio), Amazon Bedrock, Databricks, etc., couvrant divers scénarios tels que le développement d’entreprise, l’automatisation de bureau et le déploiement d’agents. Parallèlement, l’industrie s’inquiète également de ses performances en matière de sécurité et de prévention des abus, et certains estiment que la capacité du modèle à rejeter les requêtes de codage malveillantes a été améliorée, mais il reste encore une marge de manœuvre pour contourner la génération de malwares et les mauvais usages informatiques, et les mécanismes de protection pertinents sont encore en cours d’amélioration.
FAQ
Q : Qu’est-ce que le Claude Opus 4.5 ?
R : Claude Opus 4.5 est la dernière génération de modèles phares de grande taille publiée par Anthropic, appartenant à la série Claude 4.5, axée sur la génération de code complexe, la construction d’agents, l’automatisation de l’utilisation de l’ordinateur et les scénarios professionnels de bureau, et se positionne officiellement comme l’un de ses modèles polyvalents les plus puissants.
Q : Quelles sont les principales améliorations de Claude Opus 4.5 en termes de codage et d’agents ?
R : Ce modèle renforce la compréhension du code inter-fichiers et les capacités de raisonnement à long terme, peut réaliser des tâches de refactorisation, de génération de tests et de développement en plusieurs étapes dans de grandes bases de code, et obtient des résultats de premier plan dans plusieurs benchmarks de codage et d’agents, ce qui le rend plus adapté à la création d’agents de qualité production qui fonctionnent longtemps et peuvent appeler plusieurs outils et applications.
Q : Sur quelles chaînes Claude Opus 4.5 est-il disponible actuellement ?
R : Les utilisateurs peuvent utiliser Claude Opus 4.5 via les applications officielles et API d’Anthropic, et les entreprises et développeurs peuvent également l’utiliser sur des plateformes telles que Microsoft Foundry, GitHub Copilot, Copilot Studio, Amazon Bedrock, Databricks, etc., et certains services peuvent être ouverts par étapes ou sous forme d’essais limités.
Q : Y a-t-il eu un consensus sur le « modèle de codage, d’agents et d’utilisation informatique le plus puissant au monde » mentionné dans la publicité ?
R : Cette affirmation provient principalement du positionnement des responsables et des partenaires, mettant en avant les avantages de Claude Opus 4.5 dans les tâches de codage, d’agents et d’utilisation informatique. Actuellement, il existe plusieurs benchmarks publics et évaluations des développeurs pour soutenir ses performances de pointe dans les tâches connexes, mais il existe des différences selon les scénarios et indicateurs de test, et un classement unifié et autoritaire n’a pas encore été établi dans l’industrie.
Q : Quels sont les risques à prendre en compte lors de l’utilisation de Claude Opus 4.5 ?
R : Bien que Claude Opus 4.5 soit meilleur efficace pour rejeter certaines requêtes de code malveillantes et attaques potentielles, il peut néanmoins exister un risque d’abus dans des domaines tels que la génération de malwares, les mauvais opérations des terminaux, etc. Lors du déploiement de Claude Opus 4.5 pour gérer des systèmes critiques, les entreprises doivent coopérer avec le contrôle des permissions, les journaux d’opérations et les mécanismes de revue manuelle, et ne doivent pas confier complètement les ressources principales au contrôle indépendant des agents automatisés.