ToolNavs Outils IA à découvrir
Proposer Connexion
Retour à Informations sur l’IA
Guide de prompting Claude Opus 5.5 publié : le thinking est toujours actif, recalibrer l'effort lors de la migration

Guide de prompting Claude Opus 5.5 publié : le thinking est toujours actif, recalibrer l'effort lors de la migration

Informations sur l’IA • Admin • • 5 vues

Anthropic a publié le 28 septembre 2026 son guide de prompting pour Claude Opus 5.5 dans la documentation officielle de la plateforme Claude. Ce guide ne parle pas de la puissance du modèle — il ne traite qu'un seul sujet : quels prompts et configurations d'ingénierie hérités d'Opus 5 doivent changer. Il n'y a qu'un seul changement central — sur Opus 5.5, le thinking ne peut plus être désactivé.

Le plus grand changement : l'effort devient le premier levier de contrôle

Opus 5 permettait de désactiver le thinking à effort high ou inférieur ; Opus 5.5 n'accepte plus cette option. À la place, il y a le paramètre effort : 5.5 démarre par défaut à medium, contre high pour Opus 5. Dans les tests d'Anthropic, 5.5 à medium égale ou dépasse déjà Opus 5 à high sur le code et le travail de connaissance, avec low qui s'en approche sur certaines évaluations de code — pour un coût bien moindre.

Ne reportez pas telle quelle votre ancienne valeur d'effort lors de la migration : au même niveau, 5.5 réfléchit davantage par tour, surtout à xhigh et max, produisant des tours plus longs et plus de tokens. Anthropic recommande de partir de medium et de tester chaque niveau contre vos propres évaluations plutôt que de copier votre configuration Opus 5. Deux autres pièges faciles : le thinking compte dans max_tokens, donc une limite calibrée pour Opus 5 avec thinking désactivé peut tronquer les réponses — pour les longues tâches d'agents, 128 000 s'est avéré efficace ; et modifier la valeur d'effort de premier niveau invalide le cache de prompt, utilisez donc la fonction bêta per-message effort change pour ajuster un tour isolé tout en conservant le cache.

Quatre changements pour migrer depuis les configurations sans thinking

Si votre intégration tournait avec thinking désactivé, le guide liste quatre changements : commencer à low effort et mesurer, passer à medium si la qualité baisse ; supprimer les instructions qui demandaient au modèle d'écrire son raisonnement dans la réponse en substitut du thinking, et le lire plutôt dans les blocs de thinking résumé ; retester les atténuations de l'ère Opus 5 sans thinking et supprimer ce qui n'est plus nécessaire ; lire les réponses par type de bloc au lieu de supposer que le premier bloc est du texte — le contenu d'un bloc thinking est vide sous l'affichage par défaut.

Il y a aussi du nouveau côté sécurité : outre la biologie et la cybersécurité, une nouvelle catégorie de refus reasoning_extraction existe — les prompts qui poussent le modèle à reproduire son raisonnement interne dans le texte de réponse sont refusés, avec un stop_reason de refusal.

Deux pièges pour les agents sans surveillance

Sur les longues tâches, Opus 5.5 rapporte proactivement sa progression, et certaines de ces mises à jour terminent le tour en texte brut. Considérer une fin de tour en texte seul comme une tâche accomplie arrête une boucle sans surveillance trop tôt. Le guide recommande de la traiter comme un rapport, pas comme une preuve d'achèvement : suivez les sous-tâches dans une checklist ou un fichier, et si des éléments restent ouverts sans blocage déclaré, envoyez un court message utilisateur les nommant ; arrêtez après deux ou trois continuations automatiques sur la même tâche et examinez-la manuellement.

L'autre piège est le « silence » : les mises à jour de progression vivent dans les blocs thinking, dont le texte est vide sous l'affichage par défaut, si bien qu'un client qui ne rend que les blocs texte percevra les longs tours comme du silence radio. Activer l'option bêta display: "updates" fournit un résumé de chaque mise à jour.

Opus 5.5 n'a pas ajouté de nouveaux paramètres cette fois — il a remplacé le modèle de coût : avec le thinking toujours actif, les économies de tokens ne viennent plus de la désactivation de la réflexion mais du calibrage de l'effort au niveau dont la tâche a réellement besoin. Migrer, au fond, ce n'est pas changer un nom de modèle ; c'est revérifier une à une chaque hypothèse d'ingénierie écrite à l'époque où le thinking pouvait être désactivé.

Outils Recommandés

Plus