Extended Thinking
iaDéfinition
L'Extended Thinking (raisonnement etendu) est un mode de generation introduit par Anthropic dans Claude 3.7 Sonnet (2025) qui permet au modele de generer un 'thinking process' visible (chaine de pensee etendue) avant de produire sa reponse finale. Ce mode est la reponse d'Anthropic au mode de raisonnement o1 d'OpenAI et correspond a une forme de Test-Time Compute. Contrairement au Chain-of-Thought standard (ou le modele raisonne dans le meme flux de tokens que la reponse), l'Extended Thinking utilise des blocs de pensee separes (thinking blocks) qui peuvent etre exposes a l'utilisateur ou restes caches. Ces blocs peuvent etre tres longs (des dizaines de milliers de tokens) et permettent au modele d'explorer differentes pistes de raisonnement, de se corriger, de revenir en arriere. L'Extended Thinking est particulierement efficace pour : problemes mathematiques complexes (GPQA, AIME), code avec debug iteratif, analyses juridiques multi-facettes, raisonnement scientifique, et toute tache necessitant de peser plusieurs hypotheses avant de repondre. Sur SWE-Bench Verified, Claude 3.7 avec extended thinking atteint ~70%. L'API Claude permet de contrôler le budget de tokens de thinking via le parametre thinking_budget_tokens. Un budget plus eleve permet des raisonnements plus profonds mais augmente la latence et le cout. Le budget optimal varie selon la complexite de la tache — pour les questions simples, l'extended thinking est contre-productif. L'Extended Thinking a transforme la perception de Claude dans la communaute des developpeurs : de modele 'conversationnel' a modele 'raisonneur' capable de performances comparable a o1 sur les benchmarks de raisonnement hard, tout en restant accessible via l'API standard avec un simple parametre supplementaire.
Utilisation via l'API Anthropic
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model='claude-3-7-sonnet-20250219',
max_tokens=16000,
thinking={
'type': 'enabled',
'budget_tokens': 10000 # Budget de tokens de raisonnement
},
messages=[{
'role': 'user',
'content': 'Prouve que sqrt(2) est irrationnel en detaillant chaque etape logique.'
}]
)
# Acces au thinking
for block in response.content:
if block.type == 'thinking':
print('THINKING:', block.thinking[:200], '...')
elif block.type == 'text':
print('REPONSE:', block.text)Quand utiliser l'Extended Thinking
- Problemes de raisonnement multi-etapes complexes (math, logique)
- Analyse de documents juridiques ou scientifiques complexes
- Debugging de code avec erreurs subtiles
- Decisions ou plusieurs facteurs contradictoires doivent etre peser
- Ne pas utiliser pour : questions simples, generation creative, FAQ
Articles liés
Expert en cybersécurité offensive et intelligence artificielle. Pentest, audit et développement IA sur-mesure.
Services
- Audit Infrastructure
- Audit Kubernetes
- Audit Microsoft 365
- Audit Sécurité Réseau
- Analyse de Risques
- Audit Active Directory
- Audit Application Web
- Audit Cloud (AWS/Azure/GCP)
- Audit Messagerie
- Audit API (OWASP Top 10)
- Audit DevSecOps & CI/CD
- Audit Code Source (SAST)
- Audit Postes de Travail
- Audit Sauvegarde & Résilience
- Audit OT/SCADA (IEC 62443)
- Développement IA
- Formations
Ressources
Projets & Outils
© 2026 Ayi NEDJIMI Consultants. Tous droits réservés. 2.1.7
Un projet cybersécurité ?
Expert dispo · Réponse 24h