Aller au contenu principal
Expert Cybersécurité & IAv9.0
Centres de ressources conformité
Besoin d'un accompagnement expert ?
Devis personnalisé sous 24h — audit, conformité, incident
Checklists Sécurité — Audit & Durcissement
Formats disponibles
📄 PDF 📊 Excel 🌐 Web

11 checklists professionnelles couvrant 2 200+ points de contrôle. Téléchargement gratuit, aucune inscription.

Extended Thinking

ia

Définition

L'Extended Thinking (raisonnement etendu) est un mode de generation introduit par Anthropic dans Claude 3.7 Sonnet (2025) qui permet au modele de generer un 'thinking process' visible (chaine de pensee etendue) avant de produire sa reponse finale. Ce mode est la reponse d'Anthropic au mode de raisonnement o1 d'OpenAI et correspond a une forme de Test-Time Compute. Contrairement au Chain-of-Thought standard (ou le modele raisonne dans le meme flux de tokens que la reponse), l'Extended Thinking utilise des blocs de pensee separes (thinking blocks) qui peuvent etre exposes a l'utilisateur ou restes caches. Ces blocs peuvent etre tres longs (des dizaines de milliers de tokens) et permettent au modele d'explorer differentes pistes de raisonnement, de se corriger, de revenir en arriere. L'Extended Thinking est particulierement efficace pour : problemes mathematiques complexes (GPQA, AIME), code avec debug iteratif, analyses juridiques multi-facettes, raisonnement scientifique, et toute tache necessitant de peser plusieurs hypotheses avant de repondre. Sur SWE-Bench Verified, Claude 3.7 avec extended thinking atteint ~70%. L'API Claude permet de contrôler le budget de tokens de thinking via le parametre thinking_budget_tokens. Un budget plus eleve permet des raisonnements plus profonds mais augmente la latence et le cout. Le budget optimal varie selon la complexite de la tache — pour les questions simples, l'extended thinking est contre-productif. L'Extended Thinking a transforme la perception de Claude dans la communaute des developpeurs : de modele 'conversationnel' a modele 'raisonneur' capable de performances comparable a o1 sur les benchmarks de raisonnement hard, tout en restant accessible via l'API standard avec un simple parametre supplementaire.

Utilisation via l'API Anthropic

import anthropic

client = anthropic.Anthropic()

response = client.messages.create(
    model='claude-3-7-sonnet-20250219',
    max_tokens=16000,
    thinking={
        'type': 'enabled',
        'budget_tokens': 10000  # Budget de tokens de raisonnement
    },
    messages=[{
        'role': 'user',
        'content': 'Prouve que sqrt(2) est irrationnel en detaillant chaque etape logique.'
    }]
)

# Acces au thinking
for block in response.content:
    if block.type == 'thinking':
        print('THINKING:', block.thinking[:200], '...')
    elif block.type == 'text':
        print('REPONSE:', block.text)

Quand utiliser l'Extended Thinking

  • Problemes de raisonnement multi-etapes complexes (math, logique)
  • Analyse de documents juridiques ou scientifiques complexes
  • Debugging de code avec erreurs subtiles
  • Decisions ou plusieurs facteurs contradictoires doivent etre peser
  • Ne pas utiliser pour : questions simples, generation creative, FAQ

Articles liés

Un projet cybersécurité ?

Expert dispo · Réponse 24h

Devis