Aller au contenu principal
Expert Cybersécurité & IAv9.0
Centres de ressources conformité
Besoin d'un accompagnement expert ?
Devis personnalisé sous 24h — audit, conformité, incident
Checklists Sécurité — Audit & Durcissement
Formats disponibles
📄 PDF 📊 Excel 🌐 Web

11 checklists professionnelles couvrant 2 200+ points de contrôle. Téléchargement gratuit, aucune inscription.

HellaSwag

ia

Définition

HellaSwag (Harder Endings, Longer contexts, and Low-shot Activities For Situations With Adversarial Generations) est un benchmark de completion de phrase testant le raisonnement de sens commun, developpe par Zellers et al. (2019). Il propose 70K exemples de type : une situation est decrite, et 4 completions sont proposees dont 3 sont plausibles mais incorrectes (generees par un LLM adverse) et 1 est la vraie suite. L'originalite de HellaSwag est sa construction adversariale : les distracteurs (fausses reponses) sont generes par un modele adverse pour etre maximalement plausibles et pieger les LLMs. Exemple : 'Une personne cuisine. Elle met la poele sur le feu et verse de l'huile...' avec comme completions : (A) Elle mange son repas. (B) Elle remue les ingredients avec une spatule. (C) Elle lave la vaisselle. (D) Elle prepare un gateau. La bonne reponse est B, mais A et D sont plausibles. HellaSwag a joue un role important dans l'histoire de l'evaluation des LLMs : quand il a ete publie en 2019, les meilleurs modeles (BERT) atteignaient ~47% (les humains font 95%). Aujourd'hui, les modeles 70B+ depassent 90%, indiquant que HellaSwag est pratiquement sature pour les grands LLMs. Comme ARC-Challenge, HellaSwag est maintenant utilise principalement pour comparer des petits modeles (1-7B params) ou il reste discriminant. Pour les grands modeles, des benchmarks plus difficiles (GPQA, MMLU-Pro, ARC-AGI) ont pris le relais. HellaSwag est disponible dans LM-Eval-Harness (Eleuther AI) et fait partie du benchmark 'Open LLM Leaderboard v1' de HuggingFace, qui inclut aussi ARC-Challenge, MMLU, TruthfulQA, Winogrande et GSM8K pour un profil complet d'un modele 7B.

Exemple HellaSwag

Contexte : 'Ils preparent une sauce. D'abord ils font revenir des oignons dans l'huile d'olive.'

  • A) 'Ils ajoutent ensuite de l'eau froide et remuent.' (plausible mais incorrect — eau froide sur oignons = erreur culinaire)
  • B) 'Ils incorporent la tomate concassee et laissent mijoter.' (correct)
  • C) 'Ils retirent la poele du feu et vont faire leurs achats.' (incohérent temporellement)
  • D) 'Ils saupoudrent de sucre glace et de cannelle.' (incorrect — ce serait pour un dessert)

Scores HellaSwag (10-shot)

ModeleScore %
GPT-4 / Claude 3.5 Sonnet~95%
Llama 3.1 70B93.4%
Mistral 7B v0.381.3%
TinyLlama 1.1B59.2%
BERT large47.3%

Articles liés

Un projet cybersécurité ?

Expert dispo · Réponse 24h

Devis