StepFun a dévoilé Step 5 Preview le 20 septembre 2026, un modèle MoE de 600 milliards de paramètres ciblant les tâches agentiques longue durée, avec une fenêtre de contexte d'un million de tokens et des poids open-source prévus le 15 octobre.
En bref
- StepFun a lancé Step 5 Preview le 20 septembre 2026, un modèle sparse Mixture-of-Experts de 600 milliards de paramètres avec 27 milliards actifs par token.
- Conçu pour les agents IA longue durée — ingénierie logicielle, analyse financière, traitement de documents — avec une fenêtre de contexte d'un million de tokens.
- L'accès API est immédiat à 1 dollar par million de tokens en entrée ; les poids open-source seront publiés le 15 octobre 2026.
Ce qui s'est passé
Le 20 septembre 2026, StepFun, laboratoire d'intelligence artificielle fondé à Pékin par d'anciens chercheurs d'OpenAI et de Google DeepMind, a présenté Step 5 Preview, son nouveau modèle phare. L'annonce est intervenue simultanément sur les réseaux sociaux de la société et via une publication technique détaillée, accompagnée d'une ouverture immédiate de l'accès API pour les développeurs.
L'architecture repose sur un Mixture-of-Experts (MoE) sparse : le modèle compte 600 milliards de paramètres au total, mais seulement 27 milliards sont activés pour chaque token traité. Ce choix architectural, popularisé notamment par Mistral avec Mixtral et repris depuis par plusieurs laboratoires, permet d'atteindre des performances de pointe tout en réduisant les coûts computationnels à l'inférence. Techniquement, Step 5 Preview utilise un layout Transformer dit « narrow-deep » sur 92 couches, associé à une Sparse Grouped-Query Attention avec fusion par blocs de tokens — ce mécanisme réduit les coûts de sélection top-k à environ un huitième de ceux d'une architecture dense de taille comparable.
La fenêtre de contexte d'un million de tokens constitue l'un des atouts majeurs du modèle. À titre de comparaison, GPT-4o d'OpenAI propose une fenêtre de 128 000 tokens, tandis que Gemini 1.5 Pro de Google avait établi un précédent avec deux millions de tokens pour un usage limité. Step 5 Preview se positionne donc parmi les modèles commerciaux offrant les plus grandes capacités de contexte, ce qui ouvre des cas d'usage très concrets : analyse d'une base de code entière en une requête, traitement de rapports financiers volumineux, revue de dossiers réglementaires complets ou encore agents opérant sur des historiques de conversation longs.
Sur les benchmarks standardisés, Step 5 Preview affiche un score de 44 sur l'Artificial Analysis Intelligence Index, un indice agrégé qui évalue les capacités générales des LLMs. StepFun souligne des résultats particulièrement solides sur SWE-bench (ingénierie logicielle), MMLU-Finance (analyse financière) et GPQA Diamond (raisonnement professionnel de haut niveau). Le modèle prend en charge le texte et les images en entrée, bien que les capacités multimodales avancées restent en cours de développement selon la documentation officielle.
La stratégie tarifaire est délibérément agressive : 1,00 dollar par million de tokens en entrée, 2,70 dollars par million de tokens en sortie. Un rabais de 95 % est appliqué aux tokens mis en cache via le mécanisme de prompt caching, ce qui peut réduire drastiquement les coûts pour les applications avec des prompts système longs ou répétitifs. Par comparaison, les modèles haut de gamme d'Anthropic ou d'OpenAI se facturent entre 10 et 30 dollars par million de tokens d'entrée. Ce positionnement confirme la tendance déjà observée avec DeepSeek et Qwen : les laboratoires chinois utilisent le prix comme arme commerciale principale.
La publication open-source des poids du modèle est annoncée pour le 15 octobre 2026. Selon StepFun, les poids complets seront mis à disposition sous une licence permettant une utilisation commerciale avec certaines restrictions. Cette approche fait écho à celle de DeepSeek, Qwen d'Alibaba, GLM de Tsinghua University et Step 3 — les laboratoires chinois ont systématiquement choisi la distribution ouverte pour maximiser l'adoption internationale et exercer une pression sur les acteurs propriétaires occidentaux.
L'annonce s'inscrit dans une séquence dense de publications de modèles en septembre 2026. Selon les données de LLM Gateway, douze nouveaux modèles significatifs ont déjà été publiés ce mois-ci par huit fournisseurs distincts. GPT-6 Astra d'OpenAI, sorti début septembre, et Gemini 3.8 Flash de Google ont dominé les premières semaines. Step 5 Preview constitue une réponse directe à ces deux modèles sur le segment haut de gamme, avec une promesse de différenciation forte sur les capacités agentiques — c'est-à-dire la capacité du modèle à planifier, exécuter et itérer des tâches complexes de façon autonome sur des horizons temporels longs.
Le même jour, CXMT, fabricant chinois de puces mémoire, annonçait lors du World Manufacturing Convention 2026 de Hefei la production en masse de sa plateforme DRAM G5 de cinquième génération, avec deux produits LPDDR5X 24 Gb déjà intégrés dans des smartphones haut de gamme. Cette convergence entre avancées matérielles et logicielles illustre la profondeur de l'écosystème IA chinois qui se constitue progressivement en dehors des chaînes d'approvisionnement occidentales, sous pression des restrictions à l'export de semi-conducteurs.
Pourquoi c'est important
Step 5 Preview illustre une tendance structurelle devenue indéniable : la montée en puissance des laboratoires d'IA chinois sur le segment des modèles de frontier. Pendant plusieurs années, l'essentiel de l'innovation provenait des États-Unis — OpenAI, Anthropic, Google DeepMind, Meta AI. L'émergence de DeepSeek début 2025, puis de Qwen 3, GLM-5 et maintenant Step 5 Preview dessine un nouvel équilibre mondial dans lequel plusieurs pôles d'excellence coexistent, avec des approches architecturales, tarifaires et de distribution distinctes.
La stratégie open-source constitue un levier compétitif majeur. En rendant les poids disponibles gratuitement, StepFun s'assure une adoption rapide par les développeurs et les entreprises souhaitant déployer le modèle sur leur propre infrastructure, évitant la dépendance à un API tiers et les risques de confidentialité associés. Cette approche crée une pression commerciale directe sur OpenAI et Anthropic : si un modèle open-source de qualité comparable est accessible sans abonnement, justifier des tarifs premium devient structurellement plus difficile.
Du point de vue de la cybersécurité et de la souveraineté numérique, l'utilisation massive de LLMs développés et entraînés en Chine soulève des questions que les régulateurs européens commencent à formaliser. Le règlement européen sur l'IA (AI Act) impose des exigences de transparence et de documentation technique pour les modèles d'IA à usage général (GPAI) dépassant un certain seuil de puissance de calcul à l'entraînement. Avec 600 milliards de paramètres, Step 5 Preview entrerait probablement dans la catégorie des GPAI à impact systémique si commercialisé dans l'Union européenne, impliquant des obligations spécifiques de documentation, d'évaluation des risques et de coopération avec les autorités.
Pour les entreprises françaises et européennes, la disponibilité de Step 5 Preview représente une opportunité d'accéder à des capacités d'IA de pointe à un coût significativement réduit. Toutefois, une due diligence approfondie s'impose avant toute intégration : localisation des données d'entraînement et des inférences, politique de conservation des données, conformité RGPD, et risques spécifiques pour les environnements soumis à NIS2, DORA ou au secret des affaires.
Ce qu'il faut retenir
- Step 5 Preview est un MoE de 600B paramètres (27B actifs) avec fenêtre de contexte de 1M tokens, lancé le 20 septembre 2026 par StepFun.
- Les poids open-source seront disponibles le 15 octobre 2026 ; l'API est actif dès maintenant à 1$/M tokens en entrée, avec 95 % de réduction sur les tokens en cache.
- Avant toute intégration en entreprise, évaluer la conformité AI Act (catégorie GPAI), les obligations RGPD et les risques souveraineté liés à l'origine et à l'hébergement des données.
En quoi un modèle Mixture-of-Experts diffère-t-il d'un modèle dense classique ?
Un modèle Mixture-of-Experts (MoE) active seulement une fraction de ses paramètres pour chaque token traité, au lieu d'activer l'intégralité du réseau. Dans le cas de Step 5 Preview, 27 milliards de paramètres sur 600 milliards sont sollicités à chaque inférence. Cela permet d'atteindre les performances d'un grand modèle dense tout en réduisant les coûts de calcul et la latence, ce qui se traduit par des tarifs API plus compétitifs et une meilleure scalabilité à grande échelle.
Besoin d'un accompagnement expert ?
Ayi NEDJIMI vous accompagne sur vos projets cybersécurité et IA.
Prendre contactÀ propos de l'auteur
Ayi NEDJIMI
Auditeur Senior Cybersécurité & Consultant IA
Expert Judiciaire — Cour d'Appel de Paris
Habilitation Confidentiel Défense
ayi@ayinedjimi-consultants.fr
Ayi NEDJIMI est un vétéran de la cybersécurité avec plus de 25 ans d'expérience sur des missions critiques. Ancien développeur Microsoft à Redmond sur le module GINA (Windows NT4) et co-auteur de la version française du guide de sécurité Windows NT4 pour la NSA.
À la tête d'Ayi NEDJIMI Consultants, il réalise des audits Lead Auditor ISO 42001 et ISO 27001, des pentests d'infrastructures critiques, du forensics et des missions de conformité NIS2 / AI Act.
Conférencier international (Europe & US), il a formé plus de 10 000 professionnels.
Domaines d'expertise
Ressources & Outils de l'auteur
Articles connexes
Iran cible les réseaux d'eau : 12 États américains touchés
Des hackers liés à l'Iran mènent depuis fin juillet 2026 une campagne de cyberattaques contre les systèmes d'eau américains, touchant 12 États, modifiant des paramètres opérationnels et forçant des retours aux opérations manuelles.
TanStack supply chain : 170 repos CrowdSec exfiltrés
CrowdSec révèle que 170 de ses dépôts GitHub privés ont été copiés en mai 2026 après qu'un package npm TanStack malveillant a compromis le compte d'un ancien employé, avec la découverte du vol seulement en septembre sur un forum cybercriminel.
GPT-6 Astra : OpenAI franchit le seuil critique en sécurité
OpenAI a lancé GPT-6 Astra le 3 septembre 2026, son premier modèle classé Critical en cybersécurité selon son Preparedness Framework, avec 1M tokens de contexte et mémoire persistante.
Un projet cybersécurité ? Parlons-en.
Pentest, conformité NIS 2, ISO 27001, audit IA, RSSI externalisé… nos experts répondent sous 24h pour évaluer votre besoin et vous proposer un accompagnement sur mesure.
Commentaires
Aucun commentaire pour le moment. Soyez le premier à commenter !
Laisser un commentaire