← Stack

Claude Mythos

Un frontier model qui mérite sa page : hors norme en cybersécurité, sous accès restreint par choix, et un exemple concret de ce qui justifie une page dédiée.

Vue d'ensemble

Claude Mythos est un frontier model généraliste d'Anthropic, introduit le 2026-04-07. Ce qui le distingue n'est pas sa taille ni ses capacités générales, de nombreux modèles y prétendent : il est remarquablement efficace sur les tâches cybersécurité multi-étapes, détectant des vulnérabilités logicielles qui avaient échappé à des auditeurs humains pendant des années. Selon Anthropic, il a identifié des failles de haute sévérité dans chaque grand système d'exploitation et navigateur web durant les tests. Une évaluation indépendante de l'UK AI Safety Institute indique qu'il réussit environ 73 % des épreuves CTF de niveau expert, une catégorie qu'aucun modèle ne pouvait résoudre avant avril 2025. Ces chiffres sont ceux publiés par Anthropic et l'AISI, pas notre propre mesure : ce modèle, nous le cartographions, nous ne l'exploitons pas.

Anthropic n'a pas rendu Mythos public. En invoquant le risque dual-use, un outil aussi performant pour trouver des vulnérabilités aide les attaquants autant que les défenseurs, l'accès a été restreint via Project Glasswing : un consortium vérifié réunissant des équipes défensives, des partenaires industriels critiques (éditeurs de systèmes d'exploitation et de navigateurs, institutions financières) et des mainteneurs open-source, chacun devant satisfaire des exigences de sécurité. Le grand public est exclu par conception. Le pari : donner aux défenseurs une longueur d'avance pour détecter et corriger les failles avant que les attaquants n'atteignent une capacité équivalente, de façon à faire pencher la balance du côté de la défense. Ce pari est débattu, et cette page maintient l'équilibre sans trancher.

Pourquoi Mythos mérite-t-il sa propre page quand un modèle intermédiaire ou compact n'en a pas ? Parce qu'avoir sa page, c'est avoir une histoire distinctive et argumentable, pas seulement de bonnes performances. La plupart des modèles sont des entrées de catalogue : on choisit un tier, on lit une ligne de benchmark, on passe à la suite. Mythos se distingue sur un axe qui compte au-delà des scores bruts : une capacité frontier en sécurité couplée à un modèle d'accès inédit que tout le secteur observe. C'est cette combinaison qui constitue l'histoire, et la raison d'être de cette page. Considérez-la comme l'exemple de référence de la règle : un modèle mérite sa page quand il modifie votre lecture du paysage, pas quand il affiche simplement un bon chiffre.

Architecture

Ce qui est intéressant ici n'est pas l'architecture interne du modèle, qu'Anthropic n'a pas divulguée, mais le dispositif d'accès qui l'entoure. Project Glasswing est un filtre : Claude Mythos se trouve derrière une étape de vérification, et seules les voies approuvées y accèdent, équipes de sécurité défensives, partenaires industriels critiques et mainteneurs open-source, chacun validé selon des exigences de sécurité. Le grand public est exclu par conception. Lisez le diagramme comme une carte de qui peut atteindre le modèle et à quelles conditions : c'est la dimension réellement inédite de Mythos, et celle qui compte pour lire le paysage.

Défenseurs vérifiésPartenaires critiquesMainteneurs open-sourceporte de vérificationClaude Mythosfrontier, sous accès restreintGrand publicpas d'accès
Le dispositif d'accès Project Glasswing : défenseurs vérifiés, partenaires critiques et mainteneurs open-source atteignent Claude Mythos via une porte de vérification ; le grand public est exclu.

Concepts clés

Frontier model
Le tier le plus puissant des modèles qu'un laboratoire publie : les plus grands et les meilleurs sur les raisonnements les plus complexes, au coût et à la latence les plus élevés par appel. Mythos est un frontier model, remarquable pour sa capacité en sécurité plutôt que pour son statut frontier en lui-même.
Accès restreint
Un modèle qui n'est pas rendu disponible au grand public : l'accès est accordé uniquement à des parties vérifiées sous conditions, et non vendu via une API publique ouverte. Mythos est sous accès restreint, ce qui explique que la grande majorité des équipes ne peuvent tout simplement pas l'appeler.
Project Glasswing
Le consortium vérifié et programme d'accès d'Anthropic pour Claude Mythos, constitué autour de sa capacité en cybersécurité. Il admet les équipes défensives, les partenaires industriels critiques et les mainteneurs open-source répondant aux exigences de sécurité, avec pour objectif de placer le modèle en priorité entre les mains des défenseurs.
Capacité dual-use
Une capacité qui profite autant aux défenseurs qu'aux attaquants. La détection de vulnérabilités logicielles est dual-use : la même compétence qui permet à un défenseur de corriger une faille permet à un attaquant de l'exploiter. Le risque dual-use est la raison officielle de l'accès restreint de Mythos.
Divulgation responsable
La pratique consistant à signaler une vulnérabilité découverte de façon confidentielle à l'éditeur pour qu'il la corrige avant toute publication. Le modèle Glasswing s'appuie sur cette logique : les défenseurs trouvent des failles avec Mythos et les font corriger discrètement plutôt que de les rendre publiques.
CTF (capture the flag)
Un format d'épreuve de sécurité où le participant doit atteindre un token caché en traversant un système contrôlé et délibérément vulnérable. Utilisé comme indicateur de capacité : l'AISI a rapporté que Mythos résout une large part des CTF de niveau expert, avec la réserve que ces environnements n'incluent pas de défenseurs réels ni d'outillage défensif.
Red-teaming
Sonder un système ou un modèle pour en trouver les faiblesses en simulant un adversaire, afin de les corriger. Une démarche défensive : l'objectif du red-teaming sur une capacité de la classe de Mythos est de comprendre et contenir ses risques avant qu'ils n'atteignent le grand public.

Quand l'utiliser

Cas adaptés

  • Équipes de sécurité défensive à grande échelle. L'objectif de Mythos dans le cadre de Project Glasswing est de placer une capacité frontier de détection de vulnérabilités en priorité entre les mains des défenseurs : de grandes organisations de sécurité capables de trouver et corriger des failles dans leurs propres bases de code avant que les attaquants n'atteignent une capacité équivalente. Si vous pilotez la sécurité défensive de logiciels critiques, c'est pour vous que ce dispositif d'accès a été conçu.
  • Partenaires de recherche en vulnérabilités et éditeurs d'infrastructure critique. Les constructeurs de systèmes d'exploitation et de navigateurs, les institutions financières et les partenaires similaires qui maintiennent les logiciels dont dépend l'internet au sens large forment le consortium auquel Mythos a été restreint. Mozilla a par exemple rapporté avoir identifié et corrigé 271 vulnérabilités Firefox en une seule passe d'évaluation avec Mythos Preview. Le terrain d'application : durcir des logiciels sur lesquels des millions d'utilisateurs s'appuient.
  • Mainteneurs open-source vérifiés. Anthropic a inclus les mainteneurs open-source dans le programme d'accès afin que les dépendances largement utilisées, les bibliothèques sur lesquelles tout le reste est construit, puissent également être renforcées. Si vous maintenez une infrastructure open-source critique et satisfaisez aux exigences de sécurité, le dispositif d'accès vous inclut.
  • La grande majorité des équipes : ce modèle n'est pas pour elles, et c'est la réponse honnête. Mythos est sous accès restreint, donc pour l'immense majorité des équipes, la relation réaliste à ce modèle est de le comprendre, pas de l'utiliser. Savoir qu'il existe, ce qu'il signale sur la sécurité assistée par l'IA et pourquoi il est restreint compte pour lire le paysage, même si vous ne l'appellerez jamais.

Anti-patterns

  • Supposer que vous pouvez appeler Mythos comme une API ordinaire. Il n'existe pas de point d'entrée public : l'accès est restreint aux participants vérifiés de Project Glasswing. Concevoir un produit autour d'un accès que vous n'avez pas est une impasse. Si votre architecture requiert Mythos spécifiquement, cette architecture est inadaptée pour presque toutes les équipes.
  • Traiter une capacité frontier sous accès restreint comme un simple produit de catalogue. Mythos n'est pas interchangeable avec un modèle intermédiaire que l'on substitue à volonté. Ses conditions d'accès font partie de ce qu'il est. Le raisonner comme une simple ligne de tableau de benchmark, c'est passer à côté de la seule chose qui le rend remarquable : une capacité distinctive derrière un verrou délibéré.
  • Interpréter les chiffres de benchmark publiés comme une promesse sur vos systèmes. L'AISI elle-même a précisé que ses environnements d'évaluation ne disposent pas de défenseurs actifs ni d'outillage défensif, donc un score CTF élevé ne signifie pas que le modèle traverserait un vrai réseau bien protégé. Prenez ces chiffres comme des signaux de capacité en conditions de laboratoire, pas comme une projection sur des environnements de production durcis.

Comparatif

vs Model tiers

Sa position sur l'échelle des capacités

Mythos est un modèle de tier frontier, le barreau le plus haut de l'échelle des capacités. La page model-tiers cartographie cette échelle dans son ensemble : cette page-ci en est l'exemple concret au niveau frontier, remarquable non pas pour y figurer mais pour sa capacité en sécurité et son accès restreint. Lisez l'échelle là-bas, puis revenez ici comprendre pourquoi ce sommet mérite sa propre page.

vs Choosing a model

Son sort dans un processus de sélection réel

Dans l'entonnoir de sélection d'un modèle, Mythos est éliminé pour presque tout le monde dès la première étape : les critères non-négociables. L'absence d'accès est une contrainte absolue, et un modèle que vous ne pouvez pas appeler est éliminé avant même que les capacités entrent en jeu. C'est précisément pour cela que la plupart des équipes devraient raisonner sur Mythos comme un élément du paysage, pas comme un candidat : le processus de sélection l'écarte de lui-même.

Ressources

FAQ

Qu'est-ce que Claude Mythos ?
Un frontier model généraliste d'Anthropic, introduit le 2026-04-07, remarquablement performant sur les tâches cybersécurité multi-étapes, capable de détecter des vulnérabilités logicielles à un niveau qui a surpris le secteur. Ce qui le distingue n'est pas sa puissance brute, mais cette puissance couplée à une diffusion délibérément restreinte. Nous le présentons comme un élément du paysage, pas comme un outil que nous exploitons.
Puis-je utiliser Mythos en production ?
Presque certainement non. Mythos est sous accès restreint : Anthropic ne l'a pas rendu public et l'accès est limité aux participants vérifiés de Project Glasswing, équipes de sécurité défensives, partenaires industriels critiques et mainteneurs open-source satisfaisant aux exigences de sécurité. Il n'existe pas d'API publique pour le développeur ordinaire. Pour l'immense majorité des équipes, la relation réaliste à ce modèle est de le comprendre, pas de l'utiliser.
Qu'est-ce que Project Glasswing ?
Le consortium vérifié et programme d'accès d'Anthropic pour Claude Mythos, constitué autour de la capacité cybersécurité du modèle. Il accorde l'accès aux équipes défensives, aux partenaires industriels critiques et aux mainteneurs open-source qui satisfont aux exigences de sécurité, et exclut le grand public. L'objectif : placer une capacité frontier de détection de vulnérabilités entre les mains des défenseurs avant que les attaquants n'atteignent une puissance équivalente.
Pourquoi Mythos a-t-il sa propre page alors que Haiku n'en a pas ?
Parce qu'un modèle ne mérite sa page que lorsqu'il a une histoire distinctive et argumentable, pas quand il affiche simplement un bon benchmark. Un modèle intermédiaire ou compact est une entrée de catalogue : on choisit un tier, on lit une ligne, on passe à la suite. Mythos modifie votre lecture du paysage : une capacité frontier en sécurité derrière un dispositif d'accès inédit que tout le secteur observe. C'est le critère pour mériter sa page, et Mythos en est l'exemple le plus net.
Est-il raisonnable de publier un modèle aussi capable en sécurité ?
Le débat est réel, et nous le maintenons équilibré. L'argument en faveur de l'accès restreint : une capacité de détection de vulnérabilités est dual-use, donc donner aux défenseurs une longueur d'avance pour trouver et corriger les failles avant que les attaquants n'atteignent une puissance équivalente peut faire pencher la balance du côté de la défense, c'est la logique de la divulgation responsable à grande échelle. La réserve : cela concentre une puissante capacité dual-use derrière le verrou d'un seul éditeur, et la période de transition est risquée. Des personnes raisonnables se retrouvent des deux côtés ; la position honnête est d'assumer cette tension plutôt que de la résoudre superficiellement.