Logo d'Anthropic, éditeur des modèles Claude

Claude Fable 5.1 : le modèle le plus puissant d’Anthropic avance à pas de loup

Anthropic a lancé lundi 1er septembre Claude Fable 5.1 et Mythos 5.1, deux versions d’un même modèle, le plus puissant jamais publié par l’entreprise de Dario Amodei. Le premier est accessible à tous les clients payants, le second reste réservé à des chercheurs en cybersécurité et en sciences du vivant triés sur le volet, basés aux États-Unis. Deux mois après une suspension de dix-neuf jours ordonnée par le département du Commerce, Anthropic, entreprise membre du Forum économique mondial assouplit ses filtres et multiplie les précautions. Numerama résume : le groupe « marche sur des œufs ».

Même architecture, même entraînement, mêmes poids. Ce qui sépare Claude Fable 5.1 de Mythos 5.1 tient dans une couche de filtres de sécurité, explique le site spécialisé tech-ish. Fable 5.1 est ouvert à tous les abonnés payants et aux clients de l’API. Mythos 5.1 ne l’est qu’à des défenseurs en cybersécurité et des biologistes américains vérifiés, sans calendrier d’élargissement. Le premier repère une faille logicielle mais refuse d’écrire l’exploit correspondant ; le second peut aller plus loin, entre des mains qu’Anthropic dit avoir contrôlées.

Le contexte explique la prudence. Le 12 juin, le département américain du Commerce a ordonné de bloquer l’accès des ressortissants étrangers aux modèles Fable, après que des chercheurs d’Amazon, entreprise membre du Forum économique mondial, ont découvert un contournement du filtre de cybersécurité de Fable 5. Les deux modèles ont été mis hors ligne pendant dix-neuf jours, jusqu’au 30 juin. Anthropic, dont le dirigeant Dario Amodei, figure dans les listes publiées des Young Global Leaders du Forum économique mondial et parmi les contributeurs de l’Agenda 2030, sort donc sa nouvelle génération avec l’administration Trump dans le rétroviseur.

Deux fois plus fort en sciences

Sur le banc d’essai Terminal-Bench-Science, qui mesure la capacité d’un modèle à mener seul un travail scientifique en ligne de commande, Fable 5.1 atteint 52,6 %, contre 24,7 % pour Fable 5, selon Génération NT. Sur Terminal-Bench 4.0, orienté programmation, il passe de 42 % à 55,8 %, et Mythos 5.1 monte à 60,9 %. Sur AutomationBench, la progression va de 17,1 % à 31,4 %. Anthropic met en avant, pour Mythos 5.1, des protéines conçues avec des affinités de liaison « dix fois supérieures aux meilleures conceptions humaines » et une carte haute résolution de Vénus.

La fenêtre de contexte reste à un million de jetons, la sortie à 128 000. La date limite des connaissances est fixée à juin 2026. Tarif : 10 dollars le million de jetons en entrée, 50 en sortie. Le vrai changement est ailleurs : le prix de lecture du cache tombe de 1 dollar à 0,25 dollar le million, soit 75 % de baisse. Anthropic chiffre l’économie à 25 % sur une charge de travail classique et jusqu’à 45 % sur les tâches agentiques longues. Plus puissant et parfois moins cher, note Génération NT. Parfois.

Des filtres qui se déclenchent moins, pas des filtres en moins

C’est le passage le plus délicat du lancement. Le filtre de cybersécurité de Fable 5.1 se déclenche « environ 60 % moins souvent par session », et celui de biologie « 85 % moins souvent sur les questions médicales ordinaires », selon tech-ish. Anthropic présente cela comme une réduction des faux positifs : moins de refus absurdes pour un médecin qui pose une question banale. Les tests d’intrusion, eux, sont renvoyés vers les modèles Opus. Trois cabinets de sécurité externes et la société Gray Swan disent n’avoir trouvé « aucun jailbreak critique ».

Le reste du dispositif est réglementaire. Un tatouage statistique invisible marque désormais les sorties du modèle, conformément à l’AI Act européen, dont les obligations s’appliquent depuis le 2 août 2026. Des restrictions « anti-distillation » empêchent de modifier les messages passés d’une conversation tout en conservant les données de raisonnement, pour compliquer la copie du modèle par des concurrents. Les Enterprise Frontier Safeguards, un hébergement en nuage privé avec zéro rétention de données, arriveront à l’automne. Beaucoup de verrous pour un modèle qu’on annonce plus ouvert.

Face à Astra

Le calendrier n’est pas un hasard. Le même lundi, OpenAI, autre entreprise membre du WEF annonçait Astra, premier modèle classé « critique » en cybersécurité par sa propre grille, capable de trouver et d’exploiter seul des failles inconnues. Les deux entreprises, qui ont reconnu cet été des intrusions menées par leurs modèles en test, avancent désormais au même pas : plus de puissance, plus de garde-fous, plus de listes d’accès. Et un même client à ne pas contrarier, à Washington.

Claude Fable 5.1 est le modèle le plus intelligent qu’Anthropic ait jamais mis en ligne, et le plus surveillé. Les deux affirmations ne se contredisent pas. Elles se conditionnent.


Source : Numerama – https://www.numerama.com/cyberguerre/2323465-claude-fable-et-mythos-5-1-anthropic-devoile-ses-modeles-les-plus-puissants-mais-marche-sur-des-oeufs.html