Anthropic arrête les modèles d’IA Claude Fable 5 et Mythos à cause du gouvernement américain : que se passe-t-il

Alexis Tremblay
Alexis Tremblay

Trois jours c’est le moment Claude Fable 5 a dû jouir du titre de modèle d’intelligence artificielle le plus performant au monde parmi ceux accessibles au public, avant que le gouvernement américain n’ordonne son arrêt immédiat pour tous les utilisateurs non américains, à travers la planète, y compris aux États-Unis, et même pour les employés d’Anthropic non américains. Dans le communiqué de presse publié par la société dirigée par les frères Amodei, on lit en effet : « Le gouvernement des États-Unis, citant les autorités de sécurité nationale, a émis une directive sur le contrôle des exportations de suspendre l’accès à Fable 5 et Mythe 5 à tout ressortissant étrangertant à l’intérieur qu’à l’extérieur des États-Unis, y compris les employés étrangers d’Anthropic».

Comme vous venez de l’apprendre, en plus de Fable 5 il a également été désactivé Mythe 5son « grand frère » qui était jusqu’alors resté réservé à très peu de partenaires sélectionnés. Anthropic, la société qui a développé les deux modèles, s’est dite prête à respecter l’ordre mais a également fait savoir qu’elle le considérait comme une erreur : selon sa reconstruction, à la base il y aurait un prétendu et limité « jailbreak » identifié dans Fable 5, une faille dans les mécanismes de sécurité qui, selon l’entreprise, est déjà présente dans d’autres modèles concurrents. L’histoire a également eu un énorme impact en dehors des États-Unis, plusieurs hommes politiques européens s’en étant servis comme point de départ pour parler de souveraineté technologique et de la nécessité pour le continent de développer ses propres modèles d’intelligence artificielle. Voyons ensemble, dans l’ordre, ce qui s’est passé et pourquoi.

Le blocage de Mythos 5 et Fable 5 par le gouvernement américain

Commençons par Mythos : selon Anthropic, il s’agit du modèle le plus avancé jamais créé par l’entreprise, présenté en avant-première en avril mais jamais distribué à grande échelle car il est capable, selon l’entreprise elle-même, d’identifier par elle-même les failles de sécurité dans pratiquement tous les systèmes d’exploitation et navigateurs testés. C’est pourquoi il n’a été partagé qu’avec une cinquantaine d’organisations, dont Amazon, Apple, Google, Microsoft et CrowdStrike, dans le cadre d’un programme appelé Projet Aile de Verreconçu pour utiliser ces capacités à des fins défensives, c’est-à-dire pour trouver et corriger les failles avant qu’elles ne soient exploitées par des acteurs malveillants.

Fable 5 est arrivé trois jours seulement avant la fermeture et il était là version « apprivoisée » du Mythe: Mêmes fonctionnalités de base, mais avec des filtres supplémentaires pour bloquer les réponses sur des sujets à haut risque, tels que la cybersécurité et la biologie. Cela l’a rendu, selon Anthropic, suffisamment sûr pour être mis à la disposition de tous, et dès sa sortie, il s’est avéré être le modèle le plus performant parmi les modèles publics lors des tests. Vals IAune entreprise qui mesure les performances des modèles d’IA à travers des benchmarks, c’est-à-dire des tests standardisés permettant de comparer différents systèmes entre eux.

Venons-en maintenant à l’ordre du gouvernement. Formellement, c’est un mesure de contrôle des exportationsun outil qui sert normalement à empêcher que certaines technologies ne tombent entre les mains d’entités étrangères pour des raisons de sécurité nationale. Mais dans ce cas, l’effet pratique était bien plus large : pour respecter l’ordre, Anthropic a dû désactiver les deux modèles pour tous les utilisateurs du monde entiery compris les citoyens américains, car il n’existait aucun moyen technique d’appliquer le blocage uniquement aux citoyens étrangers, y compris vos propres employés non américains. Les autres modèles Anthropic continuent de fonctionner normalement pour tout le monde.

D’après la reconstruction d’Anthropic, le gouvernement n’a pas fourni de raisons détaillées à cet égardmais l’entreprise estime que l’inquiétude concerne précisément ce « jailbreak » de Fable 5. Pour faire simple, dans le monde de l’IA, ce terme indique un moyen de « convaincre » un modèle d’ignorer ses propres règles internes. Dans ce cas, il s’agirait d’une technique qui permettrait au modèle d’analyser le code et d’identifier les vulnérabilités logicielles déjà connues, une capacité qui, selon l’entreprise, est également disponible dans d’autres modèles publics, notamment GPT-5.5 par OpenAIet que les experts en cybersécurité utilisent régulièrement à des fins défensives.

Anthropic souligne également que ses protections les plus importantes ne dépendent pas uniquement du comportement du modèle, mais de systèmes de contrôle indépendants qui restent actifs même si le modèle lui-même est « convaincu » de répondre anormalement.

La frustration de l’anthropique

D’ici le La frustration de l’anthropique: retirer du marché un modèle utilisé par des centaines de millions de personnes en raison d’une vulnérabilité limitée, selon lui, comporte des risques bloquer le lancement de tout nouveau modèle par toute entreprise du secteur. Il y a aussi un paradoxe de fond : l’entreprise a bâti une grande partie de son image sur la prudence dont elle fait preuve avec Mythos, présenté comme trop puissant pour une distribution gratuite, et se retrouve aujourd’hui « punie » à peu près pour les mêmes raisons, à tel point que, déjà en avril, Sam Altman d’OpenAI avait parlé d’une stratégie marketing basée sur la peur.

L’histoire a également eu un écho immédiat en Europe, où plusieurs hommes politiques, de la France au Royaume-Uni, en passant par les Pays-Bas, ont profité de l’occasion pour demander davantage d’investissements dans les modèles européens d’IA, arguant que dépendre de technologies développées ailleurs expose au risque d’en être coupé à tout moment, comme cela s’est produit pour les utilisateurs non américains de Fable 5 et Mythos 5.