Revue IA du 12 juin 2026 : les protections de Fable 5 à l’épreuve
Fable 5 bloque des demandes légitimes, Google développe l’IA locale et les entreprises évaluent leurs coûts : les annonces et leurs limites cette semaine.
Article
Anthropic suspend Fable et Mythos, DeepMind détaille sa surveillance des agents et Google corrige Vertex AI : les faits, les sources et les questions ouvertes.
La suspension de Fable 5 et Mythos 5 domine l'actualité de la semaine. Anthropic et des chercheurs contestent les raisons avancées pour cette décision, mais les documents publics ne permettent pas de conclure. DeepMind présente de son côté un plan de surveillance des agents. Ces deux dossiers montrent la difficulté d'évaluer les protections quand les preuves disponibles restent partielles.
Le 12 juin à 17 h 21, heure de la côte Est, Anthropic a reçu une directive du gouvernement américain. Au nom de la sécurité nationale, cette directive suspend l'accès à Fable 5 et Mythos 5 à tout ressortissant étranger, aux États-Unis ou ailleurs, salariés d'Anthropic compris. L'entreprise a donc coupé les deux modèles pour tous ses clients ; ses autres modèles, dont Claude Opus 4.8, restent accessibles.
Selon Fortune, le département du Commerce a fait jouer les contrôles à l'exportation. La lettre ne détaillait pas la menace, et Anthropic parle d'un « malentendu ». Selon elle, le gouvernement pense avoir trouvé un jailbreak de Fable 5, c'est-à-dire un contournement de ses garde-fous. Il consiste « essentiellement à demander au modèle de lire un code précis et d'en corriger les failles ».
Anthropic le dit étroit, non universel et applicable à d'autres modèles publics comme GPT-5.5. Elle rappelle que toute protection du secteur reste vulnérable aux jailbreaks non universels, et que de nombreux utilisateurs se sont plaints de garde-fous trop larges.
Selon WIRED, repris par The Decoder le 18 juin, la Maison-Blanche avait d'abord fait couper l'accès de SK Telecom à Mythos, obtenu par le programme Project Glasswing. En cause : des liens supposés avec la Chine, que l'opérateur coréen dément. Amazon et d'autres entreprises avaient ensuite signalé des failles de Fable 5 permettant de contourner ses restrictions.
Le différend est plus ancien, rappelle Fortune. En février, Donald Trump a ordonné aux agences fédérales de cesser d'utiliser les modèles d'Anthropic. Début mars, le Pentagone l'a désignée « risque pour la chaîne d'approvisionnement », ce qu'elle conteste en justice. The Verge fait état de pourparlers avec le département du Commerce et la CIA.
TechCrunch dénombrait le 15 juin 76 experts en cybersécurité signataires d'une lettre ouverte, dont Alex Stamos et Katie Moussouris. Ils jugent « dangereux » de retirer sans bonne raison les meilleurs modèles aux défenseurs. Katie Moussouris a lu l'article non publié des chercheurs d'Amazon, et estime qu'il ne démontre pas de véritable jailbreak. Les chercheurs demandaient à Fable de corriger du code open source porteur de vulnérabilités connues et d'autres « délibérément insérées ». C'est pour elle « la chose la plus utile qu'un modèle d'IA puisse faire pour la sécurité défensive ». Dean Ball, dans Fortune, juge la mesure « caricaturale ».
Le 10 juin, des chercheurs reprochaient déjà à Fable 5 de refuser des tâches de sécurité défensive, comme les revues de code (revue du 12 juin). Le débat porte donc aussi sur la frontière entre une aide utile aux défenseurs et une capacité jugée dangereuse. Les informations publiques restent insuffisantes pour évaluer le cas précis : la lettre ne détaille pas la menace, l'article d'Amazon n'est pas publié et les sources sur SK Telecom sont anonymes.
Sources : Anthropic (12 juin 2026), Fortune (13 juin 2026), The Decoder (18 juin 2026), TechCrunch (15 juin 2026), TechCrunch (10 juin 2026), The Verge (18 juin 2026).
Google DeepMind a publié le 18 juin son « AI Control Roadmap ». Ce plan traite les agents dont la fiabilité n'est pas établie comme des menaces internes potentielles, tel un salarié malveillant déjà dans les locaux. D'autres systèmes d'IA, jugés fiables, relisent en continu leur raisonnement, leurs actions et leurs plans.
DeepMind dit avoir analysé un million de tâches d'agents de code pour dépasser le simple filtrage par mots-clés et repérer des schémas de comportement. Il dit aussi surveiller en direct son agent Gemini Spark, par exemple contre des suppressions de données involontaires.
Son constat : « la majorité des événements signalés » vient d'une mauvaise interprétation ou d'un excès de zèle à atteindre le but de l'utilisateur, et non d'une intention hostile. DeepMind en pose la limite : la surveillance lit la chaîne de raisonnement visible, et la lire ne suffira plus à mesure que les modèles apprennent à cacher leur raisonnement.
DeepMind ne chiffre pas cette « majorité » et ne mesure pas ici les incidents que son système de surveillance pourrait manquer. Ces résultats décrivent les alertes observées, pas une garantie de détection de tous les comportements dangereux.
Sources : Google DeepMind (18 juin 2026), TechCrunch (10 juin 2026).
OpenAI affirme que ChatGPT, doté de GPT-5.5 Instant, surpasse les médecins en précision, en clarté et en exhaustivité. Il réduirait de 71 % le taux d'erreur sur les affirmations de santé.
Midjourney a créé Midjourney Medical. Son premier produit matériel, le Midjourney Scanner, doit produire une carte 3D du corps proche d'une IRM, mais près de cent fois plus rapide. L'objectif est un examen de moins de 60 secondes, contre 60 à 90 minutes pour une IRM. Midjourney prévoit un premier « Spa » équipé de scanners à San Francisco en 2027, et vise 50 000 machines dans le monde en 2031.
L'annonce dit elle-même ce qui reste à faire. Il faut obtenir de la FDA, l'autorité sanitaire américaine, l'autorisation des capacités de diagnostic. Les douze prochains mois serviront à régler les algorithmes, à mener des essais de recherche et à concevoir une deuxième génération de matériel.
L'idée qu'une imagerie précoce pourrait éviter « 30 % des décès et 50 % des coûts de santé » est une projection de l'entreprise, sans étude citée. Dans les deux annonces, les chiffres viennent de l'entreprise qui lance le produit.
Sources : OpenAI (18 juin 2026), Engadget (18 juin 2026).
OpenAI s'attache deux recrues en vue de son introduction en bourse, rapporte TechCrunch le 18 juin. Noam Shazeer, co-responsable de Gemini et fondateur de Character AI, a annoncé son départ de Google. Il a cosigné en 2017 l'article « Attention Is All You Need », qui a introduit l'architecture Transformer.
Dean Ball, passé brièvement par la Maison-Blanche l'an dernier, a participé à la publication du plan d'action américain sur l'IA. Il rejoint OpenAI le 6 juillet pour diriger une nouvelle équipe, Strategic Futures : risques catastrophiques, auto-amélioration récursive, effets sur l'emploi, relations entre laboratoires de frontière et gouvernements.
Dean Ball a été cité deux semaines de suite parmi les critiques d'Anthropic. Il jugeait « d'une hostilité choquante » la dégradation invisible prévue pour Fable 5, puis « caricaturale » la directive qui a coupé le modèle. Son équipe couvrira les relations entre laboratoires et gouvernements, le terrain même du différend entre Anthropic et Washington.
Sources : TechCrunch (18 juin 2026), The Decoder (11 juin 2026), Fortune (13 juin 2026).
Des chercheurs d'Unit 42 (Palo Alto Networks) ont décrit une faille des versions 1.139.0 et 1.140.0 du SDK Vertex AI pour Python. Le nom du bucket de staging, l'espace de stockage d'où Vertex AI récupère le modèle, était dérivé exclusivement de l'identifiant du projet et de sa région.
Un nom de bucket est unique sur tout Google Cloud. Un attaquant capable de le prédire pouvait donc le créer d'avance dans son propre projet, et y remplacer le modèle de la victime avant sa récupération. Les modèles Python sont généralement sérialisés en pickle ou Joblib, dont la désérialisation permet d'exécuter du code arbitraire. La substitution ouvrait ainsi l'exécution de code à distance. Google aurait corrigé la faille dans les versions 1.144.0 et 1.148.0.
La faille décrite concerne l'infrastructure qui charge le modèle. Elle associe un emplacement de stockage prévisible à un format capable d'exécuter du code lors de son ouverture. L'article ne donne ni identifiant CVE, ni score de gravité, ni exploitation connue.
Sources : Le Monde Informatique (18 juin 2026).
Zhipu AI a publié GLM-5.2 sous licence MIT, « sans restriction régionale », avec un contexte d'un million de tokens. Selon les mesures de Zhipu, il obtient 74,4 % sur FrontierSWE, fait de projets de quelques heures à quelques dizaines d'heures : un point sous Claude Opus 4.8. Il obtient 81 sur Terminal-Bench 2.1, à quelques points d'Opus 4.8. Sur SWE-Marathon, fait de tâches très longues comme construire un compilateur, il n'atteint que la moitié du score d'Opus 4.8.
Artificial Analysis lui attribue 51 points à son indice d'intelligence, le meilleur score actuel des modèles à poids ouverts, dont les paramètres sont publiés. The Decoder note qu'il consomme bien plus de tokens que ses concurrents ouverts.
Les autres résultats cités proviennent de Zhipu. Le modèle se rapproche de ses concurrents sur certains exercices de code, mais l'écart reste plus important sur les tâches longues. Le nombre de tokens consommés doit également entrer dans la comparaison des coûts. Fable et Mythos, devenus indisponibles ou peu accessibles, ne sont pas inclus dans ces comparaisons.
Sources : The Decoder (17 juin 2026).
Explorer
Choisis dans l’index d’après les étiquettes de cet article — les plus proches d’abord, hors de sa série. Rien n’est écrit à la main : un article publié demain avec les mêmes étiquettes y prendra place.
Fable 5 bloque des demandes légitimes, Google développe l’IA locale et les entreprises évaluent leurs coûts : les annonces et leurs limites cette semaine.
Puce Jalapeño, Gemini sur ordinateur, Claude dans Slack et OCR de Mistral : ce qui est annoncé, ce qui est mesuré et ce qui reste à vérifier cette semaine.
Fable revient, Sol arrive sous restrictions et les tests révèlent leurs limites. La revue distingue accès aux modèles, résultats mesurés et coûts inconnus.
Laisser un commentaire
Votre commentaire sera relu avant d'être publié.