Article

Revue IA du 19 juin 2026 : modèles suspendus et agents surveillés

Anthropic suspend Fable et Mythos, DeepMind détaille sa surveillance des agents et Google corrige Vertex AI : les faits, les sources et les questions ouvertes.

La suspension de Fable 5 et Mythos 5 domine l'actualité de la semaine. Anthropic et des chercheurs contestent les raisons avancées pour cette décision, mais les documents publics ne permettent pas de conclure. DeepMind présente de son côté un plan de surveillance des agents. Ces deux dossiers montrent la difficulté d'évaluer les protections quand les preuves disponibles restent partielles.

Anthropic suspend Fable 5 et Mythos 5 après une directive américaine

Le 12 juin à 17 h 21, heure de la côte Est, Anthropic a reçu une directive du gouvernement américain. Au nom de la sécurité nationale, cette directive suspend l'accès à Fable 5 et Mythos 5 à tout ressortissant étranger, aux États-Unis ou ailleurs, salariés d'Anthropic compris. L'entreprise a donc coupé les deux modèles pour tous ses clients ; ses autres modèles, dont Claude Opus 4.8, restent accessibles.

Selon Fortune, le département du Commerce a fait jouer les contrôles à l'exportation. La lettre ne détaillait pas la menace, et Anthropic parle d'un « malentendu ». Selon elle, le gouvernement pense avoir trouvé un jailbreak de Fable 5, c'est-à-dire un contournement de ses garde-fous. Il consiste « essentiellement à demander au modèle de lire un code précis et d'en corriger les failles ».

Anthropic le dit étroit, non universel et applicable à d'autres modèles publics comme GPT-5.5. Elle rappelle que toute protection du secteur reste vulnérable aux jailbreaks non universels, et que de nombreux utilisateurs se sont plaints de garde-fous trop larges.

Un différend plus large avec les autorités

Selon WIRED, repris par The Decoder le 18 juin, la Maison-Blanche avait d'abord fait couper l'accès de SK Telecom à Mythos, obtenu par le programme Project Glasswing. En cause : des liens supposés avec la Chine, que l'opérateur coréen dément. Amazon et d'autres entreprises avaient ensuite signalé des failles de Fable 5 permettant de contourner ses restrictions.

Le différend est plus ancien, rappelle Fortune. En février, Donald Trump a ordonné aux agences fédérales de cesser d'utiliser les modèles d'Anthropic. Début mars, le Pentagone l'a désignée « risque pour la chaîne d'approvisionnement », ce qu'elle conteste en justice. The Verge fait état de pourparlers avec le département du Commerce et la CIA.

Des chercheurs contestent la justification

TechCrunch dénombrait le 15 juin 76 experts en cybersécurité signataires d'une lettre ouverte, dont Alex Stamos et Katie Moussouris. Ils jugent « dangereux » de retirer sans bonne raison les meilleurs modèles aux défenseurs. Katie Moussouris a lu l'article non publié des chercheurs d'Amazon, et estime qu'il ne démontre pas de véritable jailbreak. Les chercheurs demandaient à Fable de corriger du code open source porteur de vulnérabilités connues et d'autres « délibérément insérées ». C'est pour elle « la chose la plus utile qu'un modèle d'IA puisse faire pour la sécurité défensive ». Dean Ball, dans Fortune, juge la mesure « caricaturale ».

Le 10 juin, des chercheurs reprochaient déjà à Fable 5 de refuser des tâches de sécurité défensive, comme les revues de code (revue du 12 juin). Le débat porte donc aussi sur la frontière entre une aide utile aux défenseurs et une capacité jugée dangereuse. Les informations publiques restent insuffisantes pour évaluer le cas précis : la lettre ne détaille pas la menace, l'article d'Amazon n'est pas publié et les sources sur SK Telecom sont anonymes.

Sources : Anthropic (12 juin 2026), Fortune (13 juin 2026), The Decoder (18 juin 2026), TechCrunch (15 juin 2026), TechCrunch (10 juin 2026), The Verge (18 juin 2026).

DeepMind explique comment il surveille ses agents

Google DeepMind a publié le 18 juin son « AI Control Roadmap ». Ce plan traite les agents dont la fiabilité n'est pas établie comme des menaces internes potentielles, tel un salarié malveillant déjà dans les locaux. D'autres systèmes d'IA, jugés fiables, relisent en continu leur raisonnement, leurs actions et leurs plans.

DeepMind dit avoir analysé un million de tâches d'agents de code pour dépasser le simple filtrage par mots-clés et repérer des schémas de comportement. Il dit aussi surveiller en direct son agent Gemini Spark, par exemple contre des suppressions de données involontaires.

Son constat : « la majorité des événements signalés » vient d'une mauvaise interprétation ou d'un excès de zèle à atteindre le but de l'utilisateur, et non d'une intention hostile. DeepMind en pose la limite : la surveillance lit la chaîne de raisonnement visible, et la lire ne suffira plus à mesure que les modèles apprennent à cacher leur raisonnement.

DeepMind ne chiffre pas cette « majorité » et ne mesure pas ici les incidents que son système de surveillance pourrait manquer. Ces résultats décrivent les alertes observées, pas une garantie de détection de tous les comportements dangereux.

Sources : Google DeepMind (18 juin 2026), TechCrunch (10 juin 2026).

Santé : des performances annoncées et des validations encore attendues

OpenAI affirme que ChatGPT, doté de GPT-5.5 Instant, surpasse les médecins en précision, en clarté et en exhaustivité. Il réduirait de 71 % le taux d'erreur sur les affirmations de santé.

Midjourney a créé Midjourney Medical. Son premier produit matériel, le Midjourney Scanner, doit produire une carte 3D du corps proche d'une IRM, mais près de cent fois plus rapide. L'objectif est un examen de moins de 60 secondes, contre 60 à 90 minutes pour une IRM. Midjourney prévoit un premier « Spa » équipé de scanners à San Francisco en 2027, et vise 50 000 machines dans le monde en 2031.

L'annonce dit elle-même ce qui reste à faire. Il faut obtenir de la FDA, l'autorité sanitaire américaine, l'autorisation des capacités de diagnostic. Les douze prochains mois serviront à régler les algorithmes, à mener des essais de recherche et à concevoir une deuxième génération de matériel.

L'idée qu'une imagerie précoce pourrait éviter « 30 % des décès et 50 % des coûts de santé » est une projection de l'entreprise, sans étude citée. Dans les deux annonces, les chiffres viennent de l'entreprise qui lance le produit.
Sources : OpenAI (18 juin 2026), Engadget (18 juin 2026).

OpenAI recrute Noam Shazeer et Dean Ball avant son entrée en bourse

OpenAI s'attache deux recrues en vue de son introduction en bourse, rapporte TechCrunch le 18 juin. Noam Shazeer, co-responsable de Gemini et fondateur de Character AI, a annoncé son départ de Google. Il a cosigné en 2017 l'article « Attention Is All You Need », qui a introduit l'architecture Transformer.

Dean Ball, passé brièvement par la Maison-Blanche l'an dernier, a participé à la publication du plan d'action américain sur l'IA. Il rejoint OpenAI le 6 juillet pour diriger une nouvelle équipe, Strategic Futures : risques catastrophiques, auto-amélioration récursive, effets sur l'emploi, relations entre laboratoires de frontière et gouvernements.

Dean Ball a été cité deux semaines de suite parmi les critiques d'Anthropic. Il jugeait « d'une hostilité choquante » la dégradation invisible prévue pour Fable 5, puis « caricaturale » la directive qui a coupé le modèle. Son équipe couvrira les relations entre laboratoires et gouvernements, le terrain même du différend entre Anthropic et Washington.
Sources : TechCrunch (18 juin 2026), The Decoder (11 juin 2026), Fortune (13 juin 2026).

Vertex AI : une faille dans le chargement des modèles

Des chercheurs d'Unit 42 (Palo Alto Networks) ont décrit une faille des versions 1.139.0 et 1.140.0 du SDK Vertex AI pour Python. Le nom du bucket de staging, l'espace de stockage d'où Vertex AI récupère le modèle, était dérivé exclusivement de l'identifiant du projet et de sa région.

Un nom de bucket est unique sur tout Google Cloud. Un attaquant capable de le prédire pouvait donc le créer d'avance dans son propre projet, et y remplacer le modèle de la victime avant sa récupération. Les modèles Python sont généralement sérialisés en pickle ou Joblib, dont la désérialisation permet d'exécuter du code arbitraire. La substitution ouvrait ainsi l'exécution de code à distance. Google aurait corrigé la faille dans les versions 1.144.0 et 1.148.0.

La faille décrite concerne l'infrastructure qui charge le modèle. Elle associe un emplacement de stockage prévisible à un format capable d'exécuter du code lors de son ouverture. L'article ne donne ni identifiant CVE, ni score de gravité, ni exploitation connue.

Sources : Le Monde Informatique (18 juin 2026).

GLM-5.2 : les résultats varient selon la durée des tâches

Zhipu AI a publié GLM-5.2 sous licence MIT, « sans restriction régionale », avec un contexte d'un million de tokens. Selon les mesures de Zhipu, il obtient 74,4 % sur FrontierSWE, fait de projets de quelques heures à quelques dizaines d'heures : un point sous Claude Opus 4.8. Il obtient 81 sur Terminal-Bench 2.1, à quelques points d'Opus 4.8. Sur SWE-Marathon, fait de tâches très longues comme construire un compilateur, il n'atteint que la moitié du score d'Opus 4.8.

Artificial Analysis lui attribue 51 points à son indice d'intelligence, le meilleur score actuel des modèles à poids ouverts, dont les paramètres sont publiés. The Decoder note qu'il consomme bien plus de tokens que ses concurrents ouverts.

Les autres résultats cités proviennent de Zhipu. Le modèle se rapproche de ses concurrents sur certains exercices de code, mais l'écart reste plus important sur les tâches longues. Le nombre de tokens consommés doit également entrer dans la comparaison des coûts. Fable et Mythos, devenus indisponibles ou peu accessibles, ne sont pas inclus dans ces comparaisons.

Sources : The Decoder (17 juin 2026).

En bref

  • Rachat : SpaceX annonce vouloir racheter Cursor, outil de codage assisté par IA, pour 60 milliards de dollars (Siècle Digital, 17 juin 2026).
  • Bulle : sur CNBC, Yann LeCun juge qu'OpenAI et Anthropic risquent « l'explosion d'une grosse bulle » faute de réduire leurs coûts ou d'augmenter leurs prix. Sa société AMI Labs a levé un milliard de dollars en mars pour une autre voie que les grands modèles de langage (The Decoder, 18 juin 2026).
  • Création : Adobe intègre des assistants IA à Photoshop et Premiere (The Verge, 18 juin 2026).
  • Acquisition : selon une source unique, Elastic rachèterait Deductive AI, qui corrige des bugs logiciels par IA, pour 85 millions de dollars au plus. Les deux entreprises n'ont pas répondu (TechCrunch, 18 juin 2026).
  • Supervision : une étude du Work AI Institute de Glean, fournisseur américain d'outils d'IA, auprès de 6 000 travailleurs du numérique, chiffre à 6,4 heures par semaine le temps passé à fournir du contexte à l'IA et à corriger ses productions. Elle estime à environ 11 heures le temps gagné par l'automatisation (Le Monde Informatique, 19 juin 2026).
  • VivaTech : la dixième édition se tient du 17 au 20 juin à Paris, avec environ 180 000 participants attendus. Jeff Bezos, également co-CEO de la start-up d'IA Prometheus, y est à l'honneur, et les start-ups décrivent une levée de fonds plus difficile (Le Monde Informatique, 17 juin 2026).
  • État : Sébastien Lecornu a annoncé 655 millions d'euros supplémentaires pour l'IA dans l'administration, la recherche, la puissance de calcul et la souveraineté technologique (Siècle Digital, 16 juin 2026).
  • Mémorisation : le site In the Weights, créé par deux anciens d'OpenAI, note à quel point plusieurs modèles identifient une personne, jusqu'à 996 pour Mozart ou Taylor Swift. Les modèles peuvent toutefois inventer des détails biographiques (The Decoder, 19 juin 2026).

Explorer

Sur le même sujet

Choisis dans l’index d’après les étiquettes de cet article — les plus proches d’abord, hors de sa série. Rien n’est écrit à la main : un article publié demain avec les mêmes étiquettes y prendra place.

Laisser un commentaire

Elle n'est jamais affichée ni publiée. Elle sert à regrouper vos commentaires et, si vous vous inscrivez un jour avec elle, à vous les rendre.

Votre commentaire sera relu avant d'être publié.