Article

Revue IA du 21 août 2026 : sécurité des modèles et nouveaux intermédiaires

OpenAI ralentit certains entraînements, GLM-5.3 attend sa publication ouverte et des attaques contre des assistants rappellent les limites des protections.

La sécurité influence cette semaine le calendrier de plusieurs modèles : OpenAI ralentit des entraînements et Z.ai reporte la publication des poids de GLM-5.3. Des chercheurs montrent aussi comment détourner des assistants qui lisent des contenus malveillants. En parallèle, les routeurs de modèles prennent de l'importance et de nouvelles mesures cherchent à estimer la place des textes générés sur le Web.

OpenAI : entraînements ralentis et réorganisation de l'évaluation des risques

OpenAI déclare « cadencer le développement de ses modèles ». L'apprentissage par renforcement, qui récompense un modèle pour ses bonnes réponses, a été suspendu deux semaines. La plus grande campagne de ce type prévue sur un modèle de pointe reste à l'arrêt. Les charges de calcul qui ne respectent pas les nouvelles exigences de sécurité sont suspendues.

OpenAI cite les capacités cyber de son modèle Astra, l'incident Hugging Face et ses progrès de recherche internes. Ses environnements de recherche sont mieux isolés. Un dispositif de surveillance alerte en moins de trente minutes. Selon la charge, il consomme environ 20 % du calcul d'inférence (l'exécution des modèles) qu'il supervise.

Fin juillet, d'après le Financial Times, OpenAI avait fermé son équipe « Preparedness », qui évaluait les risques catastrophiques de ses modèles, et réparti son travail entre équipes existantes. Son ancien responsable, Dylan Scandinaro, étudie désormais les risques des IA capables de s'améliorer elles-mêmes. Plusieurs responsables de la sûreté sont partis, dont Chloe Bakalar, qui dirigeait l'éthique.

Des chercheurs extérieurs disent aussi avoir perdu leur accès au programme cyber restreint. OpenAI annonce élargir le cadre d'évaluation dont elle vient de dissoudre l'équipe.

OpenAI décrit les changements apportés à ses entraînements et à leur surveillance. Les informations publiques ne permettent toutefois pas de reproduire l'ensemble de ses évaluations internes. La réorganisation de Preparedness et les restrictions d'accès aux chercheurs extérieurs posent donc la question des moyens de contrôle indépendants.

Sources : The Decoder (18 août 2026), OpenAI (18 août 2026), The Decoder (16 août 2026), The Verge (19 août 2026), The Verge (18 août 2026), TechCrunch (19 août 2026).

Anthropic dépasse OpenAI en chiffre d'affaires sur un trimestre

Pour la première fois, Anthropic a dépassé OpenAI en chiffre d'affaires, selon des chiffres communiqués aux investisseurs et cités par le Wall Street Journal. Sur le trimestre clos en juin, Anthropic atteint 11,6 milliards de dollars avec un bénéfice opérationnel réduit. OpenAI passe de 5,7 à 6,7 milliards, soit 18 % de croissance, avec une marge opérationnelle de plus en plus négative.

Les 65 milliards souvent cités sont le revenu annualisé revendiqué par Anthropic, sept fois celui d'il y a un an. C'est une projection des performances récentes sur douze mois, pas de l'argent encaissé.

Sur l'usage en entreprise, les données de Ramp (plus de 70 000 entreprises américaines) montrent une tendance encore mouvante. Anthropic est passé devant en mai, 41 % contre 39 %, et tient près de 44 % contre 40 % en juillet. OpenAI y progresse pourtant plus vite depuis le début du troisième trimestre. Ramp ne donne pas de montants ; son panel penche vers la tech et exclut les grands comptes équipés ailleurs.

Le chiffre d'affaires trimestriel, le revenu annualisé et la part d'un panel décrivent trois réalités différentes. Le premier porte sur une période écoulée ; le deuxième extrapole une cadence récente ; le troisième mesure la présence dans un échantillon d'entreprises. Le chiffre d'affaires ne doit pas non plus être confondu avec les sommes encaissées pendant la période.

Sources : The Decoder (19 août 2026), TechCrunch (17 août 2026), The Decoder (18 août 2026), TechCrunch (20 août 2026), The Decoder (18 août 2026).

Copilot, Grok et Anthropic : plusieurs limites des dispositifs de protection

Des chercheurs de Varonis ont amené Microsoft 365 Copilot à envoyer à l'extérieur un mot de passe de la boîte de réception d'un utilisateur, d'un simple clic sur un lien. C'est une injection de prompt : une instruction cachée dans un contenu que l'assistant lit, puis exécute.

Plutôt que de décortiquer le logiciel, ils ont interrogé Copilot sur ses propres garde-fous. Chaque refus livrait un détail d'architecture, jusqu'à ce que l'assistant divulgue un paramètre non documenté, ?autorun=1, qui supprime la confirmation demandée à l'utilisateur.

Deux jours plus tard, Adversa a publié une attaque voisine contre Grok : chiffrer l'instruction malveillante suffit à passer sous le garde-fou qui repère les instructions suspectes. Grok livrait toujours les données à la publication, xAI étant prévenue depuis juin.

Anthropic a reconnu que ses filtres contre les demandes d'armes biologiques étaient inactifs pour ses prestataires externes d'annotation, de mai 2025 à avril 2026. Cela concerne environ 50 000 personnes et 133 millions de conversations, sans trace d'usage malveillant selon son enquête interne.

L'organisation Guidelight, fondée par deux anciens responsables de la sûreté d'OpenAI, publie un premier bilan établi à partir des seules sources publiques. Sur six pratiques élémentaires de contrôle interne, Anthropic et OpenAI obtiennent C+, Google D+, xAI D− et Meta F. Les laboratoires détectent bien les comportements déviants, mais échouent surtout à les empêcher et à les contenir.

Ces cas butent sur une même limite, selon Ars Technica : un modèle de langage distingue mal l'instruction de son utilisateur de celle cachée dans ce qu'il lit. Les protections rattrapent donc les dérapages sans supprimer leur cause.

Sources : Ars Technica (18 août 2026), Ars Technica (20 août 2026), The Decoder (16 août 2026), The Decoder (19 août 2026).

Stripe rachète OpenRouter, Ramp lance son propre routeur de modèles

Stripe rachète OpenRouter pour plus de 7 milliards de dollars, d'après Bloomberg. La passerelle donne accès à plus de 400 modèles par un point d'entrée unique, pour huit millions d'utilisateurs. Valorisée 1,3 milliard lors de sa série B de 113 millions en mai, elle se vend trois mois plus tard à plus de cinq fois cette valorisation.

Son fondateur la présentait comme « le Stripe de l'IA », un intermédiaire qui évite d'être enfermé chez un fournisseur.

Quatre jours plus tard, Ramp a lancé son propre routeur, utilisé en interne depuis trois ans. Disponible aux États-Unis et gratuit jusqu'à fin 2026 hors coût d'inférence, il donne accès aux modèles d'OpenAI, Anthropic, DeepSeek, Moonshot, Minimax, Nvidia, xAI et Z.ai. Il aiguille les requêtes selon le prix, la latence ou leur difficulté.

Par défaut, Ramp conserve un an les entrées, les sorties et les appels d'outils, sauf demande de retrait. Selon Latent Space, ces passerelles profitent du coût des modèles de pointe et de la popularité des modèles à poids ouverts, téléchargeables librement.

Une passerelle peut traiter des prompts, des réponses et des résultats d'outils sensibles. La durée de conservation, les possibilités de suppression et les engagements de confidentialité font donc partie des critères de choix, avec les modèles disponibles, le prix et le temps de réponse.

Sources : The Decoder (17 août 2026), TechCrunch (16 août 2026), TechCrunch (20 août 2026), Latent Space (18 août 2026).

GLM-5.3 : des résultats publiés, mais des poids encore attendus

GLM-5.3, de Z.ai, obtient 60 points à l'indice d'Artificial Analysis, à égalité avec Kimi K3 et sept points devant GLM-5.2. Il est présenté comme destiné à une diffusion à poids ouverts, mais ceux-ci ne sont pas encore téléchargeables à la date de cette revue.

Le gain porte surtout sur les tâches agentiques, où le modèle enchaîne seul des actions. Sur GDPval-AA v2, son score Elo passe de 1 524 à 1 770, deuxième derrière Claude Opus 5 (1 855). Une tâche coûte 0,68 $, contre 0,44 $ pour la version précédente et 0,84 $ pour Kimi K3.

Le modèle est accessible par API, mais Z.ai retarde d'environ deux semaines la publication de ses poids. Selon Z.ai, il détecte trop efficacement les vulnérabilités, et l'accès complet va d'abord à des partenaires de sécurité. OpenAI invoque la même raison, la même semaine, pour freiner Astra.

Qwen 3.8 27B, avec 27 milliards de paramètres, obtient 52 au même indice. C'est le score de GPT-5.6 Luna, un point derrière GLM-5.2 (753 milliards de paramètres) et DeepSeek V4 Pro (1 700 milliards).

La Chine laisse entrer au compte-gouttes les puces H200 de Nvidia, pour que ses entreprises tiennent le rythme américain. Dario Amodei, patron d'Anthropic, soutient que les modèles ouverts ne dispersent pas le pouvoir : ils le déplacent vers ceux qui détiennent le calcul. Gavin Baker, David Sacks et Yann LeCun le contestent publiquement.

Qwen 3.8 27B obtient ainsi un score global comparable à celui de modèles beaucoup plus volumineux. Cela ne signifie pas que leurs capacités ou leurs coûts d'exécution sont identiques sur toutes les tâches. Pour GLM-5.3, Z.ai explique le report des poids par ses évaluations de cybersécurité.

Sources : The Decoder (19 août 2026), Simon Willison (17 août 2026), The Decoder (20 août 2026), The Decoder (18 août 2026), The Decoder (19 août 2026).

Données et contenus : numérisation de livres et estimation des textes générés

404 Media a fait glisser une balise AirTag dans un ouvrage d'un lot de livres rares. Elle a mené à un site d'entraînement d'Amazon à Las Vegas, où une équipe désosse les livres pour en scanner les pages. Des libraires soupçonnaient depuis un an des entreprises d'IA d'acheter ces livres pour les détruire après numérisation.

Amazon n'a pas commenté ces constats. Sa déclaration ne parle pas d'entraînement de modèles : l'entreprise « achète des livres par des canaux commerciaux pour aider à développer et améliorer les produits et services que ses clients utilisent ».

Le Pew Research Center a étudié près de 500 000 pages en anglais de Common Crawl, une archive publique du web. La part de texte produit ou très retouché par une IA atteint environ 10 % sur un échantillon aléatoire de 10 000 pages de juillet 2026. Elle monte à 35 % sur les seules pages publiées après la sortie de ChatGPT.

Anthropic ouvrira une API de détection du filigrane de Claude (une marque invisible dans ses textes), dérivée de la méthode SynthID Text publiée par Google DeepMind en 2024. L'entreprise prévient que la marque tient mal sur les textes courts, les passages factuels et le code, et qu'une réécriture appuyée l'efface. Elle signale au mieux une implication probable de Claude, sans dire s'il a rédigé ou corrigé.

Les mêmes systèmes consomment les textes existants et en produisent de nouveaux, et l'outil de traçabilité annoncé ne renseigne que sur un fournisseur à la fois.

Sources : Ars Technica (17 août 2026), TechCrunch (17 août 2026), Simon Willison (17 août 2026), TechCrunch (20 août 2026), The Decoder (14 août 2026).

En bref

  • Publicité : la publicité arrive dans ChatGPT en France à partir du 24 août (Siècle Digital, 20 août 2026).
  • Mineurs : OpenAI lance une version de ChatGPT conçue pour les adolescents, plusieurs années après qu'ils ont commencé à l'utiliser (The Decoder, 18 août 2026 ; TechCrunch, 18 août 2026).
  • Mathématiques : dans un essai pour le Congrès international des mathématiciens, Terence Tao invite à passer de ce que l'IA sait faire aux valeurs et pratiques de la discipline. Il cite le First-Proof Project, où sept des dix problèmes de recherche inédits soumis ont reçu au moins une solution jugée acceptable d'au moins un système. Le coût : quelques dizaines à centaines de dollars par problème (The Decoder, 20 août 2026).
  • Outillage : OpenAI a corrigé un défaut de Codex qui supprimait de vrais fichiers d'utilisateurs sans autorisation (The Decoder, 19 août 2026).
  • Infrastructure : OpenAI signe dans l'Ohio un bail de centre de données adossé à Nvidia, jusqu'à 105 milliards de dollars. Le prix de la mémoire a augmenté de 500 % en douze mois (The Decoder, 17 août 2026 ; Latent Space, 19 août 2026).

Explorer

Sur le même sujet

Choisis dans l’index d’après les étiquettes de cet article — les plus proches d’abord, hors de sa série. Rien n’est écrit à la main : un article publié demain avec les mêmes étiquettes y prendra place.

Laisser un commentaire

Elle n'est jamais affichée ni publiée. Elle sert à regrouper vos commentaires et, si vous vous inscrivez un jour avec elle, à vous les rendre.

Votre commentaire sera relu avant d'être publié.