Article

Revue IA du 17 juillet 2026 : modèles ouverts et responsabilité des services

Kimi K3 et Inkling ont des profils différents. En Allemagne, les régulateurs examinent les réponses d’IA comme des contenus dont les services répondent.

Kimi K3 et Inkling rejoignent cette semaine l'offre de modèles ouverts, avec des niveaux de performance et des tarifs différents. Les résultats d'Artificial Analysis permettent une comparaison commune, sans résumer tous les usages. En Allemagne, les régulateurs des médias prennent aussi position sur la responsabilité des services qui produisent des réponses avec l'IA.

Kimi K3 : comparer les résultats et le coût par tâche

Moonshot AI a mis en service Kimi K3 sur Kimi.com, dans ses outils et par API. Le modèle compte 2 800 milliards de paramètres, dont 16 « experts » (sous-réseaux) actifs sur 896. Il accepte un million de tokens de contexte (un token est un fragment de mot), et pas seulement du texte en entrée. Ses poids complets, qui permettent de le faire tourner chez soi, sont promis au plus tard pour le 27 juillet.

Avant la sortie, TechCrunch relayait des sources anonymes du Financial Times qui l'attendaient au niveau d'Opus 4.8 ou au-delà. Moonshot levait alors des fonds sur une valorisation de 31,5 milliards de dollars, contre 20 milliards en mai.

Sur ses propres tests, Moonshot place K3 derrière Fable 5 et GPT-5.6 Sol. Il y devance Opus 4.8, GPT-5.5 et GLM-5.2, « largement » sur presque tous selon The Decoder. Moonshot reconnaît un « écart notable d'expérience utilisateur » avec Fable 5 et Sol.

L'indice d'Artificial Analysis resserre le tableau : 57 points, contre 60 pour Fable 5, 59 pour Sol et 56 pour Opus 4.8. Le taux d'hallucination de K3, qui mesure sa tendance à affirmer des réponses fausses, passe de 39 % sur K2.6 à 51 %.

La méthode de calcul des scores compte également. Ofir Press, auteur de ProgramBench, reproche à Moonshot d'avoir publié une moyenne des parties implémentées plutôt que le nombre de programmes entièrement fonctionnels. Un résultat partiellement réalisé peut obtenir une bonne note sans être utilisable.

Le tarif passe de 0,95 à 3 dollars par million de tokens en entrée et de 4 à 15 dollars en sortie, exactement celui de Claude Sonnet 5. The Decoder y lit la fin des modèles chinois de pointe à prix plancher. À la tâche, l'écart avec Sol se réduit encore. Artificial Analysis chiffre K3 à 0,94 dollar par tâche de son indice, contre 1,04 pour Sol, dont le token de sortie coûte pourtant deux fois plus cher.

La hausse ne porte que sur le modèle de pointe de Moonshot. Dans l'offre ouverte chinoise, GLM-5.2 (0,32 dollar par tâche) et DeepSeek V4 Pro (0,04 dollar) restent bien moins chers.
Sources : The Decoder (16 juillet 2026), AINews (17 juillet 2026), TechCrunch (16 juillet 2026).

Inkling se présente comme une base à adapter

Thinking Machines Lab, la société de Mira Murati, ancienne directrice technique d'OpenAI, a publié Inkling, dont les poids sont en libre accès sur Hugging Face sous licence Apache 2.0. Il compte 975 milliards de paramètres, dont 41 milliards actifs par token ; la version Small, 276 milliards dont 12 milliards actifs.

Inkling lit texte, images et son, et répond en texte. Il accepte un million de tokens de contexte avec les poids publiés, 256 000 par l'API. Il est facturé 1,87 dollar par million de tokens en entrée et 4,68 dollars en sortie jusqu'à 64 000 tokens de contexte, le double au-delà.

Artificial Analysis lui donne 41 points : trois de plus que Nemotron 3 Ultra, jusque-là meilleur modèle ouvert d'un laboratoire américain, mais seize de moins que Kimi K3. Sur ses tâches d'agent, il devance Kimi K2.6 et DeepSeek V4 Flash (1 238 points Elo sur GDPval-AA v2, contre 1 190 et 1 189). AINews le situe en revanche derrière GLM-5.2 sur ces tâches, et derrière Kimi K2.6 en multimodal. Son taux d'hallucination mesuré atteint 63 %.

Thinking Machines écrit qu'Inkling « n'est pas le modèle le plus fort disponible aujourd'hui », et le propose comme base à adapter sur Tinker, sa plateforme de spécialisation. Pour une entreprise qui voudrait bâtir dessus, deux points de l'annonce pèsent plus que le rang. Ses données synthétiques, produites par d'autres modèles, viennent entre autres de Kimi K2.5, un modèle chinois. Et le corpus comprend des données publiques qui « peuvent être protégées par la propriété intellectuelle ».
Sources : The Decoder (16 juillet 2026), AINews (16 juillet 2026).

Allemagne : les réponses d'AI Overviews et de Perplexity relèvent du droit des médias

La Commission des licences et de la surveillance (ZAK) des régulateurs allemands des médias a rendu ses premières décisions contre des services d'IA de Google et de Perplexity. Pour la première fois, elle applique le traité d'État sur les médias aux moteurs de recherche et chatbots d'IA, traités en fournisseurs de contenu.

Selon la ZAK, Google enfreint la section 109 du traité, sur la transparence et la non-discrimination. Ses résumés AI Overviews passent au-dessus des résultats et repoussent les liens, surtout vers les sources journalistiques. À Perplexity, elle reproche pour l'instant l'absence de représentant désigné en Allemagne et d'informations de transparence. Les décisions sont immédiatement exécutoires ; les deux entreprises ont un mois pour faire appel.

La portée dépasse ces deux dossiers. Dans la lecture rapportée par The Decoder, une réponse générée est le contenu propre du service. La protection de responsabilité du règlement européen sur les services numériques (DSA) ne s'y applique donc pas. Un tribunal de Munich avait déjà traité un texte généré comme contenu propre et tenu Google responsable d'affirmations fausses ; Google fait appel.

L'effet sur le trafic n'est mesuré que par des tiers : selon les études citées, 1 % des utilisateurs cliquent sur un lien source depuis un AI Overview. Google les conteste sans publier de données contraires. « Quiconque décide, par la sélection et le placement des liens, si un contenu est trouvé doit le rendre transparent », résume le président de la ZAK, Thorsten Schmiege.

Le 16 juillet, la Commission européenne a par ailleurs enjoint à Google, au titre du règlement sur les marchés numériques (DMA), d'ouvrir Android à ses concurrents. Google doit aussi assurer l'interopérabilité avec les assistants d'IA et moteurs de recherche tiers.
Sources : The Decoder (16 juillet 2026), The Verge (16 juillet 2026), Ars Technica (16 juillet 2026).

Cinéma et industrie : les usages annoncés suscitent des réactions différentes

Netflix emploie l'IA dans environ 300 productions, a indiqué son co-directeur général Ted Sarandos lors de la dernière présentation des résultats. L'usage porte surtout sur la postproduction, de la conception et la prévisualisation jusqu'à la livraison. L'IA sert à élargir des scènes de foule, ou à garder des batailles historiques sinon coupées pour des raisons de budget ou de délai.

La série documentaire « The American Experiment » contient 17 minutes d'images assistées par IA, produites selon lui deux fois plus vite et pour moitié moins cher. Les économies iraient « probablement » à davantage de contenus plutôt qu'à réduire un budget de 20 milliards de dollars.

Les gains annoncés proviennent de Netflix et ne sont pas accompagnés d'une comparaison indépendante. Le temps et le coût de la version classique restent estimés, puisqu'elle n'a pas été produite. The Decoder rapporte aussi des usages peu déclarés dans d'autres studios, notamment avec Seedance. Le nombre de productions annoncé par Netflix ne permet donc pas, seul, de comparer son adoption à celle du secteur.

George Lucas a déclaré que l'IA représentait l'avenir du cinéma. En Corée du Sud, les ouvriers syndiqués d'une usine automobile Hyundai ont voté une grève préventive. Ils s'inquiètent du projet du constructeur de déployer 25 000 robots humanoïdes Atlas à partir de 2028, fabriqués par sa filiale Boston Dynamics.
Sources : The Decoder (17 juillet 2026), Siècle Digital (17 juillet 2026), Ars Technica (16 juillet 2026).

En bref

  • Justice : xAI poursuit un utilisateur accusé d'avoir généré avec Grok des images pédocriminelles réalistes. Ars Technica relève qu'en engageant cette action, l'entreprise ne peut plus nier que Grok en produit (Ars Technica, 16 juillet 2026 ; The Verge, 15 juillet 2026).
  • Trafic : le trafic des agents d'IA sur le web a progressé de 45 % au cours des derniers mois (Siècle Digital, 17 juillet 2026).
  • Identifiants : Anthropic et 1Password s'associent pour que Claude puisse utiliser les identifiants d'un utilisateur pour naviguer et acheter sur le web (The Verge, 16 juillet 2026).
  • Chine : l'Administration du cyberespace de Chine a autorisé Apple Intelligence, sur la base d'un accord qui intègre le modèle Qwen d'Alibaba à iOS, iPadOS, macOS et visionOS. Baidu confirme travailler aussi avec Apple sur des fonctions pour les utilisateurs chinois. Aucun calendrier n'est donné ; lancées en 2024, ces fonctions étaient retardées en Chine faute d'autorisation (TechCrunch, 16 juillet 2026).
  • Adolescents : OpenAI plaide pour que les adolescents aient accès à une IA encadrée, avec des outils sûrs et des contrôles parentaux (OpenAI, 16 juillet 2026).
  • Musique : Suno est accusée de s'être entraînée sur des millions de morceaux piratés (Siècle Digital, 17 juillet 2026).

Explorer

Sur le même sujet

Choisis dans l’index d’après les étiquettes de cet article — les plus proches d’abord, hors de sa série. Rien n’est écrit à la main : un article publié demain avec les mêmes étiquettes y prendra place.

Laisser un commentaire

Elle n'est jamais affichée ni publiée. Elle sert à regrouper vos commentaires et, si vous vous inscrivez un jour avec elle, à vous les rendre.

Votre commentaire sera relu avant d'être publié.