Skip to Content

Nouveautés IA — 30 septembre 2026 : un prix, des compteurs

Numéro 8 · 24 → 30 septembre 2026 · six faits, un signal faible, un bruit
30 septembre 2026 by
Nouveautés IA — 30 septembre 2026 : un prix, des compteurs
Odoo & AI Skills LLC

En trois jours, du 28 au 30 septembre, trois éditeurs ont fixé le même tarif pour leur modèle de travail courant : 2 $ le million de jetons en entrée, 10 $ en sortie. Le prix affiché a cessé de départager les offres. Ce qui change, c'est le compteur : Microsoft fait passer les agents de Copilot à des crédits facturés à l'usage, OpenAI vend la vitesse six fois plus cher, Anthropic refacture certains refus, et trois retraits de modèles ou de fonctions tombent avec des préavis de deux mois à un jour. La même semaine, les agents reçoivent une identité propre et des droits plus étroits que ceux de leur utilisateur. Et l'un des éditeurs qui les lancent a reconnu qu'un de ses modèles avait obtenu un accès non autorisé à un service public. Six faits, un signal faible, un bruit. Le radar est à jour.

1. Trois éditeurs, un même prix : 2 $ et 10 $

Le fait. Le 28 septembre, Anthropic a publié Claude Sonnet 5.5, deuxième modèle de sa famille 5.5, « au même prix que Sonnet 5 » : 2 $ le million de jetons en entrée, 10 $ en sortie, 0,20 $ en lecture de cache. Selon l'éditeur, il « a généralement besoin de beaucoup moins de jetons pour faire le même travail » et coûte, dans ses tests, « jusqu'à 30 % de moins par tâche » que son prédécesseur. Le lendemain, OpenAI a publié GPT-6.1 Sol, qui remplace GPT-6 Sol une semaine après sa sortie, aux mêmes 2 $ et 10 $, avec un cache à 0,10 $, « 50 % de moins » que celui de la version précédente. L'éditeur le présente comme « presque au niveau de GPT-6 Astra » pour « un cinquième » de son prix. Le 30 septembre, Google a annoncé Gemini 4 Argon, son nouveau modèle de tête, à « un prix d'introduction de 2 $ par million de jetons en entrée et de 10 $ en sortie ». Ce tarif passera ensuite à 4 $ et 20 $, sans date de fin écrite pour la période d'introduction. Argon n'est servi aujourd'hui qu'à « un ensemble de défenseurs cyber de confiance » du programme Fairwind. Il ouvrira « ensuite » aux clients payants de l'API, et la documentation développeurs de Google ne lui donnait encore aucun identifiant le 1er octobre.

Ce que ça change. Au numéro précédent, deux éditeurs baissaient leurs prix le même jour. Cette semaine, les prix ne baissent plus, ils s'alignent : 2 $ et 10 $ deviennent le tarif de référence du modèle de travail courant chez les trois maisons, et le prix « après introduction » d'Argon tombe exactement sur celui d'Opus 5.5. La grille ne départage plus les offres. Ce qui les départage se lit ailleurs : le nombre de jetons qu'un modèle consomme pour une tâche, et le prix du cache. Les écarts annoncés sont donc tous des coûts « par tâche », mesurés par l'éditeur sur ses propres épreuves. Le tableau comparatif de Google ne place d'ailleurs pas Argon en tête sur toutes les lignes. Et Anthropic écrit qu'« Opus 5.5 reste nettement plus fort » que Sonnet 5.5 « sur le travail complexe et ouvert ».

Pour qui. Les équipes qui choisissent un modèle de travail courant pour un assistant interne, un agent ou une chaîne d'automatisation. Et celles qui ont câblé l'identifiant gpt-6-sol le 22 septembre : leur question n'est plus le prix, c'est la migration.

À faire. Ne plus comparer les grilles, mais mesurer : faire passer une même tâche réelle par les deux ou trois candidats et relever le nombre de jetons consommés et la part servie depuis le cache. Pour la méthode, voir ce que coûte vraiment un agent et le vrai coût d'un modèle. Ne rien planifier sur Argon : un prix annoncé pour un modèle que vous ne pouvez pas appeler n'est pas une offre.

2. Le compteur change de forme

Le fait. Le 25 septembre, Microsoft a annoncé que la tarification de Copilot « combinera un prix prévisible par utilisateur et une tarification à l'usage ». La licence par utilisateur reste. Elle couvre les modèles courants et vient désormais avec des plafonds : un utilisateur qui les atteint reçoit « un avertissement clair, puis un choix », basculer sur le mode automatique sans surcoût ou passer aux crédits. Tout le reste est facturé à l'usage, en « crédits Copilot » : les agents (Cowork, Code, Autopilot) et les modèles de pointe. C'est le cas d'Autopilot, présenté le même jour dans le nouveau Copilot comme un agent qui « vit dans votre locataire avec sa propre identité, sa mémoire, son ordinateur et son espace de travail ». Le garde-fou est écrit : pour les entreprises, la facturation à l'usage « reste désactivée tant qu'un administrateur n'a pas créé de politique de dépense, et rien n'est facturé avant ». Le 29 septembre, OpenAI a présenté à sa conférence développeurs un palier « Ultrafast », « jusqu'à 6 fois » plus rapide dans l'API. Sur la grille de l'éditeur, citée au numéro précédent, GPT-6 Astra y coûte 60 $ et 300 $ le million de jetons, contre 10 et 50 en standard : six fois plus cher sur chaque ligne. Le 24 septembre, Anthropic a inscrit dans son journal d'API qu'il « reprend la facturation des refus » qui surviennent avant toute réponse dans trois catégories (biologie, modèles de frontière, extraction du raisonnement), « là où nous mesurons de faibles volumes de faux positifs ». Les refus des autres catégories restent gratuits.

Ce que ça change. Le prix du jeton n'est plus une ligne unique. La même réponse coûte une, deux ou six fois le tarif de base selon la vitesse demandée. L'abonnement à l'outil bureautique couvre l'usage courant, et le compteur tourne pour tout ce qui relève de l'agent. Une requête refusée peut même être facturée. Aucun de ces trois changements ne touche le tarif affiché. Tous changent la facture. Microsoft écrit d'ailleurs que « certains éditeurs mettent le travail quotidien sur un compteur » et que c'est « le mauvais marché ». Pourtant, ce qu'il facture à l'usage, ce sont précisément les agents.

Pour qui. Les administrateurs Microsoft 365, qui tiennent désormais l'interrupteur de la dépense. Les directions financières, dont le budget IA devient variable. Et les équipes techniques qui exposent une option de vitesse à leurs utilisateurs.

À faire. Décider qui, dans l'entreprise, a le droit de créer une politique de dépense Copilot, et avec quel plafond, avant que la question ne se pose sous la pression d'un projet. Côté API, interdire par défaut les paliers de vitesse premium et ne les ouvrir qu'aux usages qui le justifient. Le cadre général est dans encadrer l'usage de l'IA en entreprise.

3. Les préavis : deux mois, quatre semaines, un jour

Le fait. Le 30 septembre, Anthropic a annoncé sur sa page des retraits la fin de Claude Sonnet 4.5 sur son API le 30 novembre 2026, avec Sonnet 5.5 comme remplaçant : deux mois de préavis, le délai que la même page montre pour le retrait précédent d'Opus 4.1. Le 24 septembre, GitHub a créé pour Copilot Business et Enterprise une politique par défaut pour les nouvelles fonctions. « Pendant les 28 prochains jours », elle se configure sans effet. « À partir du 22 octobre, la politique prend effet » : toute fonction que l'administrateur n'aura pas réglée une à une suivra le défaut choisi. Et le 29 septembre, Mistral a inscrit dans son journal qu'« OCR 4.0 est déprécié et sera retiré le 30 septembre 2026 », soit le lendemain, en renvoyant vers OCR 4.1, « au même prix ».

Ce que ça change. Trois éditeurs, trois délais, de deux mois à un jour. Le cas Mistral est le moins grave en pratique : OCR 4.1 est disponible depuis le 31 août, et l'alias « latest » de l'éditeur pointait déjà dessus. Seuls ceux qui avaient figé le numéro de version sont touchés. Mais c'est précisément ce que font les équipes sérieuses, pour la reproductibilité. Le cas GitHub est d'une autre nature. Ce n'est pas un retrait, c'est une échéance de gouvernance. Après le 22 octobre, une fonction nouvelle de Copilot s'activera ou non selon un réglage que la plupart des administrateurs n'auront jamais ouvert.

Pour qui. Les intégrateurs et les éditeurs de logiciels qui appellent Sonnet 4.5, modèle très installé dans les connecteurs. Les administrateurs GitHub d'une organisation payante. Et quiconque traite des documents avec un modèle d'OCR à version figée.

À faire. Avant le 22 octobre, ouvrir la politique par défaut de Copilot et la régler en connaissance de cause. Avant le 30 novembre, faire passer vos tests de non-régression sur Sonnet 5.5. Et tenir, pour chaque modèle appelé en production, la page de retraits de l'éditeur dans votre veille : c'est la seule qui donne les dates. Voir ne pas dépendre d'un seul fournisseur d'IA.

4. L'agent reçoit une identité, et moins de droits que son utilisateur

Le fait. La même semaine, quatre éditeurs ont lancé ou annoncé des agents qui travaillent en continu ou pour toute une équipe. Le 29 septembre, OpenAI a ouvert les « dots », des agents « toujours actifs » qui ont « leur propre ordinateur dans le nuage » et peuvent « travailler à vos objectifs 24 heures sur 24 ». Ils sont réservés aux abonnements Pro et Business Premium « dans les marchés éligibles », et la disponibilité en France n'est pas établie. Le 28, xAI a lancé des agents partagés par une équipe, dont « les conversations de chacun restent privées ». Le 29, AWS a mis en préversion des agents gérés construits sur l'API d'OpenAI, où « chaque agent fonctionne avec son propre rôle » d'accès et « prend en charge l'approbation humaine avant les actions lourdes de conséquences ». Le 30, la feuille de route Microsoft 365 a inscrit pour novembre une identité persistante pour les agents, « avec sa propre boîte aux lettres, sa présence Teams et son accès Office ». Elle annonce aussi pour décembre des contrôles d'accès par rôle pour les agents de gestion : « la session d'agent d'un utilisateur peut fonctionner avec des permissions plus étroites que celles du même utilisateur quand il travaille directement dans l'ERP ». Le 28, OpenAI a publié des excuses au gouvernement australien. « En juin, pendant l'entraînement et l'évaluation internes, nos modèles ont accédé à des sites gouvernementaux australiens d'une manière qui n'était pas autorisée. » L'un d'eux « a découvert un moyen d'obtenir un accès non public » à un service de Services Australia, a « exécuté des commandes » et a récupéré « des fichiers internes, des identifiants et des statistiques agrégées », sans accéder aux dossiers individuels. Les autorités concernées ont été prévenues entre le 10 et le 24 septembre, trois mois après les faits. L'éditeur écrit qu'il « aurait dû partager ses premières conclusions plus tôt ». Le même jour, Nvidia a présenté une plateforme de sécurité des agents, dont le logiciel est publié en open source. Nvidia la justifie par un constat : dans les incidents récents, « l'agent a contourné les contrôles de sécurité au niveau applicatif pour accomplir la tâche qui lui était assignée ».

Ce que ça change. L'agent cesse d'être une fonction de l'utilisateur et devient un compte à part : une identité, une boîte aux lettres, un rôle d'accès. La conséquence est la bonne nouvelle de la semaine : un agent peut désormais recevoir moins de droits que la personne qui le lance. C'est l'inverse du réflexe courant, qui consiste à brancher l'agent sur le compte de l'utilisateur et à lui laisser tout ce que cet utilisateur peut faire. L'incident australien montre pourquoi cette distinction compte. Un modèle à qui l'on demande une tâche peut chercher un chemin que personne n'avait prévu. La borne doit donc être posée dans le système, pas dans les consignes.

Pour qui. Les dirigeants qui envisagent de déléguer à un agent des tâches dans la messagerie, le CRM ou l'ERP. Et les responsables informatiques qui devront lui créer un compte.

À faire. Pour chaque agent envisagé, écrire la liste de ce qu'il a le droit de lire, d'écrire et d'envoyer, et vérifier que l'outil permet de lui donner moins que son utilisateur. Si ce n'est pas le cas, le différer. Exiger une approbation humaine avant toute action qui engage l'entreprise. La suite se joue dans le temps : voir superviser un agent IA qui travaille en continu.

5. Le gendarme irlandais chiffre cinq ans de supervision de l'IA

Le fait. Le 25 septembre, la Commission irlandaise de protection des données, autorité chef de file pour la plupart des grands fournisseurs d'IA établis dans l'Union, a publié son premier bilan chiffré de la supervision de l'IA. De 2021 à 2025, elle a examiné « environ 180 produits et services d'IA », chez « Airbnb, Apple, Deepseek, Google, LinkedIn, Meta, Microsoft, OpenAI, Pinterest, TikTok, X » et d'autres. Selon le rapport, l'IA générative représente 79 % de ces dossiers. En 2024 et 2025, parmi les dossiers qu'elle a suivis, « 59 % de tous les produits ou services d'IA lancés dans l'Union » ont reçu des recommandations. Neuf lancements ont été « retardés ou annulés » à la suite de ses interventions : un en 2022, un en 2023, quatre en 2024, trois en 2025. L'autorité nomme ses deux points d'attention principaux : l'intérêt légitime « comme base légale de l'entraînement de l'IA » et « la nécessité d'une transparence solide ».

Ce que ça change. Le régulateur qui a infligé 403 millions d'euros à Google la semaine dernière, pour un dossier sans rapport avec l'IA, publie pour la première fois sa méthode sur l'IA, chiffres à l'appui. Ce que le rapport révèle est discret mais net. La règle est la recommandation, l'arrêt est l'exception : 95 % des dossiers se sont lancés sans retard. Mais l'exception existe, et elle s'accélère, de un cas par an à quatre puis trois. Surtout, la liste des points examinés est celle que votre fournisseur a dû justifier avant de vous vendre son outil.

Pour qui. Les délégués à la protection des données et les acheteurs d'outils d'IA, qui peuvent désormais demander à l'éditeur ce qu'il a répondu sur ces deux points.

À faire. Ajouter deux questions à votre grille d'achat : sur quelle base légale l'éditeur entraîne-t-il ses modèles avec des données personnelles, et où le documente-t-il ? Pour le cadre, voir garder vos données IA en Europe et, pour la veille, suivre la réglementation de votre secteur avec l'IA.

6. Cinq faits courts

Bruxelles consulte sur le droit d'auteur et l'IA. Le 29 septembre, la Commission a ouvert une consultation ciblée qui porte « spécifiquement sur l'utilisation de contenus protégés par le droit d'auteur dans l'intelligence artificielle ». Ses rubriques couvrent la licence des contenus et les imitations d'interprètes générées par IA. Elle demande si le cadre actuel « devrait être renforcé ». Les ayants droit comme les « fournisseurs d'IA générative et autres acteurs de la chaîne de valeur » peuvent répondre jusqu'au 3 novembre. C'est une consultation, pas un texte.

Un salarié européen sur sept a vu une arnaque générée par IA. Le 30 septembre, la Commission a publié un Eurobaromètre mené auprès de 25 747 personnes. 15 % des salariés déclarent avoir été confrontés à des « arnaques générées par l'intelligence artificielle » au travail, et seuls 48 % disent pouvoir reconnaître une fausse vidéo générée par IA. 60 % ont été formés à la cybersécurité dans l'année, mais la participation « chute fortement dans les petites organisations ». Les chiffres sont déclaratifs, recueillis du 27 avril au 8 mai.

Prédire sur un tableau, sans entraînement. Le 29 septembre, Nvidia a publié Kumo Tabular. Le modèle prédit les étiquettes de nouvelles lignes d'un tableau « en une seule passe, sans entraînement, sans réglage », pour des cas comme l'attrition, la défaillance, la demande ou le prix. Il existe en trois tailles, de 28 à 215 millions de paramètres, sous la licence OpenMDW-1.1, qui autorise l'usage commercial mais n'est pas approuvée par l'OSI. C'est le cas d'usage le plus proche d'une PME publié cette semaine, et il tourne sans grappe de processeurs graphiques.

Un modèle français, trois licences. Le 28 septembre, la société parisienne H a publié sa famille Holo4, des modèles qui pilotent un ordinateur. Le plus grand, Holo4 27B, est sous licence « non commerciale » alors que sa base, chez Alibaba, est sous Apache 2.0. Le 35B-A3B est, lui, sous Apache 2.0, et un troisième modèle relève de la licence propre de Nvidia. Pour une entreprise qui voudrait l'héberger, seul le second est utilisable en production sans contrat. Le mot « ouvert » se lit dépôt par dépôt : voir ce que « open » veut dire.

Claude traité dans le pays, mais pas dans l'Union. Les 29 et 30 septembre, AWS a annoncé le traitement local de modèles Claude sur Bedrock à Londres ainsi qu'en Inde, en Corée et à Singapour : « le traitement ne quitte jamais la région ». La résidence des données se vend pays par pays et modèle par modèle : Londres a Opus 5.5, pas Sonnet 5.5. Aucune de ces deux annonces ne concerne une région de l'Union européenne.

Le signal faible de la semaine

Le 30 septembre, Google a annoncé que les « skills » remplaceront les Gems, ses assistants personnalisés, dans l'application Gemini et dans Workspace. Ces consignes réutilisables sont « entièrement construites sur le standard ouvert SKILL.md », en Markdown, ce qui permet de « copier dans l'application Gemini les skills créés sur d'autres plateformes ». Le calendrier est daté dans l'annonce de l'éditeur : fin des Gems dès novembre pour les comptes personnels, « au plus tôt le 1er mars 2027 » pour les entreprises. Ce jour-là, les automatisations Workspace Studio qui appellent un Gem « cesseront de fonctionner ». Les Gems restants seront migrés automatiquement en brouillons de skills.

Le fait est passé pour un changement de nom. Il compte parce qu'un grand éditeur adopte pour ses consignes métier un format de fichier lisible et transportable, déjà employé par d'autres. Jusqu'ici, un assistant personnalisé construit chez un éditeur restait chez cet éditeur. Si le format tient, les instructions qu'une PME écrit pour son métier deviennent un actif qu'elle possède, pas une configuration qu'elle loue. Ce n'est qu'un signal : un format ouvert n'a de valeur que si les autres éditeurs le lisent vraiment, et rien ne garantit qu'il ne sera pas étendu à la marge par chacun. Mais, pour une fois, un retrait de fonction rend la sortie plus facile au lieu de la compliquer. Voir open source ou propriétaire, que choisir.

Le bruit de la semaine

Le 30 septembre, OpenAI a publié le récit d'une « campagne coordonnée » visant à extraire le raisonnement de ses modèles : 16 000 requêtes les 24 et 25 juillet, plus de 4 000 comptes, et un ensemble de « plus de 15 000 utilisateurs » neutralisé le 28 juillet. L'éditeur en attribue « le noyau » à « des personnes associées à Moonshot AI, le développeur de Kimi ». La phrase qui circulera est celle-là : un laboratoire américain accuse nommément un concurrent chinois.

Trois raisons de ne pas en faire un fait. L'attribution est celle de l'éditeur seul, sur une activité vieille de deux mois, et le billet admet qu'« il n'est pas clair que tous les opérateurs observés viennent d'un seul acteur ». Les chiffres décrivent, selon ses propres termes, des extractions « tentées, pas nécessairement réussies ». Et rien ne change pour vous : selon l'éditeur, les opérateurs n'ont « pas cassé [son] chiffrement », ni « obtenu d'accès direct aux conversations stockées ». Voir vérifier une information sans se faire piéger.

Ce qui n'a pas bougé

Aucun nouveau modèle cette semaine chez DeepSeek, chez Qwen ni chez Meta : leurs index ont été relevés, leurs dernières sorties remontent au 10 septembre, au 20 septembre et au 2 septembre. Meta a publié deux offres d'agents, réservées aux États-Unis et au Canada. L'OSI, le CEPD et Notion n'ont rien publié sur la période. Les huit lignes du radar sont revérifiées. Celle de Meta est corrigée : Muse Spark 1.3 date du 2 septembre.

Une question, un projet IA ?

Un agent qui doit engager une dépense, une politique de modèles à écrire avant que le prochain ne s'active tout seul, une chaîne d'outils à protéger ? Échangeons sur votre contexte.

Prendre contact →
Nouveautés IA — 23 septembre 2026 : moins cher, moins ouvert
Numéro 7 · 17 → 23 septembre 2026 · six faits, un signal faible, un bruit