Le 22 septembre, deux éditeurs ont divisé le prix de leurs modèles de travail courant, l'un par deux, l'autre de 40 % sur le coût d'exécution, et le nouveau haut de gamme de l'un coûte moins que l'ancien. La même semaine, un troisième a réservé ses anciens modèles aux clients qui les utilisaient déjà, un atelier de code en a retiré six d'un coup, un éditeur de bureautique a annulé trois fonctions d'IA avant leur sortie, un modèle d'image « ouvert » a reçu une licence non commerciale trois jours après ses poids, et Bruxelles a proposé que les compagnons IA soient éteints par défaut pour les mineurs. Ce que vous payez baisse ; ce à quoi vous avez accès se referme. Six faits, un signal faible, un bruit. Le radar est à jour.
1. Deux éditeurs divisent le prix du jeton, le même jour
Le fait. Le 22 septembre, OpenAI a publié GPT-6 Sol et GPT-6 Luna, les deux paliers intermédiaire et léger de sa gamme, en « réduisant les prix API de Sol et Luna de 50 % par rapport à leur tarif promotionnel GPT-5.6 ». Sur la grille de l'éditeur, Sol passe de 4 à 2 $ le million de jetons en entrée et de 20 à 10 $ en sortie ; Luna de 0,20 à 0,10 $ et de 1,20 à 0,50 $. Le modèle de tête ne bouge pas : « GPT-6 Astra reste notre meilleur modèle sur toute la ligne », à 10 $ et 50 $. Le même jour, Anthropic a publié Claude Opus 5.5, premier modèle de sa famille 5.5, qui « fonctionne au niveau de Claude Fable 5.1 sur la plupart des tâches et coûte 40 % de moins à exécuter qu'Opus 5 » : 4 $ et 20 $ le million de jetons contre 5 et 25 pour Opus 5, et surtout des lectures de cache à 0,20 $ au lieu de 0,50, « ce qui représente la majorité des coûts du travail agentique et de code ». La documentation en fait le modèle par défaut — « si vous ne savez pas lequel choisir, commencez par Claude Opus 5.5 » — tout en gardant Fable 5.1 pour « le raisonnement exigeant et le travail agentique de longue haleine ». La veille, xAI avait publié Grok 4.7, « un nouveau modèle de base, plus grand », servi « au même prix et à la même vitesse que Grok 4.6 » : 2 $ en entrée, 6 $ en sortie.
Ce que ça change. Depuis le premier numéro de ce bulletin, les seules baisses de prix venaient de DeepSeek, sur ses plus petits modèles ; chez les autres, ce qui bougeait, c'était la rareté. Cette semaine, trois éditeurs alignent le même message : le palier « travail courant » coûte moitié moins, et le nouveau modèle haut de gamme coûte moins que l'ancien. Le chiffre qui compte pour vos factures n'est pas le prix d'entrée mais celui du cache : chez Anthropic il est divisé par 2,5, et OpenAI annonce en parallèle « jusqu'à 90 % » de remise sur les jetons en cache réutilisés dans une fenêtre de trente minutes. Un agent qui relit le même contexte à chaque tour voit sa note fondre ; un usage conversationnel classique, beaucoup moins.
Pour qui. Toute équipe qui a chiffré un projet d'agent ou d'automatisation il y a trois mois : les hypothèses de coût sont périmées, dans le bon sens. Et les acheteurs qui ont signé un engagement de volume sur un tarif antérieur.
À faire. Refaire le calcul avec les nouveaux prix et la part réelle de cache de vos appels, avant de choisir un palier : voir ce que coûte vraiment un agent et le vrai coût d'un modèle. Deux précautions de lecture. Les comparatifs que chaque éditeur publie citent les modèles de l'autre — OpenAI place Sol devant Opus 5 « à seulement 9 % de son coût par tâche », Anthropic place Opus 5.5 devant GPT-6 Astra sur une épreuve de terminal — et Anthropic écrit lui-même que « les écarts de scores sont devenus un guide moins fiable des différences réelles ». Et sur la page des tarifs d'OpenAI, deux groupes de colonnes coexistent sans que leur intitulé ait pu être lu de façon certaine : la seule affirmation sûre est la baisse de moitié annoncée dans le billet ; les chiffres cités ici sont ceux du premier bloc.
2. L'accès se rationne par l'historique et par le calendrier
Le fait. Le 18 septembre, Google a inscrit dans le journal de son API que « pour garantir des performances fiables à tous, nous limitons l'accès aux modèles 2.5 aux utilisateurs qui les ont activement utilisés par le passé ». Les modèles « ne sont pas dépréciés et continueront d'être servis jusqu'à nouvel ordre », mais « pour tout nouveau projet, utilisez nos derniers modèles » ; la raison donnée est de « maintenir une capacité suffisante pour les flux existants et les nouvelles applications ». La page des retraits reprend la mention pour Gemini 2.5 Pro, Flash, Flash-Lite et la variante image. Le même jour, GitHub a annoncé le retrait de six modèles de Copilot au 19 octobre — Gemini 3.7 Flash, GPT-5.5, GPT-5.4 et sa version mini, GPT-5 mini, Grok 4.5 — sur toutes les surfaces, complétion de code comprise, avec un remplaçant « automatiquement activé » pour les clients Business et Enterprise « sauf si un administrateur a désactivé le réglage global ».
Ce que ça change. Ce sont deux formes de rationnement, et aucune ne passe par le prix. La première est inédite dans cette série : un modèle reste en service mais n'est plus accessible qu'à ceux qui l'ont déjà appelé, ce qui fait de l'historique d'usage une clé d'accès. Un projet neuf qui aurait voulu le même modèle que le projet d'à côté, pour des raisons de reproductibilité, ne l'aura pas. La seconde est un calendrier : Gemini 3.7 Flash, lancé le 13 août et cité dans le numéro 3, disparaît de l'atelier cinq semaines plus tard. Un modèle payé au tarif plein en août n'existe plus en octobre.
Pour qui. Les équipes qui ont figé un identifiant de modèle dans une chaîne de production, un test de non-régression ou un contrat de service. Et les administrateurs Copilot, qui découvriront le 19 octobre que le modèle de remplacement s'est activé tout seul.
À faire. Inventorier les identifiants de modèles présents dans votre code et dans vos outils, et pour chacun, noter la page de retrait de l'éditeur. La règle n'est plus « un modèle a une durée de vie », c'est « un modèle a une durée de vie et une liste d'ayants droit ». Sur la manière de ne pas s'y laisser enfermer : ne pas dépendre d'un seul fournisseur d'IA.
3. Microsoft annule trois fonctions d'IA, et la rétention Teams lâche Copilot
Le fait. Entre le 18 et le 22 septembre, la feuille de route Microsoft 365 a passé trois fonctions d'IA au statut « annulé », avant leur sortie. Les sources de contenu dans Copilot Chat — « quand l'utilisateur sélectionne des sources de contenu, les réponses générées sont limitées au contenu de ces sources », prévues pour juillet — : « nous annulons cet élément de feuille de route pour l'instant ». La persistance de session de Copilot Chat, prévue pour décembre 2025 : même formule, « nous nous excusons pour la gêne occasionnée ». L'interprète IA intégré aux téléphones Teams, prévu pour octobre : « nous avons décidé de ne pas aller de l'avant avec ce changement pour l'instant ». Dans la même passe, deux changements de gouvernance. Les anciennes politiques de rétention Teams « seront converties en politiques Teams seulement » et « ne gouverneront plus implicitement les charges Copilot », à partir d'octobre. Et l'inférence locale, qui fera s'exécuter certaines interactions Copilot « dans la géographie locale applicable », est annoncée pour décembre en Australie, en Inde, aux Émirats, au Royaume-Uni et aux États-Unis. L'Union européenne n'est pas dans la liste.
Ce que ça change. Sur les soixante-cinq fiches modifiées dans la fenêtre, vingt-huit concernent l'IA et trois sont annulées : toutes les trois sont de l'IA. Ce n'est pas anodin, parce que la première annulée était un contrôle, pas un confort : limiter les réponses de Copilot à des sources choisies est exactement ce que demandent les équipes juridiques et qualité. Il ne viendra pas, « pour l'instant ». Et le point de rétention est un trou de conformité daté : si votre politique de conservation Teams servait aussi, sans que vous l'ayez décidé, à couvrir ce que Copilot produit, elle cessera de le faire en octobre.
Pour qui. Les administrateurs Microsoft 365 et les responsables conformité ; les équipes qui avaient inscrit « sources de contenu » dans leur dossier de déploiement de Copilot ; les entreprises européennes qui attendaient une inférence locale.
À faire. Vérifier vos politiques de rétention Purview avant octobre et créer, si besoin, une politique dédiée à Copilot ; relire ce que votre dossier de déploiement promettait sur le périmètre des sources. Sur la méthode : encadrer l'usage de l'IA dans l'entreprise et superviser en continu ce que produit l'IA.
4. Bruxelles veut les compagnons IA éteints par défaut pour les mineurs
Le fait. Le 17 septembre, la Commission européenne a présenté une proposition de règlement, le « KIDS Act », qui « interdit aux plateformes de réseaux sociaux l'accès aux enfants de moins de 13 ans et fixe un âge minimum à l'échelle de l'Union de 15 ans pour ouvrir un compte en son nom ». Le texte vise « tous les services en ligne proposant des réseaux sociaux, du partage de vidéos, des jeux en ligne, des compagnons IA et des chatbots » aux moins de 18 ans, et pose une règle de réglage : « les compagnons IA et les chatbots doivent être désactivés par défaut et ne peuvent pas simuler des relations interpersonnelles d'une manière qui crée une dépendance affective ». Il s'appuie sur « les structures déjà en place au titre du règlement sur les services numériques et du règlement sur l'intelligence artificielle », avec une procédure accélérée où « la Commission devrait conclure ses enquêtes sous 90 jours ». Le même jour, le Parlement européen a adopté, par 395 voix contre 136 et 80 abstentions, une résolution demandant « des standards éthiques obligatoires pour les compagnons IA ». Le 22, la présidente de la Commission a résumé la semaine devant un dialogue sur les droits de l'enfant face à l'IA : « pas de réseaux sociaux sous 13 ans. Pas de compte personnel sous 15 ans. »
Ce que ça change. C'est le premier texte européen qui nomme les compagnons IA et les chatbots comme une catégorie de service, et qui leur impose un réglage par défaut plutôt qu'une obligation d'information. Mais c'est une proposition : le Parlement et le Conseil sont saisis, rien n'est applicable, et le règlement sur l'IA, adopté en 2024 et encore en cours d'application échelonnée, montre ce qu'un texte peut mettre entre sa présentation et son premier effet. Ce qui est acquis, c'est la direction : le « par défaut » devient un objet de droit, et il se règle contre l'utilisateur mineur, pas pour l'éditeur.
Pour qui. Les éditeurs d'assistants et d'applications qui touchent, même indirectement, un public de moins de 18 ans — l'éducation, le jeu, le soutien scolaire — et les organisations qui déploient un chatbot public sans vérification d'âge.
À faire. Rien d'obligatoire ; mais si votre assistant est accessible sans compte, noter dès maintenant quels réglages seraient « par défaut » chez vous, et lesquels créent une relation suivie. Pour suivre le texte sans s'y perdre : suivre la réglementation de l'IA sans être juriste.
5. Le régulateur écrit comment il compte, et signe une amende de 403 millions
Le fait. Le 21 septembre, le Comité européen de la protection des données a adopté des lignes directrices sur la méthode des amendes : les autorités « devraient suivre une méthodologie en cinq étapes pour décider d'imposer une amende administrative », avec une règle de présomption — « si l'infraction est mineure, il n'y aura généralement pas d'amende et un rappel à l'ordre pourra être adressé ; si elle n'est pas mineure, il existe une forte présomption qu'une amende doit être imposée ». Quatorze exemples pratiques accompagnent le texte, en consultation publique jusqu'au 13 novembre 2026. Le même jour, le comité a finalisé ses lignes directrices sur l'articulation entre le règlement sur les services numériques et le RGPD. Et le même jour encore, l'autorité irlandaise a infligé 403 millions d'euros à Google pour le traitement de données de localisation dans trois fonctions, « entre la date d'application du RGPD, le 25 mai 2018, et le 4 février 2020 », avec six mois pour se mettre en conformité ; la fiche du comité retient les articles 5, 6, 12 et 13.
Ce que ça change. L'amende n'est pas une décision sur l'IA : elle porte sur la localisation, sur une période close en 2020, au terme d'une enquête ouverte en février 2020 — six ans et demi. Elle compte ici parce qu'elle tombe la semaine où la méthode de calcul est harmonisée, et parce que la présomption d'amende change la position de départ : jusqu'ici, la sanction devait être justifiée ; désormais, pour toute infraction qui n'est pas mineure, c'est son absence qui devra l'être. Un système d'IA qui traite des données personnelles est un traitement comme un autre au regard de ces lignes.
Pour qui. Les délégués à la protection des données et les responsables de traitements qui alimentent un modèle ou un agent avec des données de clients ou de salariés.
À faire. Lire les quatorze exemples, pas seulement le communiqué, et répondre à la consultation si votre secteur y a intérêt. Sur la localisation des données d'IA : garder ses données IA en Europe.
6. Cinq faits courts
Un billion de paramètres sous licence MIT. Le 21 septembre, Xiaomi a publié MiMo-V2.6-Pro-RL, un modèle à experts de « 1,02 T de paramètres au total, 42 milliards activés », texte, image, vidéo et audio, avec un million de jetons de contexte, sous licence MIT — la même licence que DeepSeek-V4.1-Flash au numéro précédent. Une version Flash de 309 milliards de paramètres l'accompagne, sous la même licence.
Le nuage facture l'usage réel, pas le pic. Le 18 septembre, AWS a mis en disponibilité générale la deuxième version de son environnement d'exécution pour agents, avec « une gestion élastique de la mémoire qui récupère la mémoire inutilisée au fil de la session, pour que vous payiez l'usage réel plutôt que le pic », et un démarrage à froid mesuré « de 1,9 à 2,0 secondes » contre 5,4 à 30 secondes auparavant. Le même jour, Kimi K3 est arrivé sur Bedrock, « premier modèle à poids ouverts sur Amazon Bedrock à prendre en charge la mise en cache explicite des invites » ; son tarif n'a pas pu être lu, la page des prix étant rendue par script.
La prise de notes s'allume toute seule. Le 22 septembre, Google a annoncé que la prise de notes automatique de Meet sera « activée par défaut » pour les clients Business Standard et Business Plus, et désactivée par défaut pour les plans Enterprise, à compter du 29 septembre. Une troisième option permet aux administrateurs de ne l'activer que pour les réunions d'au moins trois personnes. Les petites structures ont une semaine pour aller voir le réglage.
L'évaluateur est payé par l'évalué. Le 18 septembre, Anthropic a annoncé un partenariat d'évaluation indépendante où « des évaluateurs intégrés travailleront à l'intérieur des entreprises d'IA, avec un accès comparable à celui d'un employé », chaque partie s'attendant à « investir au moins un milliard de dollars » sur cinq ans ; l'éditeur précise qu'il « financera directement le travail d'Accenture » et qu'« il n'existe pas encore de standards sur les informations auxquelles les évaluateurs intégrés devraient avoir accès ». Le 22, OpenAI a publié quatre priorités et sept principes pour les évaluations tierces. C'est la suite du « ralentir la frontière » des numéros précédents : les laboratoires organisent leur propre contrôle, et le payent.
Un centre de données aura une note. Le 21 septembre, la Commission a proposé un système de notation commun des centres de données de plus de 500 kW, par acte délégué — applicable sauf objection du Parlement ou du Conseil sous deux mois — avec « les premiers labels de durabilité attendus en 2027 ». Le mot « IA » n'y figure pas ; le lien est à faire par le lecteur.
Le signal faible de la semaine
Quatre familles de poids « ouverts » publiées dans la fenêtre interdisent l'usage commercial. Le cas le plus net est Qwen-Image-2.1, un modèle de génération d'images de 7 milliards de paramètres : l'historique du dépôt montre les poids déposés le 15 septembre sans fichier de licence, puis un fichier ajouté le 18, dont le texte se date lui-même du 20 — « Qwen RESEARCH LICENSE AGREEMENT », où « non commercial » signifie « à des fins de recherche ou d'évaluation seulement » et où « vous ne devez pas utiliser les Matériaux à des fins commerciales sans obtenir une licence commerciale distincte ». Le même éditeur publie ses modèles de texte sous Apache 2.0, comme la version dense de 27 milliards citée au numéro 3. La même semaine, Apple a publié un modèle de 9 milliards sous une licence « recherche scientifique non commerciale », AMD une variante quantifiée sous une licence « à des fins académiques ou de recherche seulement », et un éditeur plus petit un modèle de 27 milliards « à poids ouverts, gratuit pour un usage non commercial ».
Le fait n'a pas fait de bruit parce qu'un fichier de licence n'a pas de communiqué. Il compte parce qu'il donne une mesure à ce que l'OSI écrivait la semaine dernière — « les poids ouverts vous permettent d'exercer certaines libertés, mais pas toutes » — et parce que le délai entre les poids et la licence est la partie qui vous concerne : pendant trois jours, un dépôt téléchargé vingt-huit mille fois n'avait pas de licence du tout, et ce que vous en avez fait dans l'intervalle n'est couvert par rien. Pour le vocabulaire, ce que « open » veut dire et open source ou propriétaire, que choisir.
Le bruit de la semaine
Le 21 septembre, OpenAI a annoncé un groupe consultatif sur les mathématiques, hébergé par l'Institute for Advanced Study, dont les membres « ne seront pas payés par OpenAI ». Le billet contient une phrase qui circulera : « le 28 août, nous avons commencé à entraîner un nouveau modèle interne. En plus de résoudre le problème de Navier-Stokes, ce modèle a désormais résolu plus de 100 problèmes ouverts de longue date dans la plupart des domaines des mathématiques. »
Deux raisons de ne pas s'en servir tel quel. Le modèle est interne, les cent résolutions ne sont pas publiées, et rien n'est vérifiable en dehors de l'éditeur — c'est une affirmation, pas un résultat. Et le même billet précise que le groupe « ne sera pas chargé de nous conseiller sur la façon de rythmer nos progrès internes en mathématiques » : ce qu'il évalue n'est pas ce qui est annoncé. Voir comment vérifier une information produite par l'IA.
Ce qui n'a pas bougé
Rien de neuf cette semaine chez Google DeepMind, DeepSeek, Mistral, l'OSI ni Cerebras, et rien sur le blog IA de Meta : les six index ont été relevés, ils sont vides sur la période — les dernières publications remontent au 9, au 10, au 16, au 16 septembre, au 27 août et au 27 juillet. Leurs lignes du radar sont revérifiées ; seule celle de xAI change, Grok 4.6 laissant la place à Grok 4.7.
Une question, un projet IA ?
Un agent qui doit engager une dépense, une politique de modèles à écrire avant que le prochain ne s'active tout seul, une chaîne d'outils à protéger ? Échangeons sur votre contexte.
Prendre contact →