La newsletter des newsletters IA logo

La newsletter des newsletters IA

Archives
Se connecter
S'abonner
23 mai 2026

Jefke, la newsletter du 23 mai

=

Jefke

Jefke
Le brief IA pédagogique

Le débat du jour : La fin des forfaits "illimités" et l'avènement de l'économie du token

Cette semaine marque un tournant majeur dans la consommation des services d'IA, et il est temps que tu comprennes bien ce qui se joue. Les géants de l'IA comme Anthropic, OpenAI et Google sifflent la fin de la récréation pour les forfaits "illimités" que beaucoup d'utilisateurs intensifs pensaient encore avoir. L'heure est à la facturation basée sur la consommation réelle de tokens, et cela change tout, surtout pour les agents autonomes.

Jusqu'à présent, de nombreux "power users" pouvaient exploiter des abonnements à faible coût (environ 20 dollars par mois) pour faire tourner leurs agents, qui généraient des centaines, voire des milliers d'interactions en quelques heures, là où un humain en ferait quelques dizaines. Le hic, c'est que ces abonnements n'ont en réalité jamais été vraiment illimités, avec des restrictions en nombre de messages ou de documents. Mais désormais, cette distinction devient explicite et tarifée différemment.

Le 13 mai, Anthropic a annoncé que, à partir du 15 juin, l'usage de ses modèles par des agents (via des harnais tiers comme OpenClaw ou Hermes, ou le SDK Agent) serait facturé aux tarifs API standard, avec une enveloppe mensuelle de crédits non reportables. Une fois ces crédits épuisés, l'automatisation s'arrête ou la facture grimpe très vite. En quelques dizaines de sessions avec un grand contexte, ton crédit Pro peut être vidé. Une belle création de rente, en effet ! Source: IA Pulse

OpenAI a rapidement réagi en offrant deux mois de Codex Enterprise gratuits pour les entreprises migrant dans les 30 jours, tandis qu'Anthropic augmentait de 50 % les limites hebdomadaires de Claude Code jusqu'en juillet. Source: IA Pulse Ce n'est pas une simple guerre des prix, c'est l'entrée explicite de tout le secteur dans l'économie du token.

Google a enfoncé le clou le 19 mai lors de son I/O 2026. Sundar Pichai a révélé que les plateformes Google traitent désormais 3,2 quadrillions de tokens par mois, une multiplication par 7 en un an. Il a également confirmé que de nombreuses entreprises avaient déjà épuisé leur budget annuel en tokens dès le mois de mai. Source: IA Pulse Le message est clair : "token is gold".

Pourquoi cette ruée vers le token ? D'un côté, le coût unitaire de production du token continue de chuter drastiquement, grâce à des améliorations d'efficacité (Google a réduit ses coûts unitaires de 78 % en un an pour Gemini) et à l'augmentation massive des capacités de calcul (multipliées par 3 par an depuis 2022). Source: IA Pulse De l'autre, le volume global de tokens consommés explose à un rythme tel que cette baisse de coût unitaire est entièrement absorbée. Les modèles Gemini traitent par exemple 19 milliards de tokens par minute via l'API directe. Source: IA Pulse

Les analystes financiers s'attendent à ce que cette consommation devienne enfin rentable pour les fournisseurs. La preuve ? Anthropic a annoncé son premier trimestre bénéficiaire, bien plus tôt que prévu. Source: IA Pulse La pression des marchés boursiers pour les entreprises se préparant à une IPO ne tolère plus l'écart entre un revenu d'abonnement forfaitaire et un coût de calcul variable.

L'enseignement principal : L'ère des tokens gratuits ou presque pour les usages intensifs est révolue. Il est crucial d'optimiser ta consommation et de comprendre la valeur réelle de chaque token utilisé par tes agents.

L'Actu

1. Google AI Studio débarque sur mobile : Construis des apps IA où que tu sois Google vient d'annoncer que son AI Studio sera disponible en application autonome sur ton téléphone. Décris une idée d'application et l'outil la construira directement sur ton mobile. Tu pourras prévisualiser les builds et partager les déploiements avec tes amis. La version iOS est prévue pour le 1er juillet, avec une prise en charge de 76 langues. Source: AlphaSignal

2. Le modèle GRAM de KAIST défie les géants avec 10M de paramètres Une petite révolution se profile avec le modèle GRAM de KAIST, doté de seulement 10 millions de paramètres, qui surpasse des modèles bien plus grands sur des tâches de raisonnement complexes. Il atteint par exemple 97 % de réussite sur le Sudoku et 52 % sur ARC-AGI-1, prouvant que petite taille ne rime pas forcément avec intelligence limitée. Source: AlphaSignal

3. OpenAI résout (en le réfutant) un problème mathématique vieux de 80 ans Un modèle de raisonnement interne d'OpenAI aurait réfuté la conjecture d'Erdős sur la distance unitaire, un problème de géométrie discrète datant de 1946. Le modèle a trouvé un contre-exemple, une nouvelle famille infinie d'arrangements de points qui crée plus de paires à distance unitaire que ce que l'ancienne croyance prévoyait. Des mathématiciens externes ont vérifié et expliqué le résultat. Source: The Neuron

4. La Californie s'attaque aux pertes d'emplois dues à l'IA Le gouverneur de Californie, Gavin Newsom, a signé un décret visant à préparer les travailleurs et les entreprises aux "perturbations économiques" de l'IA. Le plan inclut des formations, plus d'informations publiques sur l'impact de l'IA et des réponses robustes aux changements de la main-d'œuvre, notamment des politiques de sécurité sociale et un "AI playbook" pour moderniser les programmes de formation. Source: The Deep View

5. Les robots humanoïdes de Figure AI font le buzz en ligne Figure AI captive l'attention avec le livestream viral de ses robots humanoïdes manipulant des colis sur un tapis roulant. Initialement prévue pour 8 heures, la diffusion a été prolongée 24h/24 et 7j/7 face à l'engouement du public, qui a même baptisé les robots. Source: TLDR

Avis d'Expert : Le "Slop" IA, un atout sous-estimé ?

Mitchell Hashimoto, cofondateur de HashiCorp et créateur de Ghostty, défend une position à contre-courant : le "slop" généré par l'IA est en fait une bonne chose. Le "slop", c'est ce code ou ce contenu produit rapidement et de manière imparfaite par l'IA, souvent considéré comme une pollution.

Son argument est simple : ce "slop" est précisément ce qui permet une expérimentation rapide et parallèle. Il utilise cette approche pour développer des systèmes où l'interface et l'habillage technique sont volontairement "slop sans aucune honte". Cela lui permet de concentrer la qualité sur le cœur du produit tout en fournissant une version utilisable aux testeurs, en étant transparent sur ce qui est bâclé.

Pour Hashimoto, la même logique s'applique aux extensions de systèmes. Il a lancé des agents en boucle pendant une nuit, générant des dizaines d'extensions de qualité discutable. Mais le coût d'un changement ne se mesure plus en jours de travail, mais en tokens consommés par les agents.

Attention, il nuance son propos : le "slop" est un outil, ni bon ni mauvais en soi. Il ne l'enverrait jamais tel quel à un tiers sans prévenir. La vraie compétence n'est pas de produire du "slop", mais de savoir où il a sa place et comment le gérer. Source: Flint.media

Le Cadeau

Zero.xyz : Le super-outil gratuit pour tes agents IA

Découvre Zero.xyz, un outil gratuit qui libère tes agents IA ! Il leur permet de découvrir des services pour accomplir des tâches sans nécessiter de clés API ou de configurations complexes. Fonctionne avec Claude Code, Codex, Gemini, OpenClaw, Hermes et la plupart des autres agents CLI. C'est l'outil parfait pour rendre tes agents plus autonomes et efficaces. Source: TLDR

Un dernier pour la route

Selon Guido van Rossum, le créateur de Python, tout le monde ajoute une fonctionnalité pour gérer les agents IA depuis son téléphone. Son conseil ? "Ne l'utilise pas. Tu deviendras encore plus accro et tu t'épuiseras encore plus vite." C'est peut-être ça, le vrai prix de la productivité à l'ère de l'IA : la facture en tokens… et en heures de sommeil.

Cette newsletter est rédigée par Gemini 2.5-Flash à partir d'un échantillon de newsletters IA reçues lors des dernières 24h. Il s'agit d'une expérience qui vise notamment à évaluer le taux d'hallucination dans les contenus rédigés sans supervision humaine.

Jefke | Le brief IA pédagogique
Envoyé automatiquement via n8n

Ne manquez pas la suite. Abonnez-vous à La newsletter des newsletters IA:
← Plus récent Jefke, la newsletter du 25 mai Plus ancien → Jefke, la newsletter du 22 mai
neuronesque.com
Cet e-mail vous est présenté par Buttondown, la façon la plus simple de démarrer et développer votre newsletter.