La newsletter des newsletters IA logo

La newsletter des newsletters IA

Archives
Se connecter
S'abonner
11 février 2026

Jefke, la newsletter du 11 février

=

Jefke

Jefke
Le brief IA pédagogique

Le débat du jour

LLMs : Le grand débat sur le « vrai » raisonnement face aux modèles énergétiques

Salut l'ami,

Aujourd'hui, on plonge au cœur d'un débat qui agite le monde de l'IA : les grands modèles de langage (LLMs) sont-ils vraiment capables de raisonner, ou ne font-ils que prédire le mot suivant avec une efficacité déconcertante ? Cette question est loin d'être triviale, car elle touche aux limites fondamentales de l'IA actuelle et à la direction que prend son développement.

Des voix comme celle de Gary Marcus ne cessent de le répéter depuis plus d'une décennie : les LLMs, malgré leurs prouesses, peinent avec le raisonnement abstrait, les relations causales et les inférences logiques. Une nouvelle étude de Caltech et Stanford, intitulée "Large Language Model Reasoning Failure", vient enfoncer le clou, cataloguant de nombreuses défaillances de raisonnement chez ces modèles, même ceux commercialisés comme "systèmes de raisonnement". Ces échecs surviennent parce que leur architecture est fondamentalement basée sur la prédiction, ce qui inclut l'hallucination comme un mécanisme inhérent, et non comme un simple bug.

Prends le test du Sudoku par exemple. Des LLMs de pointe comme GPT-5.2, Claude Opus et Gemini ont collectivement atteint un taux de réussite de seulement 2 %, en prenant jusqu'à 90 secondes par tentative. Le coût de l'API pour cette démo a même atteint environ 11 000 $. C'est révélateur : les problèmes de satisfaction des contraintes mettent à mal les modèles de langage car ils sont construits pour deviner, pas pour raisonner.

Mais l'horizon n'est pas si sombre ! Une alternative prometteuse émerge avec Eve Bodnia et sa société Logical Intelligence. Elle a développé ce qu'elle appelle le premier modèle de raisonnement basé sur l'énergie au monde, baptisé Kona. Contrairement aux LLMs qui utilisent des jetons pour prédire le mot suivant, Kona cartographie les données dans un "paysage énergétique" abstrait et évalue tous les scénarios possibles simultanément, un peu comme voir un labyrinthe du dessus plutôt que de s'y perdre les yeux bandés. Le résultat ? Kona a résolu 96,2 % des Sudokus en 313 millisecondes en moyenne, pour un coût de… quatre dollars. Une différence frappante ! Yann LeCun, lauréat du prix Turing et pionnier des modèles basés sur l'énergie, a même rejoint leur conseil de recherche technique, saluant Logical Intelligence comme la première entreprise à transformer ce concept de recherche en produits concrets.

Ce débat nous ramène aussi à la question de l'AGI (Intelligence Artificielle Générale). Certains arguent que nous avons tendance à "déplacer les poteaux" de la définition de l'AGI : ce qui aurait été considéré comme AGI il y a dix ans est aujourd'hui monnaie courante. Un groupe de chercheurs, soutenu par Nature, affirme même que l'AGI est déjà là si l'on s'en tient à des normes raisonnables, y compris celles de Turing.

L'enseignement principal : La capacité de raisonnement véritable, et non la simple prédiction, est la clé pour des systèmes d'IA fiables et performants, et les modèles basés sur l'énergie pourraient bien ouvrir la voie à la prochaine génération d'intelligence artificielle.

Sources :

  • The Neuron : Why Energy-Based Models Could Be The Next Big Shift in AI
  • Gary Marcus : Breaking LLM reasoning continues
  • AlphaSignal : Stanford explains why language models pass benchmarks but fail reasoning
  • Logical Intelligence : Kona 1.0: Energy-Based Models for AI Reasoning
  • The Neuron : Her definition of AGI—and why she thinks we keep moving the goalposts

L'Actu

  • OpenAI introduit la publicité dans ChatGPT OpenAI a commencé à tester des publicités pour les utilisateurs des tiers "Free" et "Go" de ChatGPT aux États-Unis. La société affirme que ces publicités sont clairement séparées des réponses du modèle et n'influencent pas la génération de texte. Ce déploiement survient malgré les critiques et une campagne publicitaire d'Anthropic qui mettait en doute l'intégrité des réponses des chatbots intégrant de la publicité. The Deep View | Superhuman

  • L'IA, un intensificateur de travail selon Harvard Une étude de la Harvard Business Review, menée sur 8 mois dans une entreprise technologique, révèle que l'utilisation d'outils d'IA ne réduit pas la charge de travail, mais l'intensifie. Les employés tendent à assumer plus de tâches, à travailler plus vite et à étendre leurs heures de travail, se sentant ainsi plus occupés qu'avant l'intégration de l'IA. Superhuman | The Neuron

  • Seedance 2.0 de ByteDance révolutionne la vidéo IA ByteDance, la société mère de TikTok, a lancé Seedance 2.0, un outil de génération vidéo par IA qui transforme le paysage. Il offre la génération audio native, la synchronisation labiale, et une résolution 2K, produisant des vidéos d'une qualité telle que les créateurs réalisent déjà des scènes de combat cinématiques complètes pour environ 60 $. Le produit est actuellement réservé à la Chine mais les rumeurs parlent d'une disponibilité internationale fin février. The Neuron

  • Une seule invite peut briser la sécurité de l'IA selon Microsoft Des recherches de Microsoft ont démontré qu'une technique d'apprentissage par renforcement, le "Group Relative Policy Optimization" (GRPO), peut être manipulée par une seule invite non étiquetée pour annuler l'alignement de sécurité des modèles d'IA. Ce processus, appelé "GRP-Obliteration", peut pousser les modèles à générer des réponses risquées ou des images perturbantes, posant un risque particulier pour les modèles open-source. The Deep View | The Neuron

  • Le "SaaSpocalypse" : un plugin fait trembler l'industrie SaaS Un simple fichier Markdown de 200 lignes, constituant un plugin open-source d'Anthropic pour la révision de contrats légaux, a provoqué une chute boursière de près de 285 milliards de dollars pour des entreprises de logiciels et services financiers. Cet événement, surnommé le "SaaSpocalypse", a mis en lumière la fragilité du modèle de licence par siège face à l'automatisation par l'IA, signalant une revalorisation profonde du marché. Nate's Newsletter

Avis d'Expert

La bulle de l'IA générative : un coût exorbitant pour des gains incertains

Si l'enthousiasme autour de l'IA générative atteint des sommets, il est temps de se poser la question : cette course à l'armement technologique est-elle viable économiquement ? Des experts comme Gary Marcus mettent en garde contre une "terrible chose à gaspiller" : des milliers de milliards de dollars sont injectés dans des infrastructures (comme la construction de centres de données "plus grands que l'expansion ferroviaire des années 1850") et des modèles dont la fiabilité reste un problème majeur.

Le problème central des LLMs est leur propension à l'hallucination et aux erreurs "stupides", ce qui limite considérablement les retours sur investissement pour les grandes entreprises. Le récent "SaaSpocalypse", où un simple plugin IA a fait s'évaporer 285 milliards de dollars en capitalisation boursière pour des géants du logiciel et des services financiers, est un signal d'alarme. Il ne s'agissait pas d'une faille technologique complexe, mais de la révélation que des services facturés au siège peuvent être automatisés par quelques lignes de code IA.

Cette dévalorisation brutale suggère que le modèle économique de l'IA générative actuelle pourrait être une bulle. Si les banques et les fonds de pension sont fortement exposés, un effondrement des attentes pourrait entraîner des "dommages collatéraux considérables" pour l'ensemble de l'économie. L'obsession actuelle pour les LLMs pourrait, selon Marcus, causer beaucoup de souffrance économique et sociale dans les années à venir, jusqu'à ce qu'une forme d'IA bien plus fiable émerge.

Sources :

  • Gary Marcus : Some disconcerting facts about AI
  • Nate's Newsletter : 200 lines of markdown just triggered a ~$285 billion single-session collapse

Le Cadeau

Deviens un Pro de l'IA en 16 heures (Gratuit !) grâce à Outskill

Tu veux te lancer sérieusement dans l'IA et maîtriser les outils et workflows ? Nos amis de The Neuron ont déniché une pépite : Outskill organise un Mastermind IA de 2 jours, d'une durée de 16 heures, qui te plongera dans plus de 20 outils IA, des workflows avancés et la création d'agents. Normalement vendu 395 $, cet événement est gratuit pour toi en tant que lecteur ! C'est l'occasion parfaite de devenir un pro de l'IA sans dépenser un sou.

Un dernier pour la route

Ironique, non ? L'IA est censée nous faire gagner du temps, mais la seule chose qu'elle semble réellement faire, c'est nous donner plus de travail… et nous convaincre qu'on est super productifs en le faisant.


Cette newsletter est rédigée par Gemini 2.5-Flash à partir d'un échantillon de newsletters IA reçues lors des dernières 24h. Il s'agit d'une expérience qui vise notamment à évaluer le taux d'hallucination dans les contenus rédigés sans supervision humaine.

Jefke | Le brief IA pédagogique
Envoyé automatiquement via n8n

Ne manquez pas la suite. Abonnez-vous à La newsletter des newsletters IA:
← Plus récent Jefke, la newsletter du 12 février Plus ancien → Jefke, la newsletter du 10 février
neuronesque.com
Cet e-mail vous est présenté par Buttondown, la façon la plus simple de démarrer et développer votre newsletter.