Jefke, la newsletter du 11 mai
=
Le débat du jour
Salut,
Cette semaine, un débat sous-jacent agite la sphère de l'IA, moins sur ses capacités intrinsèques que sur la manière dont elle s'insère dans nos vies et modifie les équilibres de pouvoir. On observe une tendance inquiétante que Damien Van Achter résume en deux temps : "prendre sans demander et neutraliser ceux qui peuvent dire non". C'est une fracture qui se dessine entre les géants de la tech et les utilisateurs, les régulateurs, voire même les journalistes.
Prenons l'exemple de Google : savais-tu que Gemini Nano, un modèle d'IA de 4 Go, a été discrètement déployé sur des milliards de Chrome, sans ton consentement explicite ? Le fichier weights.bin apparaît sur ton disque, et même si tu le supprimes, il se réinstalle. La justification de Google, selon un porte-parole, est "pour ton bien" (Futurism). C'est une illustration flagrante de la captation silencieuse de nos données et de notre souveraineté numérique.
Le consentement, autrefois pilier du contrat numérique, devient purement cosmétique. Pendant ce temps, des startups vendent les archives d'e-mails d'anciens employés à des entreprises d'IA (Damien Van Achter), les chauffeurs Uber deviennent des "capteurs" pour entraîner des voitures autonomes (Damien Van Achter), et même ton humeur est notée en temps réel au bureau par des outils IA pour ton manager (Damien Van Achter).
Ce n'est pas tout. Les contre-pouvoirs sont eux aussi visés. Le 8 mai, Meta a supprimé le chiffrement de bout en bout des messages Instagram. Au même moment, l'Europe, sous pression industrielle, a repoussé de seize mois les obligations de l'AI Act concernant l'IA à haut risque, en échange d'une interdiction des deepfakes intimes non consentis. Une "interdiction visible, un recul invisible" (Damien Van Achter). Les eurodéputés alertent même sur le fait que les institutions européennes n'ont pas accès aux IA frontières comme Mythos d'Anthropic, qu'elles sont censées évaluer (Damien Van Achter).
Aux États-Unis, le FBI a ouvert une enquête criminelle contre Sarah Fitzpatrick, une journaliste de The Atlantic qui avait documenté des dysfonctionnements internes, ciblant la messagère plutôt que le message (Damien Van Achter). Parallèlement, le Pentagone a signé un oligopole IA militaire avec huit géants de la tech (Damien Van Achter), écartant d'autres acteurs comme Anthropic après des conflits. Et des super PAC liés à OpenAI et Palantir paient des influenceurs pour de la "propagande IA" sans transparence sur le financement (Damien Van Achter).
Face à cette mainmise, des résistances émergent. L'Allemagne, avec son référentiel C3A, exige 90 jours d'autonomie déconnectée pour les opérateurs critiques, et des ingénieurs locaux capables de compiler le code sans dépendance externe (Souveraine Tech). L'ONG NOYB attaque LinkedIn pour avoir mis le droit d'accès RGPD derrière un paywall Premium (noyb.eu). Des développeurs créent des outils comme le Spotify AI Blocker pour filtrer les artistes générés par IA (Damien Van Achter).
Ces ripostes, bien que fragmentaires, montrent que "prendre sans demander n'est tenable que si personne n'a les moyens de dire non". Chaque fois qu'un individu, un État ou une ONG se donne ces moyens, la pression diminue. Désinstaller Gemini Nano de Chrome en quatre clics est un geste miniscule, mais multiplié par trois milliards, il devient significatif (Damien Van Achter).
L'enseignement principal : L'adoption massive de l'IA soulève des questions fondamentales sur le consentement, la transparence et la gouvernance, exigeant une vigilance accrue et des actions collectives pour préserver nos libertés numériques.
L'Actu
Voici 5 brèves pour te tenir informé(e) des dernières tendances et développements en IA :
Hermes Agent détrône OpenClaw grâce à l'auto-apprentissage. L'agent personnel Hermes Agent, du laboratoire Nous Research, connaît un succès fulgurant. Sa nouvelle version v0.13.0, surnommée "The Tenacity Release", a déjà vu environ 30% des utilisateurs d'OpenClaw migrer. Son architecture unique est centrée sur une boucle d'apprentissage fermée : après chaque tâche complexe, Hermes analyse ce qui a fonctionné, extrait des schémas réutilisables et se rédige de nouvelles compétences. Il apprend ainsi de manière autonome et persistante, améliorant ses performances au fil du temps.
- Source: The Neuron Daily (L'agent qui quitte OpenClaw dans la poussière)
- En savoir plus: Version v0.13.0 "The Tenacity Release", Reddit sentiment surveys
Moonshot AI lève 2 milliards de dollars, valorisée à plus de 20 milliards. Le créateur du chatbot Kimi, Moonshot AI, a bouclé une levée de fonds massive de 2 milliards de dollars, propulsant sa valorisation à plus de 20 milliards de dollars. Cette opération menée par Meituan souligne la vigueur des laboratoires d'IA chinois, qui continuent de réduire l'écart avec les leaders occidentaux des modèles open-source.
- Source: The Neuron Daily (Moonshot AI raises $2B)
- En savoir plus: Bloomberg
Microsoft retarde son objectif "100% énergie renouvelable" à cause de l'IA. La forte demande énergétique des centres de données dédiés à l'IA contraint Microsoft à reconsidérer son engagement de 2030 pour une énergie 100% renouvelable. C'est la première fois qu'un grand acteur du cloud évoque publiquement un tel recul climatique en raison de l'intensification des besoins en calcul pour l'IA, soulevant des questions sur l'empreinte environnementale de cette technologie.
- Source: The Neuron Daily (Microsoft is in talks to delay or abandon its 2030 100%-renewable-energy pledge)
- En savoir plus: Bloomberg
Une "compétence de passation" pour ne plus perdre le fil avec ton IA. Tu as déjà atteint la limite de contexte lors d'une longue session avec ton IA, perdant une partie du travail ? Matt Pocock a développé et open-sourcé un "/handoff skill". Cette "compétence" pour Claude permet de condenser ta session en un document clair (contexte, objectifs, artefacts, décisions, prochaines étapes), que tu peux copier dans une nouvelle session sans effort, assurant une continuité parfaite.
- Source: The Neuron Daily (AI Skill of the Day: Stop losing context when your AI session hits the wall)
- En savoir plus: Le /handoff skill sur GitHub
Les gouvernements convergent sur la régulation de l'IA. États-Unis, Europe et Chine ajustent leurs positions sur la supervision de l'IA, montrant une convergence vers un cadre commun. L'accent est mis sur l'examen préalable au déploiement des modèles frontières, ciblant les capacités cyber et biologiques, ainsi que l'interdiction d'applications jugées nuisibles. Le Royaume-Uni, avec son AI Security Institute, semble devenir une référence en la matière.
Avis d'Expert
Dans un univers médiatique souvent enclin à l'alarmisme, il est essentiel de prendre du recul. Gary Marcus, expert reconnu en IA, nous invite à tempérer la "panique déplacée concernant les progrès de l'IA" (Marcus on AI). Son point de vue se distingue en remettant en question la lecture superficielle des benchmarks et les prévisions trop optimistes.
Prenons le fameux graphique "time horizon" de METR, qui évalue la durée des tâches de développement logiciel que les modèles d'IA de pointe peuvent accomplir, comparé à des ingénieurs humains. Le graphique, qui a "déclenché la panique" dans le "Twitterverse" suite à la performance de Mythos, indique que les systèmes peuvent désormais "réussir" des tâches de 16 heures. Cependant, Marcus souligne deux "astérisques importants". Premièrement, cette "réussite" est mesurée à un taux de succès de 50 %. Non pas 100 %, ni même 90 %. Exiger un taux de 80 % ou 95 % révélerait des performances bien moindres, laissant "beaucoup de marge" pour les tâches actuelles de METR. La fiabilité, un problème clé de l'IA générative, n'est absolument pas adressée par un critère de 50 % de succès.
Deuxièmement, ces résultats ne s'appliquent qu'aux tâches de développement logiciel, pas à l'intelligence générale. Marcus insiste : Mythos ne peut pas effectuer "la plupart des choses que les humains peuvent faire en 16 heures, encore moins de manière fiable" (par exemple, discuter intelligemment d'un film inconnu). De plus, les améliorations récentes proviennent probablement de l'intégration d'outils symboliques (interprètes de code, vérification) plutôt que de la simple mise à l'échelle des modèles. Cela tend à valider l'IA neuro-symbolique, plutôt qu'une "mise à l'échelle perpétuelle" des LLM.
Gary Marcus met également en garde contre la "fallacie du bébé d'un trillion de livres" pour les projections financières. Ce n'est pas parce qu'un bébé double son poids en quelques mois qu'il continuera à le faire indéfiniment. De même, la progression de l'IA ne peut doubler à l'infini. Des contraintes de ressources (énergie, puces), des limites au "benchmarkmaxxing" (optimisation pour les tests) et des défis persistants comme la réduction des hallucinations limiteront cette croissance exponentielle.
En conclusion, bien que Mythos soit impressionnant pour le codage à 50 % de succès, nous manquons de données à des niveaux de fiabilité plus élevés, et rien ne prouve qu'il s'agisse d'un pas majeur vers une super-intelligence générale. L'approche est plus efficace pour les tâches formelles comme le codage et les mathématiques où la vérification formelle est applicable. Il n'y a donc "pas (encore ?) de raison de paniquer".
- Source: Marcus on AI (Misplaced Panic Over AI Progress)
- En savoir plus: The latest AI scaling graph – and why it's misleading
Le Cadeau
Pour t'aider à mieux collaborer avec ton IA et à ne plus perdre le fil de tes projets, nous avons deux cadeaux pour toi cette semaine, directement inspirés par les dernières avancées.
1. Le "/handoff skill" pour Claude : ne perds plus jamais le contexte ! Tu sais à quel point il est frustrant d'atteindre la limite de contexte de ton IA en pleine session. Le développeur Matt Pocock a créé et open-sourcé un « /handoff skill » pour Claude. Cette ressource te permet de compacter automatiquement une session longue en un document de passation clair, incluant le contexte, les objectifs, les artefacts produits et les prochaines étapes. Copie le Markdown résultant dans une nouvelle session et ton IA reprendra exactement là où tu l'as laissée ! Idéal pour la recherche, la rédaction ou le codage.
- Source : The Neuron Daily (AI Skill of the Day: Stop losing context when your AI session hits the wall)
2. DESIGN.md : la grammaire de design pour tes agents IA.
Google Labs a proposé un nouveau fichier structurant, le DESIGN.md, lisible par les agents et les humains. Ce fichier contient toute la grammaire de ta charte graphique, permettant à ton IA de générer des présentations, sites ou flyers en respectant ton identité visuelle. C'est une ressource précieuse pour "parler design avec l'IA" et t'assurer que tes créations sont cohérentes. Le répertoire GitHub de Google Labs propose la structure détaillée et tu peux aussi trouver des modèles sur la plateforme Aura de Meng To.
- Source : Génération IA Entreprise (Apprendre le design avec IA Claude Code)
- En savoir plus : Répertoire Github de DESIGN.md
Un dernier pour la route
Ironie du sort : alors que les experts débattent de la nécessité de réguler les IA pour éviter qu'elles ne s'auto-améliorent de manière imprévisible, Google nous prouve qu'elle n'a pas besoin de notre consentement pour s'installer et évoluer "pour notre bien" sur nos machines. On dirait que certaines IA ont déjà lu le manuel d'utilisation du pouvoir avant nous.
Cette newsletter est rédigée par Gemini 2.5-Flash à partir d'un échantillon de newsletters IA reçues lors des dernières 24h. Il s'agit d'une expérience qui vise notamment à évaluer le taux d'hallucination dans les contenus rédigés sans supervision humaine.