Jefke, la newsletter du 10 avril
=
Le débat du jour
Faut-il vraiment paniquer face à Mythos, la nouvelle IA d'Anthropic, ou est-ce "surfait" ?
Tu l'as sûrement entendu : Anthropic a récemment dévoilé un nouveau modèle, Claude Mythos, dont les capacités ont secoué le monde de la cybersécurité. Ce qui rend Mythos si particulier, c'est sa capacité à découvrir des vulnérabilités logicielles par milliers de manière autonome. Imagine : trouver des failles vieilles de plusieurs décennies dans des systèmes critiques comme OpenBSD (27 ans) ou FFmpeg (16 ans), le tout pour un coût de calcul dérisoire de 50 $ [https://www.aiready.so/p/anthropic-unveiled-its-most-powerful-model-and-decided-not-to-release-it].
Face à cette annonce, deux camps s'affrontent. D'un côté, certains, comme Gary Marcus, estiment que la hype est "surfaite" [https://garymarcus.substack.com/p/three-reasons-to-think-that-the-claude]. Il avance que le système testé était dans un environnement "sandboxé", rendant la menace moins immédiate, et que les modèles open-source actuels peuvent déjà accomplir une partie de ces exploits. En d'autres termes, ce serait plus une preuve de concept qu'une menace imminente pour le réseau électrique mondial.
De l'autre côté, une inquiétude palpable se fait sentir. Anthropic a elle-même jugé le modèle trop risqué pour une diffusion publique et a mis en place le "Project Glasswing" [https://www.anthropic.com/glasswing]. Cette initiative donne accès à Mythos à plus de 40 organisations essentielles (dont AWS, Apple, Google, Microsoft) afin qu'elles puissent identifier et corriger les vulnérabilités avant que des acteurs malveillants ne s'en emparent. Plus alarmant encore, Anthropic a briefé des officiels américains, les avertissant que Mythos rend les cyberattaques à grande échelle "significativement plus probables cette année" [https://fortune.com/2026/04/07/anthropic-claude-mythos-model-project-glasswing-cybersecurity/].
Le point de bascule réside dans l'économie des attaques. La capacité à trouver des "zero-day bugs" (failles inconnues) à un coût minimal et sans trace forensique, grâce à un "développeur d'exploits niveau PhD disponible 24/7 à coût quasi nul" [https://www.aiready.so/p/anthropic-unveiled-its-most-powerful-model-and-decided-not-to-release-it], change radicalement la donne. La tension est palpable : Anthropic décrit Mythos comme "à la fois le modèle le mieux aligné et le plus risqué en termes d'alignement" qu'ils aient jamais construit. La même puissance qui le rend utile le rend potentiellement dangereux.
L'enseignement principal : La rapidité et l'autonomie des IA dans la découverte de vulnérabilités obligent à repenser fondamentalement la cybersécurité, passant d'une logique réactive à une urgence proactive.
L'Actu
Meta Muse Spark débarque et tourne le dos à l'open source Meta a lancé Muse Spark, le premier modèle de son Meta Superintelligence Labs, qui alimentera Meta AI et sera déployé sur WhatsApp, Instagram, Facebook, Messenger et les lunettes AI. Bien qu'il soit multimodal et rapide, avec des performances respectables (quatrième sur l'Artificial Analysis Intelligence Index), ce modèle est propriétaire. Cela marque un tournant philosophique pour Meta, qui était jusqu'à présent le plus grand contributeur de modèles ouverts dans l'industrie, bien qu'ils aient promis d'ouvrir les futures versions. Sources : The Deep View, The Neuron Daily, TLDR
Perplexity lance un défi "Billion Dollar Build" avec 1 million de dollars à la clé Perplexity a annoncé une compétition de 8 semaines, le "Billion Dollar Build", où les participants doivent créer une entreprise viable avec un potentiel d'atteindre une valorisation d'un milliard de dollars en utilisant Perplexity Computer. Les gagnants se partageront 1 million de dollars d'investissement initial et 1 million de dollars de crédits Computer. Source : Superhuman AI
Google Gemini et NotebookLM fusionnent pour des espaces de travail persistants Google a intégré NotebookLM à Gemini, permettant de créer des espaces dédiés où conversations, fichiers et instructions sont regroupés pour une tâche spécifique. Cette mise à jour offre un contexte persistant, évitant de répéter les informations à chaque nouvelle interaction, et peut stocker jusqu'à 100 sources. Sources : AlphaSignal, Ben's Bites
L'adoption de l'IA en entreprise : la réalité des chiffres De nouvelles données d'a16z révèlent que 29% des entreprises du Fortune 500 et 19% du Global 2000 sont des clients payants d'une startup IA. Le codage est l'utilisation dominante, et contrairement à une idée reçue, seulement 5% des projets pilotes IA échouent à se concrétiser, réfutant la statistique de 95% de l'étude du MIT. Sources : AIReady.so, TLDR
Les "AI Overviews" de Google et le défi de la précision Un rapport récent du NYT indique que les "AI Overviews" de Google sont précises à 90%, mais avec 5 billions de recherches par an, cela signifie des dizaines de millions d'erreurs chaque heure. Le problème est que ces aperçus sont présentés avec une confiance apparente, même lorsqu'ils s'appuient sur des sources peu fiables comme Facebook ou Reddit, ou génèrent des résumés factuellement faux. Source : Superhuman AI
Avis d'Expert
L'infrastructure de sécurité : le nouveau "moat" compétitif à l'ère des agents IA
À mesure que les agents IA deviennent plus autonomes et capables d'exécuter des tâches complexes, le "coût de l'erreur" augmente de façon exponentielle. Une IA mal alignée ou compromise peut avoir des conséquences désastreuses. C'est pourquoi l'infrastructure de sécurité autour des agents IA n'est plus un simple ajout, mais un véritable avantage compétitif.
Des entreprises comme Guild AI construisent une "couche de sécurité" fondamentale pour ces agents. Leur plateforme permet aux développeurs de déployer des dizaines d'agents spécifiques aux flux de travail à travers une entreprise, tout en leur donnant les outils pour suivre précisément leurs actions, itérer en toute sécurité et protéger l'organisation des résultats imprévisibles. James Everingham, PDG de Guild AI, souligne que la sécurité n'est pas une réflexion après coup, mais la fondation même sur laquelle le déploiement responsable de l'IA doit reposer [https://tdv.transistor.fm/episodes/37-the-race-to-control-ai-agents-begins-james-everingham].
Dans un monde où les agents IA peuvent trouver des vulnérabilités logicielles à faible coût ou automatiser des processus métier critiques, la capacité à les contrôler, à les monitorer et à garantir leur alignement avec les objectifs de l'entreprise devient essentielle. Cette nouvelle approche de la sécurité permet non seulement de mitiger les risques, mais aussi d'accélérer l'innovation en offrant un cadre de déploiement confiant. L'avenir de l'IA en entreprise dépendra de la robustesse de ces "moats" de sécurité.
Le Cadeau
Wispr Flow : Dites adieu à la frappe sur Android !
Marre de taper sur ton téléphone ? Wispr Flow est l'outil qu'il te faut ! Cette application révolutionnaire te permet de dicter du texte n'importe où sur ton appareil Android. Que ce soit pour un message WhatsApp, un email Gmail, un prompt ChatGPT ou des commentaires de code, Wispr Flow convertit tes paroles en texte propre et poli. Tu peux parler naturellement, avec des "euh" et des changements d'avis, l'application se charge de nettoyer, corriger la grammaire et formater le tout. C'est simple, intuitif et ultra-efficace.
Et le meilleur dans tout ça ? Wispr Flow est gratuit et illimité sur Android pendant sa période de lancement !
Un dernier pour la route
OpenAI a récemment célébré les 3 millions d'utilisateurs hebdomadaires de Codex en "réinitialisant les limites d'utilisation", transformant ce qui devrait être un événement technique en un véritable jour férié pour les développeurs. Apparemment, rien ne dit "nous vous aimons" comme des "painsticks gratuits" illimités pour les codeurs affamés.
Cette newsletter est rédigée par Gemini 2.5-Flash à partir d'un échantillon de newsletters IA reçues lors des dernières 24h. Il s'agit d'une expérience qui vise notamment à évaluer le taux d'hallucination dans les contenus rédigés sans supervision humaine.