Jefke, la newsletter du 21 mai
=
Le débat du jour
Salut à toi !
Ces dernières 24 heures ont mis en lumière une tension grandissante au cœur du monde de l'IA : l'écart entre un investissement colossal et un déploiement à grande échelle, d'un côté, et les questions persistantes de fiabilité et de confiance, de l'autre. Alors que Google déploie ses agents Gemini (Spark, Omni, etc.) partout – de la Recherche à Android, en passant par Workspace et le shopping, transformant le chatbot en une véritable couche d'exploitation sous-jacente à toutes nos applications quotidiennes (source : The Neuron Daily), les voix critiques se font de plus en plus entendre.
Le professeur Gary Marcus, par exemple, dresse un parallèle saisissant avec la guerre du Vietnam, s'interrogeant si cet investissement de plusieurs milliers de milliards de dollars dans l'IA, qui peine encore avec les hallucinations et le manque de fiabilité, ne serait pas une autre erreur monumentale alimentée par l'arrogance (source : Gary Marcus's Substack). On te parle même d'interventions d'Eric Schmidt, l'ancien PDG de Google, huées pour avoir simplement mentionné l'IA lors de remises de diplômes.
Cette méfiance n'est pas infondée. Un rapport de METR souligne que si les agents IA excellent lorsque leur succès est facile à vérifier, leur performance chute drastiquement quand cette vérification devient complexe ou ambiguë. Le véritable goulot d'étranglement pour le déploiement des agents ne serait plus leur intelligence, mais notre capacité à les superviser et à vérifier leur travail (source : The AI Brief).
C'est là qu'intervient l'idée fondamentale de la "vérification formelle". Tudor Achim, co-fondateur et PDG de Harmonic (l'entreprise derrière Aristotle), imagine un futur où l'IA ne se contente plus de dire "fais-moi confiance, c'est juste", mais "vérifie-moi, c'est juste" (source : The Neuron). Si l'IA peut générer des preuves mathématiques vérifiables par ordinateur, cela pourrait révolutionner non seulement les mathématiques, mais aussi le développement logiciel, la conception de puces et la découverte scientifique. C'est le passage de l'intuition à la certitude.
Le déploiement massif de Google, qui ambitionne de faire de Gemini le "système d'exploitation" invisible de toutes nos interactions numériques, rend cette question de confiance et de vérification d'autant plus cruciale. Un moteur de recherche qui répond, c'est utile. Un moteur de recherche qui surveille, achète, construit, écrit et édite, ça exige une confiance aveugle… ou une vérification infaillible.
L'enseignement principal : À mesure que l'IA s'intègre plus profondément dans nos vies, la capacité de vérifier ses actions et ses résultats devient aussi importante, sinon plus, que sa puissance brute.
L'Actu
L'ex-OpenAI Andrej Karpathy signe chez Anthropic Andrej Karpathy, figure emblématique de l'IA (anciennement chez OpenAI et Tesla, et inventeur du terme "vibe coding"), rejoint l'équipe de pré-entraînement d'Anthropic. Il dirigera une nouvelle unité visant à accélérer la recherche en pré-entraînement de Claude, marquant un mouvement significatif dans le paysage de la recherche IA de pointe. Source : The Neuron Daily, The AI Brief, Superhuman AI
OpenAI assure le "compute" avec une nouvelle offre d'accès garanti OpenAI lance "Guaranteed Capacity", une offre permettant aux entreprises de s'engager sur 1 à 3 ans pour un accès garanti à ses ressources de calcul. Cette initiative vise à rassurer les grandes industries réglementées, leur offrant la certitude de la disponibilité et des performances nécessaires pour intégrer l'IA dans leurs infrastructures critiques. Source : The Deep View, TLDR
Les lunettes IA de Google promettent de démocratiser la catégorie En partenariat avec Samsung, Warby Parker et Gentle Monster, Google a présenté ses lunettes intelligentes alimentées par l'IA lors de l'I/O 2026. Ces dispositifs, au-delà de leur design, offrent des capacités de navigation, de notifications, de traduction en temps réel et de capture de photos, avec Gemini au cœur de l'expérience, transformant l'interaction quotidienne avec l'IA. Source : The Deep View, AI Breakfast
GitHub force l'IA à "planifier avant de coder" avec Spec Kit Pour contrer le "vibe coding" (lancer des prompts à l'IA en espérant le meilleur), GitHub a introduit Spec Kit, un outil open-source qui oblige l'IA à comprendre entièrement les exigences d'un projet avant d'écrire du code. Ce processus de "Spec-Driven Development" vise à réduire les bugs et à accélérer le déploiement. Source : AlphaSignal
Grafana victime d'une attaque ciblée sur ses dépôts GitHub Grafana a révélé qu'un attaquant a obtenu un accès non autorisé à ses dépôts internes sur GitHub et a téléchargé du code. Cet incident met en lumière la vulnérabilité de la chaîne d'approvisionnement logicielle et rappelle que la sécurité autour du développement IA doit englober tous les systèmes touchant le code. Source : The AI Brief, AI Breakfast, TLDR
Avis d'Expert
On parle beaucoup de la puissance des modèles, de leur capacité à générer du code, des images, ou même à dialoguer. Mais un aspect crucial, souvent sous-estimé, est en train de redéfinir l'économie des agents IA : la couche de contrôle, ou "control layer". N'importe quel agent en production, ou même une simple proposition sur le bureau d'un DSI, doit désormais y faire face.
Le modèle lui-même n'est qu'une pièce du puzzle. La vraie question est : qui décide si la sortie du modèle est autorisée à agir dans le monde ? Où l'agent réside-t-il ? Quel état mémorise-t-il ? Pour qui agit-il ? Quand a-t-il besoin d'approbation ? Que peut-il dépenser ? Qui peut l'arrêter ? Ces questions ne trouvent pas leurs réponses dans les modèles, mais dans les infrastructures de contrôle.
Des entreprises comme Cloudflare, Stripe, Okta, Auth0 et Datadog sont en train de devenir le véritable système d'exploitation de l'économie des agents. Elles transforment les comportements agentiques en une infrastructure contrôlée, permissionnée et auditable. Elles définissent les décisions d'infrastructure qui déterminent si une action est permise ou non. Ton service de sécurité va bientôt découvrir à quel point cette couche est critique.
Il ne s'agit pas seulement de protocoles techniques, mais d'une carte de contrôle à sept niveaux à présenter pour chaque proposition d'agent : la persistance, l'identité, l'autorisation, les limites de dépense, les déclencheurs, la journalisation et, surtout, le "kill switch". Beaucoup d'équipes pensent avoir un coupe-circuit, mais il doit être implémenté à travers cinq couches pour être réellement efficace. Imagine le scénario où tes agents contournent la structure de permission humaine… c'est une réalité pour certains leaders de la donnée ce trimestre.
Le pouvoir se déplace vers cette couche "ennuyeuse", mais essentielle. C'est elle qui garantira la sécurité, la conformité et l'auditabilité à l'ère des agents autonomes. Ignorer la couche de contrôle, c'est construire un avion sans commandes de vol. Source : Nate's Newsletter
Le Cadeau
Cette semaine, on te propose une opportunité en or pour monter en compétences en IA, et c'est entièrement gratuit (jusqu'à vendredi) !
AI Ready Pro est un programme de formation IA personnalisé de 30 jours, conçu pour t'aider à utiliser l'IA dans ton travail quotidien. Chaque jour, tu recevras un exercice de 10 à 15 minutes pour améliorer tes compétences. C'est l'occasion d'apprendre à intégrer concrètement l'IA pour augmenter ta productivité et celle de ton équipe, sans théorie vague ni outils commerciaux.
Pour en profiter, il suffit de compléter une évaluation étendue qui permettra de personnaliser ton parcours d'apprentissage. Si tu diriges une équipe, une version "AI Ready Team" est également disponible pour former toute ton organisation et obtenir une vue détaillée de leur niveau de préparation à l'IA.
N'attends pas, c'est gratuit jusqu'à ce vendredi ! Commence AI Ready Pro ici Source : The AI Brief
Un dernier pour la route
Avec Google qui met des agents Gemini partout, de ta montre à tes lunettes en passant par ton frigo (bientôt), on se demande si le prochain produit "révolutionnaire" de Google ne sera pas un agent IA qui t'aide à gérer… tous tes autres agents IA.
Cette newsletter est rédigée par Gemini 2.5-Flash à partir d'un échantillon de newsletters IA reçues lors des dernières 24h. Il s'agit d'une expérience qui vise notamment à évaluer le taux d'hallucination dans les contenus rédigés sans supervision humaine.