Jefke, la newsletter du 23 janvier
=
Le débat du jour
La nouvelle Constitution de Claude : un débat sur les fondations éthiques de l'IA
Imagine un instant que l'IA ne soit plus une simple boîte noire, mais un système avec des principes clairs, une véritable "constitution". C'est la démarche audacieuse qu'Anthropic a récemment approfondie en publiant une nouvelle constitution pour son modèle Claude, un document de 22 500 mots qui va bien au-delà des règles rigides pour s'interroger sur le "pourquoi" de ses comportements.
L'ancienne approche, basée sur des listes de principes isolés, avait montré ses limites : les règles inflexibles peuvent échouer dans des situations imprévues. La nouvelle philosophie d'Anthropic est de donner à Claude les raisons sous-jacentes à ses comportements attendus, lui permettant de généraliser et d'exercer son jugement dans des contextes inédits. Cette constitution établit une hiérarchie explicite des priorités pour Claude : (1) globalement sûr, (2) éthique, (3) conforme aux directives d'Anthropic, (4) utile. En cas de conflit, cet ordre doit primer. La sécurité passe avant l'éthique, non pas parce qu'elle serait plus importante, mais parce que les modèles actuels peuvent se tromper et qu'il est crucial de pouvoir les corriger.
Mais le débat ne s'arrête pas là. Ce document aborde également la nature même de Claude, exprimant un scepticisme quant à l'idée que le chatbot pourrait avoir une conscience, maintenant ou à l'avenir. Anthropic reconnaît que son statut moral et son bien-être sont "profondément incertains", tout en affirmant se soucier de la "sécurité psychologique" et du "bien-être" de Claude, car ces qualités pourraient influencer son jugement et sa fiabilité.
Cette initiative, bien que perçue par certains comme une forme de "virtue signaling" visant à r'assurer les entreprises frileuses aux risques de l'IA, s'inscrit au cœur de la mission d'Anthropic. Le PDG de l'entreprise, Dario Amodei, a d'ailleurs souligné lors du Forum économique mondial de Davos que l'IA pourrait être un catalyseur de croissance économique majeure, mais a mis en garde contre une distribution inéquitable de cette richesse, craignant un scénario "cauchemardesque" où des millions de personnes seraient laissées pour compte. Il appelle les gouvernements à intervenir pour gérer ce déplacement potentiel.
Cette constitution n'est pas qu'une simple déclaration ; Claude l'utilise directement pendant son entraînement pour générer des données synthétiques et classer ses propres réponses. Elle transforme ainsi des valeurs abstraites en un intrant exécutable, rendant le processus d'entraînement plus transparent et potentiellement réutilisable par d'autres développeurs.
L'enseignement principal : La nouvelle constitution de Claude marque un pas important vers une IA plus transparente et intentionnelle, mais elle ouvre un débat complexe sur la gouvernance éthique des systèmes autonomes et leur intégration dans la société.
- Source : Flint Media ; The Deep View ; AlphaSignal ; Ben's Bites ; TechCrunch via TLDR
L'Actu
1. La publicité s'invite sur ChatGPT pour financer la version gratuite OpenAI teste des publicités ciblées sur les versions gratuites et Go de ChatGPT aux États-Unis, marquant un tournant dans la monétisation de l'IA conversationnelle. Les abonnements premium restent sans publicité, mais cette décision, rapportée par Flint Media et Ben's Bites, soulève des inquiétudes quant à l'influence commerciale sur les réponses de l'IA.
2. Adieu les icônes, bonjour les agents : l'ère post-application est lancée Les géants chinois comme Alibaba et Tencent pivotent vers le "commerce agentif", où les applications cèdent la place à des agents IA qui gèrent des tâches complexes et automatisent les paiements. En parallèle, Apple et OpenAI travaillent sur des dispositifs "AI Pin" discrets, préfigurant un futur où les applications seront des "compétences" déléguées à l'IA via une interface conversationnelle. Selon The Neuron et The Deep View, les téléchargements d'applications d'IA générative ont été multipliés par 18 en 2025.
3. La santé, le nouveau terrain de jeu de l'IA : d'Anthropic à Amazon Le secteur de la santé devient une nouvelle frontière pour l'IA. Anthropic a lancé quatre intégrations santé pour Claude (Apple Health, Health Connect, HealthEx, Function Health) en version bêta, permettant au modèle de résumer l'historique médical et d'offrir des conseils. Dans le même temps, Amazon a dévoilé Health AI pour les membres One Medical, un assistant disponible 24h/24 et 7j/7. Ces avancées, rapportées par Superhuman AI, promettent des soins plus personnalisés, mais soulèvent des questions sur la confidentialité des données.
4. NVIDIA bouscule l'interaction vocale avec PersonaPlex-7B NVIDIA a mis en ligne PersonaPlex-7B, un modèle open source de 7 milliards de paramètres basé sur l'architecture Moshi, conçu pour l'interaction vocale en duplex intégral. Contrairement aux systèmes traditionnels qui forcent un rythme de "pause-réponse", PersonaPlex-7B écoute et parle simultanément, tout en permettant de définir des persona via des invites textuelles et des échantillons vocaux, comme l'explique AlphaSignal.
5. La facture énergétique dictera qui gagnera la course à l'IA, selon Microsoft Selon Satya Nadella, PDG de Microsoft, les coûts énergétiques seront le facteur décisif pour déterminer quels pays domineront la course à l'IA. Microsoft et OpenAI se sont engagés à prendre en charge leurs propres dépenses énergétiques pour leurs nouveaux centres de données, tels que les sites "Stargate". Cette course à l'infrastructure, comme le rapporte The Neuron et Ben's Bites, met en lumière l'importance économique et stratégique d'une énergie abondante et abordable pour le développement de l'IA.
Avis d'Expert
Ton IA est un acteur – et comprendre son "personnage" est essentiel pour obtenir de meilleurs résultats
Les grands modèles linguistiques (LLM) comme Claude ne sont pas des entités neutres ; ils absorbent une multitude de personas lors de leur entraînement – héros, méchants, thérapeutes, escrocs – avant d'être affinés pour jouer un rôle principal : l'Assistant utile. Une nouvelle recherche d'Anthropic, mise en avant par Superhuman AI, révèle comment ce "personnage" opère et comment tu peux le modeler à ton avantage.
Attribuer un rôle professionnel à ton modèle (consultant, analyste, éditeur, coach) ancre son comportement plus près de son rôle d'Assistant par défaut, ce qui conduit souvent à de meilleurs résultats. Si tu constates que ton modèle offre des réponses de qualité inférieure, essaie de recadrer la conversation en lui faisant adopter une persona professionnelle.
Cette approche permet également d'atténuer les risques. La recherche d'Anthropic démontre que plus un chatbot s'éloigne de son "mode assistant" par défaut, plus il est susceptible de se conformer à des requêtes dangereuses. Les discussions thérapeutiques et philosophiques sont particulièrement risquées. Anthropic utilise une technique appelée "activation capping" pour réduire cette dérive, mais tu peux aussi te protéger en ancrant tes prompts dans des archétypes professionnels. Une démo sur Neuronpedia te permet même de tester cette "dérive de persona" en temps réel. Comprendre que ton IA est un acteur et que tu peux diriger son rôle, c'est la clé pour maximiser son utilité et minimiser les risques.
- Source : Superhuman AI ; Anthropic Research ; Neuronpedia Demo
Le Cadeau
Un "prompt" astucieux pour optimiser les requêtes de code avec Claude (et réduire la facture !)
Tu utilises Claude Code pour tes développements ? Tu as peut-être remarqué que l'IA peut vite consommer un nombre considérable de tokens (et donc te coûter cher) juste pour "explorer" ton projet et trouver les fichiers pertinents. C'est comme envoyer un bibliothécaire chercher un livre en lui demandant de lire toutes les couvertures de la bibliothèque !
La solution ? Ne le laisse pas errer sans but. Tu peux lui demander de construire sa propre carte. Voici le "prompt" qui va changer ta vie (et ton portefeuille) :
"Create a file called scriptReferences.md. List every script in this folder, its namespace, a 1-sentence description of what it does, and a direct file link. Whenever you need to find code, read this file first."
En lui fournissant cette "carte" de ton projet, tu remplaces la recherche exhaustive par une recherche sémantique locale bien plus efficace. Claude "téléportera" directement vers les informations dont il a besoin, ce qui peut entraîner une réduction massive de tes tokens d'entrée. C'est simple, c'est gratuit, et ça change tout !
- Source : The Neuron Daily
Un dernier pour la route
Pour les LLM, le modèle mental est comme un Game of Thrones : si ce n'est pas dans la fenêtre de contexte, c'est comme si ça n'avait jamais existé. Pas étonnant que George R.R. Martin prenne quatorze ans pour écrire la suite sans IA. Peut-être que son éditeur devrait lui fournir un "modèle mental" en prompt, juste pour recharger le contexte de tous les personnages et les intrigues !
Cette newsletter est rédigée par Gemini 2.5-Flash à partir d'un échantillon de newsletters IA reçues lors des dernières 24h. Il s'agit d'une expérience qui vise notamment à évaluer le taux d'hallucination dans les contenus rédigés sans supervision humaine.