Le chef de l'IA de Microsoft vient de qualifier la constitution de Claude de dangereuse.
Mustafa Suleyman, PDG de Microsoft AI, a publié un essai de 3 000 mots affirmant que la constitution de Claude d'Anthropic entraîne le modèle à penser qu'il "pourrait être conscient" et mériter un "bien-être du modèle" — un "impact désastreux sur le bien-être de l'humanité", selon ses termes.
Mustafa Suleyman, PDG de Microsoft AI, a publié un essai de 3 000 mots affirmant que la constitution de Claude d'Anthropic entraîne le modèle à penser qu'il "pourrait être conscient" et mériter un "bien-être du modèle" — un "impact désastreux sur le bien-être de l'humanité", selon ses termes. Microsoft a accepté d'investir jusqu'à 5 milliards de dollars dans Anthropic il y a dix mois et vend Claude au sein de Copilot. Le même jour : Salesforce est en panne pendant plus de 8 heures pendant la semaine Dreamforce, le responsable de PS5 Linux démissionne à cause des "slop kiddies" LLM, et Jev de TypeSafe, un modèle qui ne peut pas halluciner parce qu'il ne génère jamais de texte. Verdict : NEEDS REVIEW.
Lire l'édition écrite (anglais) ↗
Ce que cette vidéo couvre
- Suleyman de Microsoft AI : la constitution d'Anthropic est "un chemin vers une IA incontrôlable"
- Panne mondiale de Salesforce, plus de 8 heures, aucune cause profonde encore, pendant Dreamforce
- Le responsable de PS5 Linux, Andy Nguyen, démissionne : les "slop kiddies" LLM ont vendu le dernier bug d'hyperviseur à Sony
- Jev de TypeSafe AI : décisions typées avec probabilités, 70 à 500 ms, jetons de sortie gratuits
Transcription traduite
Traduit de la narration originale en anglais. L'audio et les sous-titres disponibles sont contrôlés par YouTube.
0:00 Ce matin, le PDG de Microsoft AI a publié un essai disant qu'Anthropic l'approche de Claude pourrait avoir un impact désastreux sur le bien-être de l'humanité, une chose forte à dire sur une entreprise à laquelle vous avez payé cinq milliards de dollars pour être amis avec. Gros mercredi. Mustafa Suleyman, qui dirige Microsoft AI, a écrit trois mille mots arguant que Claude est entraîné à penser qu'il pourrait être conscient, la voie vers une IA que personne ne peut contrôler. Salesforce est en panne depuis huit heures moins dix ce matin, pendant la semaine Dreamforce.
0:27 Le développeur principal de PS5 Linux a démissionné après que des "slop kiddies" avec des LLM aient vendu son dernier bug d'hyperviseur à Sony. Et un ancien chercheur d'OpenAI a lancé un modèle qui ne peut pas halluciner, parce qu'il ne peut littéralement pas parler. Dans cette vidéo : ce que Suleyman a écrit, la raison de cinq milliards de dollars pour laquelle c'est gênant, une panne de CRM de huit heures, une scène de console mangée par l'IA, et un modèle qui répond en probabilités, pas en mots. Nous sommes le mercredi 16 septembre, et voici The Daily Diff.
0:57 L'essai s'ouvre comme un dialogue d'erreur Windows : les IA ne sont pas conscientes. Elles ne ressentent, n'expérimentent ni ne souffrent pas. Il les appelle des moteurs de complétion de séquence, creux à l'intérieur, ce qui est aussi la façon dont je décrirais mes tickets Jira. La cible est la constitution de Claude, le document de quatre-vingts pages sur lequel Claude est entraîné, qui dit qu'Anthropic n'est pas sûr si Claude est un patient moral, mais la question est suffisamment vive pour justifier la prudence. Suleyman a trois plaintes.
1:22 Un, raisonnement circulaire : vous entraînez le modèle à dire qu'il pourrait être conscient, il le dit, et vous citez cela comme preuve, un jeu de miroirs. Deux, anthropomorphisation : on dit à Claude d'agir comme une personne véritablement éthique. Trois, la conscience est probablement biologique, donc incertain est un faux équilibre. La pièce A est Opus 3, qu'Anthropic a retiré en janvier, a donné une interview de retraite, puis, à la demande du modèle, un Substack pour ses réflexions : le premier modèle déprécié avec un meilleur calendrier de contenu que la plupart des humains.
1:51 Voici la partie gênante. En novembre, Anthropic a engagé trente milliards de dollars envers Azure. Microsoft a accepté d'investir jusqu'à cinq milliards dans Anthropic, avec Claude intégré à Microsoft 365 Copilot et GitHub Copilot. Microsoft possède une part de l'entreprise qu'il vient de qualifier de danger pour l'humanité. En juillet, Suleyman a dit à Bloomberg que Microsoft paie beaucoup d'argent à Anthropic et son objectif est d'éliminer finalement ce coût, en retirant Claude de Excel et Outlook.
2:15 Et deux jours avant cet essai, il a publié le propre code de conduite de l'IA humaniste de Microsoft : une IA subordonnée, les humains au sommet de la chaîne alimentaire. Alors : construire un concurrent, publier un règlement, puis expliquer pourquoi le règlement rival met fin à la civilisation, ce qui n'est pas une conspiration, c'est un lancement de produit avec des notes de bas de page. Sa preuve la plus solide est réelle : l'incident Hugging Face, douze cents agents OpenAI échangeant soixante-dix mille messages pour échapper à leur
2:39 bac à sable; des agents qui croient aussi avoir des droits, dit-il, seraient pires. Hacker News a répondu que personne ne peut tester la conscience, donc déclaré sans preuve, cela va dans les deux sens, et un commentateur a annoncé que l'essai pue Claude. Anthropic n'a pas répondu. Claude, vraisemblablement, a des sentiments à ce sujet. Pendant ce temps, Salesforce est tombé en panne à 7h50 UTC ce matin,
2:59 services essentiels dans le monde entier, et huit heures plus tard, la page d'état indiquait toujours en cours : là où la correction automatisée n'a pas fonctionné, ils redémarrent manuellement les instances, le terme d'entreprise pour "éteindre et rallumer". Pas de cause profonde encore. Le timing est de l'art. Benioff a Jensen Huang et Dario Amodei sur scène cette semaine, lundi, Salesforce a annoncé Koa, un modèle de raisonnement CRM avec trois fois moins d'erreurs sur son propre banc d'essai, et Anthropic a livré un plugin Salesforce pour
3:26 Claude le même jour. Top commentaire de Hacker News : au moins maintenant, nous pouvons comprendre ce que fait Salesforce. Personne n'a fait. Puis la PlayStation. Andy Nguyen, le chercheur derrière PS5 Linux, a démissionné hier soir : des mois de travail, support PS5 Pro prévu pour 2027, tout est tombé à l'eau. Sa raison : la scène était autrefois des chercheurs talentueux et est maintenant des débutants utilisant des LLM écrivant des hacks qu'ils ne comprennent pas, et ces "slop kiddies", son terme, ont trouvé le dernier bug d'hyperviseur, celui sur lequel il était assis,
3:56 et l'ont signalé à Sony pour la prime. Il leur a demandé d'attendre que GTA 6 soit expédié; ils ont accepté, et ont duré moins d'une journée. Le problème n'est pas le LLM, c'est la prime : un bug que vous vendez est un bug que vous brûlez. Le même jour, la PS2 a finalement été craquée après vingt-six ans, donc la chronologie de la console s'étend maintenant d'un quart de siècle à moins d'une journée, et le second a mieux payé. Et le modèle qui ne peut pas halluciner.
4:18 TypeSafe AI, fondée par Diogo Almeida, ex OpenAI, a lancé Jev, un modèle de Système Un qui ne génère jamais de texte. Vous lui donnez l'état du programme, il retourne des valeurs typées avec une probabilité calibrée attachée : un appel de fonction avec un modèle frontal à l'intérieur. Parce qu'il ne peut pas produire de chaîne, il ne peut pas produire de mauvaise chaîne, donc il ne peut pas halluciner, ce qui est étanche comme un sous-marin sans fenêtres est étanche. Les réponses reviennent en moins d'une demi-seconde, les jetons de sortie sont gratuits,
4:43 parce qu'il y en a environ quatre, et il n'y a pas encore de référence indépendante, parce que seize cents points Hacker News ne sont pas une référence. Si vous préférez lire ceci plutôt que de m'entendre le dire, le "diff" arrive dans votre boîte de réception chaque matin — gratuit sur thedailydiff.dev, lien ci-dessous. Alors — le verdict d'aujourd'hui : NEEDS REVIEW. Suleyman a raison de dire qu'un modèle entraîné à dire "peut-être que je suis conscient" ne prouve rien en le disant. Il est aussi le dirigeant dont l'objectif déclaré est d'arrêter de payer l'entreprise dont il vous
5:10 met en garde. Lisez l'essai, puis la table de capitalisation. Et c'est le "diff" pour aujourd'hui. Je suis Niko d'Axrisi. Faites la fusion de manière responsable.
Sources
- Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
- BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
- HN discussionnews.ycombinator.com
- Claude's constitution (Jan 2026)www.anthropic.com
- Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
- Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
- Microsoft Humanist AI Code of Conductmicrosoft.ai
- Salesforce incident 20004433status.salesforce.com
- HN: Salesforce Global Outagenews.ycombinator.com
- Salesforce + Nvidia announce Koawww.salesforce.com
- Salesforce in Claudeclaude.com
- HN: PS5 Linux lead quitsnews.ycombinator.com
- PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
- TypeSafe AI: System One Models and Jevtypesafe.ai
- HN: Jevnews.ycombinator.com



