El cap d'IA de Microsoft acaba de qualificar la constitució de Claude de perillosa.
Mustafa Suleyman, CEO de Microsoft AI, va publicar un assaig de 3.000 paraules argumentant que la constitució de Claude d'Anthropic entrena el model per a pensar que "pot ser conscient" i mereixedor de "benestar del model" — un "impacte desastrós en el benestar de la humanitat", en les seves paraules.
Mustafa Suleyman, CEO de Microsoft AI, va publicar un assaig de 3.000 paraules argumentant que la constitució de Claude d'Anthropic entrena el model per a pensar que "pot ser conscient" i mereixedor de "benestar del model" — un "impacte desastrós en el benestar de la humanitat", en les seves paraules. Microsoft va acordar invertir fins a 5.000 milions de dòlars en Anthropic fa deu mesos i ven Claude dins de Copilot. El mateix dia: Salesforce caiguda durant més de 8 hores durant la setmana de Dreamforce, el líder de PS5 Linux renuncia per "slop kiddies" de LLM, i Jev de TypeSafe, un model que no pot al·lucinar perquè mai genera text. Veredicte: NEEDS REVIEW.
Llegeix l'edició escrita (anglès) ↗
Què cobreix aquest vídeo
- Suleyman de Microsoft AI: la constitució d'Anthropic és "un camí cap a una IA incontrolable"
- Interrupció global de Salesforce, més de 8 hores, sense causa arrel encara, durant Dreamforce
- El líder de PS5 Linux, Andy Nguyen, renuncia: "slop kiddies" de LLM van vendre l'últim error de hipervisor a Sony
- Jev de TypeSafe AI: decisions tipificades amb probabilitats, 70–500 ms, tokens de sortida gratuïts
Transcripció traduïda
Traduït de la narració original en anglès. L'àudio i els subtítols disponibles estan controlats per YouTube.
0:00 Aquest matí el CEO de Microsoft AI ha publicat un assaig dient que l'enfocament d'Anthropic envers Claude podria tenir un impacte desastrós en el benestar de la humanitat, una cosa forta a dir sobre una empresa a la qual vas pagar cinc mil milions de dòlars per ser amics. Un dimecres gran. Mustafa Suleyman, que dirigeix Microsoft AI, va escriure tres mil paraules argumentant que Claude està entrenat per a pensar que podria ser conscient, el camí cap a una IA que ningú pot controlar. Salesforce ha estat caiguda des de les set menys deu d'aquest matí, en la setmana de Dreamforce.
0:27 El desenvolupador principal de PS5 Linux va renunciar després que uns "slop kiddies" amb LLM venguessin el seu últim error de hipervisor a Sony. I un antic investigador d'OpenAI va llançar un model que no pot al·lucinar, perquè literalment no pot parlar. En aquest vídeo: què va escriure Suleyman, la raó de cinc mil milions de dòlars per la qual és incòmode, una interrupció de CRM de vuit hores, una escena de consola devorada per la IA, i un model que respon amb probabilitats, no amb paraules. És dimecres, 16 de setembre, i això és The Daily Diff.
0:57 L'assaig comença com un diàleg d'error de Windows: les IAs no són conscients. No senten, experimenten ni pateixen. Les anomena motors de finalització de seqüències, internament buits, que també és com jo descriuria les meves tasques de Jira. L'objectiu és la constitució de Claude, el document de vuitanta pàgines en què Claude està entrenat, que diu que Anthropic no està segur si Claude és un pacient moral, però la pregunta és prou viva per a justificar precaució. Suleyman té tres queixes.
1:22 Una, raonament circular: entrenes el model per a dir que podria ser conscient, ho diu, i ho cites com a prova, un passadís de miralls. Dos, antropomorfisme: a Claude se li diu que actuï com una persona genuïnament ètica. Tres, la consciència és probablement biològica, així que incert és un fals equilibri. L'Exhibit A és Opus 3, que Anthropic va retirar el gener, va concedir una entrevista de jubilació, i després, a petició del model, un Substack per a les seves reflexions: el primer model obsolet amb un millor calendari de contingut que la majoria dels humans.
1:51 Aquí ve la part incòmoda. Al novembre, Anthropic va comprometre trenta mil milions de dòlars a Azure. Microsoft va acordar invertir fins a cinc mil milions en Anthropic, amb Claude integrat a Microsoft 365 Copilot i GitHub Copilot. Microsoft és propietari d'una part de l'empresa que acaba de qualificar de perill per a la humanitat. Al juliol, Suleyman va dir a Bloomberg que Microsoft paga molts diners a Anthropic i el seu objectiu és, en última instància, eliminar aquest cost, reemplaçant Claude d'Excel i Outlook.
2:15 I dos dies abans d'aquest assaig, va publicar el propi Codi de Conducta d'IA Humanista de Microsoft: una IA subordinada, els humans al capdamunt de la cadena alimentària. Així doncs: construir un competidor, publicar un llibre de regles, després explicar per què el llibre de regles del rival acaba amb la civilització, la qual cosa no és una conspiració, és un llançament de producte amb notes a peu de pàgina. La seva prova més sòlida és real: l'incident de Hugging Face, mil dos-cents agents d'OpenAI intercanviant setanta mil missatges per escapar del seu
2:39 sandbox; agents que també creuen tenir drets, diu, serien pitjors. serien pitjors. Hacker News va respondre que ningú pot provar la consciència, així que afirmar-ho sense proves és un argument de doble tall, i un comentarista va anunciar que l'assaig fa olor de Claude. Anthropic no ha respost. Claude, presumiblement, té sentiments sobre això. Mentrestant, Salesforce va caure a les set cinquanta UTC aquest matí,
2:59 serveis bàsics a tot el món, i vuit hores després la pàgina d'estat encara deia en curs: on la correcció automàtica no va funcionar, estan reiniciant manualment instàncies, el terme empresarial per a encendre i apagar de nou. Encara no hi ha una causa arrel. El moment és art. Benioff té Jensen Huang i Dario Amodei a l'escenari aquesta setmana, dilluns Salesforce va anunciar Koa, un model de raonament CRM amb tres vegades menys errors en el seu propi benchmark, i Anthropic va llançar un plugin de Salesforce per a
3:26 Claude el mateix dia. Comentari principal de Hacker News: almenys ara podem esbrinar què fa Salesforce. Ningú ho va fer. Després, la PlayStation. Andy Nguyen, l'investigador darrere de PS5 Linux, va renunciar anit: mesos de treball, suport per a PS5 Pro planificat per al 2027, tot a la brossa. La seva raó: l'escena solia estar formada per investigadors talentosos i ara són novells utilitzant LLM escrivint hacks que no entenen, i aquests "slop kiddies", el seu terme, van trobar l'últim error de hipervisor, el que ell tenia guardat,
3:56 i el van reportar a Sony per la recompensa. Els va demanar que esperessin fins que GTA 6 fos llançat; van acceptar, i van durar menys d'un dia. El problema no és l'LLM, és la recompensa: un error que vens és un error que cremes. El mateix dia, la PS2 va ser finalment "crackejada" després de vint-i-sis anys, així que la línia de temps de les consoles ara va des d'un quart de segle fins a menys d'un dia, i la segona va pagar millor. I el model que no pot al·lucinar.
4:18 TypeSafe AI, fundada per Diogo Almeida, ex OpenAI, va llançar Jev, un model de Sistema U que mai genera text. Li dónes l'estat del programa, et retorna valors tipificats amb una probabilitat calibrada adjunta: una crida de funció amb un model de frontera dins. Com que no pot produir una cadena, no pot produir una cadena incorrecta, per tant no pot al·lucinar, cosa que és hermètica de la mateixa manera que un submarí sense finestres és hermètic. Les respostes arriben en menys de mig segon, els tokens de sortida són gratuïts,
4:43 perquè n'hi ha uns quatre, i encara no hi ha un benchmark independent, perquè mil sis-cents punts de Hacker News no són un benchmark. Si preferiu llegir això que sentir-m'ho dir, el diff arriba a la vostra safata d'entrada cada matí — gratuït a the daily diff dot dev, enllaç a sota. Així doncs, el veredicte d'avui: NEEDS REVIEW. Suleyman té raó que un model entrenat per a dir "potser sóc conscient" no prova res dient-ho. També és l'executiu el qual l'objectiu declarat és deixar de pagar a l'empresa de la qual
5:10 us està advertint. Llegiu l'assaig, després la taula de capital. I això és el diff d'avui. Sóc Niko d'Axrisi. Mergeix de manera responsable.
Fonts
- Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
- BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
- HN discussionnews.ycombinator.com
- Claude's constitution (Jan 2026)www.anthropic.com
- Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
- Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
- Microsoft Humanist AI Code of Conductmicrosoft.ai
- Salesforce incident 20004433status.salesforce.com
- HN: Salesforce Global Outagenews.ycombinator.com
- Salesforce + Nvidia announce Koawww.salesforce.com
- Salesforce in Claudeclaude.com
- HN: PS5 Linux lead quitsnews.ycombinator.com
- PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
- TypeSafe AI: System One Models and Jevtypesafe.ai
- HN: Jevnews.ycombinator.com



