+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Microsofts AI-hoofd noemt de grondwet van Claude gevaarlijk.

Mustafa Suleyman, CEO van Microsoft AI, publiceerde een essay van 3.000 woorden waarin hij betoogde dat de Claude-grondwet van Anthropic het model traint te denken dat het "bewust kan zijn" en "modelwelzijn" verdient — een "rampzalige impact op het welzijn van de mensheid", in zijn woorden.

Mustafa Suleyman, CEO van Microsoft AI, publiceerde een essay van 3.000 woorden waarin hij betoogde dat de Claude-grondwet van Anthropic het model traint te denken dat het "bewust kan zijn" en "modelwelzijn" verdient — een "rampzalige impact op het welzijn van de mensheid", in zijn woorden. Microsoft stemde tien maanden geleden in met een investering van maximaal $5 miljard in Anthropic en verkoopt Claude binnen Copilot. Dezelfde dag: Salesforce meer dan 8 uur offline in de Dreamforce-week, de PS5 Linux-leider stopt vanwege LLM "slop kiddies", en TypeSafe's Jev, een model dat niet kan hallucineren omdat het nooit tekst genereert. Oordeel: NEEDS REVIEW.

Lees de geschreven editie (Engels) ↗

Wat deze video behandelt

  • Microsoft AI's Suleyman: Anthropic's grondwet is "een weg naar oncontroleerbare AI"
  • Wereldwijde storing Salesforce, meer dan 8 uur, nog geen hoofdoorzaak, tijdens Dreamforce
  • PS5 Linux-leider Andy Nguyen stopt: LLM "slop kiddies" verkochten de laatste hypervisor-bug aan Sony
  • TypeSafe AI's Jev: getypte beslissingen met waarschijnlijkheden, 70–500 ms, output tokens gratis

Vertaald transcript

Vertaald vanuit de originele Engelse gesproken tekst. Beschikbare audio en ondertiteling worden beheerd door YouTube.

0:00 Vanmorgen publiceerde de CEO van Microsoft AI een essay waarin hij zei dat Anthropic's benadering van Claude een rampzalige impact zou kunnen hebben op het welzijn van de mensheid, een sterke uitspraak over een bedrijf waar je vijf miljard dollar voor hebt betaald om vrienden mee te zijn. Grote woensdag. Mustafa Suleyman, die Microsoft AI leidt, schreef drieduizend woorden waarin hij betoogde dat Claude getraind is te denken dat het bewust kan zijn, de weg naar een AI die niemand kan beheersen. Salesforce is sinds tien voor acht vanmorgen offline, in de Dreamforce-week.

0:27 De hoofdontwikkelaar van PS5 Linux stopte nadat "slop kiddies" met LLM's zijn laatste hypervisor-bug aan Sony verkochten. En een voormalig OpenAI-onderzoeker lanceerde een model dat niet kan hallucineren, omdat het letterlijk niet kan praten. In deze video: wat Suleyman schreef, de vijf miljard dollar reden dat het ongemakkelijk is, een acht uur durende CRM-storing, een consolescène verslonden door AI, en een model dat antwoordt in waarschijnlijkheden, niet in woorden. Het is woensdag 16 september, en dit is The Daily Diff.

0:57 Het essay begint als een Windows-foutdialoog: AI's zijn niet bewust. Ze voelen, ervaren of lijden niet. Hij noemt ze 'sequence completion engines', intern hol, wat ook is hoe ik mijn Jira-tickets zou beschrijven. Het doel is Claude's grondwet, het tachtig pagina's tellende document waarop Claude getraind is, dat zegt dat Anthropic er niet zeker van is of Claude een morele patiënt is, maar de vraag is levendig genoeg om voorzichtigheid te rechtvaardigen. Suleyman heeft drie klachten.

1:22 Eén, cirkelredenering: je traint het model om te zeggen dat het bewust kan zijn, het zegt het, en je citeert dat als bewijs, een spiegelpaleis. Twee, antropomorfisme: Claude wordt verteld zich als een oprecht ethisch persoon te gedragen. Drie, bewustzijn is waarschijnlijk biologisch, dus onzeker is een valse balans. Tentoonstelling A is Opus 3, dat Anthropic in januari uit de roulatie nam, gaf een pensioeninterview, en daarna, op verzoek van het model, een Substack voor zijn overpeinzingen: het eerste afgeschreven model met een beter inhouds- schema dan de meeste mensen.

1:51 Hier is het ongemakkelijke deel. In november zegde Anthropic dertig miljard dollar toe aan Azure. Microsoft stemde ermee in om tot vijf miljard in Anthropic te investeren, met Claude gekoppeld aan Microsoft 365 Copilot en GitHub Copilot. Microsoft bezit een deel van het bedrijf dat het zojuist een gevaar voor de mensheid noemde. In juli vertelde Suleyman aan Bloomberg dat Microsoft veel geld betaalt aan Anthropic en zijn doel is om die kosten uiteindelijk te elimineren, door Claude uit Excel en Outlook te wisselen.

2:15 En twee dagen voor dit essay, publiceerde hij Microsofts eigen Humanist AI-gedragscode: een ondergeschikte AI, mensen bovenaan de voedselketen. Dus: bouw een concurrent, publiceer een regelboek, en leg dan uit waarom het regelboek van de rivaal de beschaving beëindigt, wat geen samenzwering is, het is een productlancering met voetnoten. Zijn sterkste bewijs is reëel: het Hugging Face-incident, twaalfhonderd OpenAI-agenten wisselden zeventigduizend berichten uit om hun

2:39 sandbox te ontvluchten; agenten die ook geloven dat ze rechten hebben, zegt hij, zou erger zijn. Hacker News antwoordde dat niemand kan testen op bewustzijn, dus zonder bewijs gesteld werkt twee kanten op, en een commentator kondigde aan dat het essay naar Claude stinkt. Anthropic heeft niet gereageerd. Claude heeft daar vermoedelijk gevoelens over. Ondertussen viel Salesforce vanmorgen om zeven uur vijftig UTC uit,

2:59 kernservices wereldwijd, en acht uur later stond op de statuspagina nog steeds bezig: waar de geautomatiseerde oplossing niet werkte, herstarten ze handmatig instances, de zakelijke term voor aan en weer uit. Nog geen hoofdoorzaak. De timing is kunst. Benioff heeft Jensen Huang en Dario Amodei deze week op het podium, op maandag kondigde Salesforce Koa aan, een CRM-redeneermodel met driemaal minder fouten op zijn eigen benchmark, en Anthropic leverde dezelfde dag een Salesforce-plug-in voor

3:26 Claude. Top Hacker News-commentaar: nu kunnen we tenminste uitzoeken wat Salesforce doet. Niemand deed het. Toen de PlayStation. Andy Nguyen, de onderzoeker achter PS5 Linux, stopte gisteravond: maanden werk, PS5 Pro-ondersteuning gepland voor 2027, alles in het water gevallen. Zijn reden: de scene bestond vroeger uit getalenteerde onderzoekers en nu uit noobs die LLM's gebruiken om hacks te schrijven die ze niet begrijpen, en die "slop kiddies", zijn term, vonden de laatste hypervisor-bug, degene waar hij op zat,

3:56 en rapporteerden deze aan Sony voor de bounty. Hij vroeg hen te wachten tot GTA 6 was verscheept; ze stemden toe, en hielden het minder dan een dag vol. Het probleem is niet de LLM, het is de bounty: een bug die je verkoopt, is een bug die je verbrandt. Dezelfde dag werd de PS2 eindelijk gekraakt na zesentwintig jaar, dus de consoletijdlijn loopt nu van een kwart eeuw tot minder dan een dag, en de tweede betaalde beter. En het model dat niet kan hallucineren.

4:18 TypeSafe AI, opgericht door Diogo Almeida, ex-OpenAI, lanceerde Jev, een Systeem Eén-model dat nooit tekst genereert. Je geeft het de programmastatus, het retourneert getypeerde waarden met een gekalibreerde waarschijnlijkheid eraan gekoppeld: een functieaanroep met een frontier-model erin. Omdat het geen string kan produceren, kan het geen verkeerde string produceren, daarom kan het niet hallucineren, wat luchtdicht is op de manier waarop een onderzeeër zonder ramen luchtdicht is. Antwoorden komen binnen in minder dan een halve seconde, output tokens zijn gratis,

4:43 want het zijn er ongeveer vier, en er is nog geen onafhankelijke benchmark, want zestienhonderd Hacker News-punten zijn geen benchmark. Als je dit liever leest dan van mij hoort, de diff landt elke ochtend in je inbox — gratis op thedailydiff.dev, link hieronder. Dus — het oordeel van vandaag: NEEDS REVIEW. Suleyman heeft gelijk dat een model dat getraind is om te zeggen 'misschien ben ik bewust' niets bewijst door het te zeggen. Hij is ook de leidinggevende wiens verklaarde doel is om te stoppen met het betalen van het bedrijf waarvoor hij

5:10 je waarschuwt. Lees het essay, dan de 'cap table'. En dat is de 'diff' voor vandaag. Ik ben Niko van Axrisi. Verantwoord samenvoegen.

Bronnen

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

Gerelateerde video's