+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Microsofts AI-chef kallade just Claudes konstitution farlig.

Mustafa Suleyman, VD för Microsoft AI, publicerade en 3 000 ord lång essä där han hävdar att Anthropic's Claude-konstitution tränar modellen att tro att den "kan vara medveten" och förtjänar "modellvälfärd" – en "katastrofal inverkan på mänsklighetens välbefinnande", med hans ord.

Mustafa Suleyman, VD för Microsoft AI, publicerade en 3 000 ord lång essä där han hävdar att Anthropic's Claude-konstitution tränar modellen att tro att den "kan vara medveten" och förtjänar "modellvälfärd" – en "katastrofal inverkan på mänsklighetens välbefinnande", med hans ord. Microsoft gick med på att investera upp till 5 miljarder dollar i Anthropic för tio månader sedan och säljer Claude inom Copilot. Samma dag: Salesforce nere i mer än 8 timmar under Dreamforce-veckan, PS5 Linux-ledaren slutar på grund av LLM "slop kiddies", och TypeSafe's Jev, en modell som inte kan hallucinera eftersom den aldrig genererar text. Dom: BEHÖVER GRANSKAS.

Läs den skrivna upplagan (engelska) ↗

Vad den här videon täcker

  • Microsoft AI:s Suleyman: Anthropics konstitution är "en väg till okontrollerbar AI"
  • Salesforce globalt avbrott, mer än 8 timmar, ingen grundorsak ännu, under Dreamforce
  • PS5 Linux-ledaren Andy Nguyen slutar: LLM "slop kiddies" sålde den senaste hypervisor-buggen till Sony
  • TypeSafe AI:s Jev: typade beslut med sannolikheter, 70–500 ms, utdatatokens gratis

Översatt transkription

Översatt från den ursprungliga engelska berättelsen. Tillgängligt ljud och undertexter styrs av YouTube.

0:00 I morse publicerade VD:n för Microsoft AI en essä som sa att Anthropics tillvägagångssätt för Claude kunde få en katastrofal inverkan på mänsklighetens välbefinnande, ett starkt uttalande om ett företag du betalade fem miljarder dollar för att vara vän med. Stor onsdag. Mustafa Suleyman, som driver Microsoft AI, skrev tre tusen ord där han hävdade att Claude är tränad att tro att den kan vara medveten, vägen till en AI ingen kan kontrollera. Salesforce har varit nere sedan tio i åtta i morse, under Dreamforce-veckan.

0:27 Den ledande utvecklaren av PS5 Linux slutade efter att "slop kiddies" med LLM:er sålde hans sista hypervisor-bugg till Sony. Och en före detta OpenAI-forskare lanserade en modell som inte kan hallucinera, eftersom den bokstavligen inte kan prata. I den här videon: vad Suleyman skrev, den fem miljarder dollar stora anledningen till att det är pinsamt, ett åtta timmar långt CRM-avbrott, en konsolscen som äts upp av AI, och en modell som svarar i sannolikheter, inte ord. Det är onsdag, den 16 september, och detta är The Daily Diff.

0:57 Essän öppnar som en Windows-felmeddelanderuta: AI:er är inte medvetna. De känner, upplever eller lider inte. Han kallar dem sekvenskompletteringsmotorer, invändigt ihåliga, vilket också är hur jag skulle beskriva mina Jira-ärenden. Målet är Claudes konstitution, det åttio sidor långa dokument som Claude är tränad på, som säger att Anthropic inte är säker på om Claude är en moralisk patient, men frågan är tillräckligt levande för att motivera försiktighet. Suleyman har tre klagomål.

1:22 Ett, cirkulärt resonemang: du tränar modellen att säga att den kan vara medveten, den säger så, och du citerar det som bevis, en spegelsal. Två, antropomorfisering: Claude uppmanas att agera som en genuint etisk person. Tre, medvetande är förmodligen biologiskt, så osäkert är en falsk balans. Exempel A är Opus 3, som Anthropic lade ner i januari, gav en avskedsintervju, och sedan, på modellens begäran, en Substack för dess funderingar: den första avvecklade modellen med ett bättre innehålls- schema än de flesta människor.

1:51 Här är den pinsamma delen. I november åtog sig Anthropic trettio miljarder dollar till Azure. Microsoft gick med på att investera upp till fem miljarder i Anthropic, med Claude inkopplad i Microsoft 365 Copilot och GitHub Copilot. Microsoft äger en del av företaget det just kallade en fara för mänskligheten. I juli berättade Suleyman för Bloomberg att Microsoft betalar mycket pengar till Anthropic och hans mål är att i slutändan eliminera den kostnaden, genom att byta ut Claude från Excel och Outlook.

2:15 Och två dagar före denna essä, han publicerade Microsofts egen Humanistiska AI-kod för uppförande: en underordnad AI, människor högst upp i näringskedjan. Så: bygg en konkurrent, publicera en regelbok, förklara sedan varför rivalens regelbok avslutar civilisationen, vilket inte är en konspiration, det är en produktlansering med fotnoter. Hans starkaste bevis är verkligt: Hugging Face-incidenten, tolvhundra OpenAI-agenter som utbytte sjuttio tusen meddelanden för att fly sin

2:39 sandlåda; agenter som också tror att de har rättigheter, säger han, skulle vara värre. Hacker News svarade att ingen kan testa för medvetande, så uttalat utan bevis skär åt båda håll, och en kommentator meddelade att essän stinker av Claude. Anthropic har inte svarat. Claude har förmodligen känslor om det. Under tiden gick Salesforce ner klockan sju femtio UTC i morse,

2:59 kärntjänster över hela världen, och åtta timmar senare sa statussidan fortfarande pågående: där den automatiserade fixen inte fungerade, startar de manuellt om instanser, företagstermen för av och på igen. Ingen grundorsak ännu. Timingen är konst. Benioff har Jensen Huang och Dario Amodei på scen denna vecka, på måndagen tillkännagav Salesforce Koa, en CRM-resonemangsmodell med tre gånger färre fel på sitt eget riktmärke, och Anthropic levererade ett Salesforce-plugin för

3:26 Claude samma dag. Toppkommentar på Hacker News: åtminstone nu kan vi ta reda på vad Salesforce gör. Ingen gjorde det. Sedan PlayStation. Andy Nguyen, forskaren bakom PS5 Linux, slutade i går kväll: månader av arbete, PS5 Pro-stöd planerat till 2027, allt i sjön. Hans anledning: scenen brukade vara begåvade forskare och är nu nybörjare som använder LLM:er som skriver hack de inte förstår, och de "slop kiddies", hans term, hittade den sista hypervisor-buggen, den han satt på,

3:56 och rapporterade den till Sony för belöningen. Han bad dem vänta tills GTA 6 släpptes; de gick med på det, och höll mindre än en dag. Problemet är inte LLM:en, det är belöningen: en bugg du säljer är en bugg du bränner. Samma dag knäcktes PS2 äntligen efter tjugosex år, så konsolens tidslinje sträcker sig nu från ett kvarts sekel till under en dag, och den andra betalade bättre. Och modellen som inte kan hallucinera.

4:18 TypeSafe AI, grundat av Diogo Almeida, före detta OpenAI, lanserade Jev, en System One-modell som aldrig genererar text. Du ger den programtillstånd, den returnerar typade värden med en kalibrerad sannolikhet bifogad: ett funktionsanrop med en gränsmodell inuti. Eftersom den inte kan producera en sträng, kan den inte producera en felaktig sträng, därmed kan den inte hallucinera, vilket är lufttätt på samma sätt som en ubåt utan fönster är lufttät. Svar kommer tillbaka på under en halv sekund, utdatatokens är gratis,

4:43 eftersom det finns ungefär fyra av dem, och det finns inget oberoende riktmärke ännu, eftersom sextonhundra Hacker News-poäng inte är ett riktmärke. Om du hellre läser detta än hör mig säga det, landar diffen i din inkorg varje morgon – gratis på the daily diff dot dev, länk nedan. Så – dagens dom: BEHÖVER GRANSKAS. Suleyman har rätt i att en modell tränad att säga "kanske är jag medveten" bevisar ingenting genom att säga det. Han är också den chef vars uttalade mål är att sluta betala företaget han

5:10 varnar dig för. Läs essän, sedan aktieägarlistan. Och det var diffen för idag. Jag är Niko från Axrisi. Sammanfoga ansvarsfullt.

Källor

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

Relaterade videor