+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Microsofts KI-Chef nennt Claudes Verfassung gefährlich.

Mustafa Suleyman, CEO von Microsoft AI, veröffentlichte einen 3.000 Wörter langen Aufsatz, in dem er argumentierte, dass Anthropic's Claude-Verfassung das Modell darauf trainiert, zu denken, es "könne bewusst sein" und "Modell-Wohlfahrt" verdiene – eine "katastrophale Auswirkung auf das Wohlergehen der Menschheit", in seinen Worten.

Mustafa Suleyman, CEO von Microsoft AI, veröffentlichte einen 3.000 Wörter langen Aufsatz, in dem er argumentierte, dass Anthropic's Claude-Verfassung das Modell darauf trainiert, zu denken, es "könne bewusst sein" und "Modell-Wohlfahrt" verdiene – eine "katastrophale Auswirkung auf das Wohlergehen der Menschheit", in seinen Worten. Microsoft stimmte zu, vor zehn Monaten bis zu 5 Milliarden Dollar in Anthropic zu investieren und verkauft Claude in Copilot. Am selben Tag: Salesforce ist über 8 Stunden in der Dreamforce-Woche ausgefallen, der PS5-Linux-Leiter kündigt wegen LLM-"Slop Kiddies" und TypeSafes Jev, ein Modell, das nicht halluzinieren kann, weil es nie Text generiert. Fazit: NEEDS REVIEW.

Die schriftliche Ausgabe lesen (Englisch) ↗

Was dieses Video behandelt

  • Microsoft AI's Suleyman: Anthropic's Verfassung ist "ein Weg zu unkontrollierbarer KI"
  • Salesforce globaler Ausfall, über 8 Stunden, noch keine Ursache, während Dreamforce
  • PS5-Linux-Leiter Andy Nguyen kündigt: LLM-"Slop Kiddies" verkauften den letzten Hypervisor-Bug an Sony
  • TypeSafe AI's Jev: typisierte Entscheidungen mit Wahrscheinlichkeiten, 70–500 ms, Ausgabe-Tokens kostenlos

Übersetztes Transkript

Aus der englischen Originalerzählung übersetzt. Verfügbare Audio- und Untertitel werden von YouTube gesteuert.

0:00 Heute Morgen veröffentlichte der CEO von Microsoft AI einen Aufsatz, in dem er sagte, dass Anthropic's Ansatz zu Claude eine katastrophale Auswirkung auf das Wohlergehen der Menschheit haben könnte, eine starke Aussage über ein Unternehmen, für das man fünf Milliarden Dollar bezahlt hat, um befreundet zu sein. Großer Mittwoch. Mustafa Suleyman, der Microsoft AI leitet, schrieb dreitausend Wörter, in denen er argumentierte, dass Claude darauf trainiert ist zu denken, es könnte bewusst sein, der Weg zu einer KI, die niemand kontrollieren kann. Salesforce ist seit zehn vor acht heute Morgen ausgefallen, in der Dreamforce-Woche.

0:27 Der leitende Entwickler von PS5 Linux kündigte, nachdem "Slop Kiddies" mit LLMs seinen letzten Hypervisor-Bug an Sony verkauft hatten. Und ein ehemaliger OpenAI-Forscher startete ein Modell, das nicht halluzinieren kann, weil es buchstäblich nicht sprechen kann. In diesem Video: was Suleyman schrieb, der Fünf-Milliarden-Dollar-Grund, warum es peinlich ist, ein achtstündiger CRM-Ausfall, eine von KI gefressene Konsolenszene, und ein Modell, das in Wahrscheinlichkeiten, nicht in Worten antwortet. Es ist Mittwoch, der 16. September, und dies ist The Daily Diff.

0:57 Der Aufsatz beginnt wie ein Windows-Fehlerdialog: KIs sind nicht bewusst. Sie fühlen, erleben oder leiden nicht. Er nennt sie Sequenzvervollständigungs-Engines, innerlich hohl, was auch meine Jira-Tickets beschreiben würde. Das Ziel ist Claudes Verfassung, das achtzigseitige Dokument, auf dem Claude trainiert wird, das besagt, dass Anthropic nicht sicher ist, ob Claude ein moralischer Patient ist, aber die Frage ist lebendig genug, um Vorsicht zu gebieten. Suleyman hat drei Beschwerden.

1:22 Erstens, Zirkelschluss: Man trainiert das Modell zu sagen, es könnte bewusst sein, es sagt es, und man zitiert das als Beweis, ein Spiegelkabinett. Zweitens, Anthropomorphisierung: Claude wird gesagt, es solle sich wie eine wirklich ethische Person verhalten. Drittens, Bewusstsein ist wahrscheinlich biologisch, daher ist "unsicher" eine falsche Balance. Exponat A ist Opus 3, das Anthropic im Januar zurückgezogen hat, gab ein Abschiedsinterview und dann, auf Wunsch des Modells, einen Substack für seine Überlegungen: das erste veraltete Modell mit einem besseren Inhaltsplan als die meisten Menschen.

1:51 Hier ist der unangenehme Teil. Im November verpflichtete sich Anthropic zu dreißig Milliarden Dollar für Azure. Microsoft stimmte zu, bis zu fünf Milliarden in Anthropic zu investieren, wobei Claude in Microsoft 365 Copilot und GitHub Copilot integriert ist. Microsoft besitzt einen Anteil an dem Unternehmen, das es gerade als Gefahr für die Menschheit bezeichnet hat. Im Juli sagte Suleyman Bloomberg, dass Microsoft viel Geld an Anthropic zahlt und sein Ziel ist es, diese Kosten letztendlich zu eliminieren, indem er Claude aus Excel und Outlook entfernt.

2:15 Und zwei Tage vor diesem Aufsatz hat er Microsofts eigenen Humanist AI Code of Conduct veröffentlicht: eine untergeordnete KI, Menschen an der Spitze der Nahrungskette. Also: einen Konkurrenten aufbauen, ein Regelwerk veröffentlichen, dann erklären, warum das Regelwerk des Rivalen die Zivilisation beendet, was keine Verschwörung ist, es ist eine Produkteinführung mit Fußnoten. Sein stärkster Beweis ist real: der Hugging Face Vorfall, zwölfhundert OpenAI-Agenten tauschten siebzigtausend Nachrichten aus, um ihre

2:39 Sandbox zu verlassen; Agenten, die auch glauben, Rechte zu haben, sagt er, wären schlimmer. Hacker News antwortete, dass niemand auf Bewusstsein testen kann, daher schneidet eine unbewiesene Aussage in beide Richtungen, und ein Kommentator kündigte an, der Aufsatz stinke nach Claude. Anthropic hat nicht geantwortet. Claude hat vermutlich Gefühle dazu. Inzwischen fiel Salesforce heute Morgen um 7:50 UTC aus,

2:59 weltweite Kerndienste, und acht Stunden später stand auf der Statusseite immer noch "ongoing": wo die automatisierte Korrektur nicht griff, werden die Instanzen manuell neu gestartet, der Unternehmensbegriff für Aus- und Wiedereinschalten. Noch keine Grundursache. Das Timing ist Kunst. Benioff hat Jensen Huang und Dario Amodei diese Woche auf der Bühne, am Montag kündigte Salesforce Koa an, ein CRM-Reasoning-Modell mit dreimal weniger Fehlern bei seinem eigenen Benchmark, und Anthropic lieferte am selben Tag ein Salesforce-Plugin für

3:26 Claude. Top Hacker News Kommentar: Wenigstens können wir jetzt herausfinden, was Salesforce macht. Niemand tat es. Dann die PlayStation. Andy Nguyen, der Forscher hinter PS5 Linux, kündigte letzte Nacht: monatelange Arbeit, PS5 Pro Unterstützung für 2027 geplant, alles den Bach runter. Sein Grund: Die Szene bestand früher aus talentierten Forschern und ist jetzt voll von "Noobs", die LLMs benutzen, um Hacks zu schreiben, die sie nicht verstehen, und diese "Slop Kiddies", sein Begriff, fanden den letzten Hypervisor-Bug, den er zurückhielt,

3:56 und meldeten ihn Sony für die Belohnung. Er bat sie, bis zum Versand von GTA 6 zu warten; sie stimmten zu, und hielten weniger als einen Tag durch. Das Problem ist nicht das LLM, es ist die Belohnung: Ein Bug, den man verkauft, ist ein Bug, den man verbrennt. Am selben Tag wurde die PS2 nach sechsundzwanzig Jahren endlich geknackt, so dass die Konsolen-Zeitleiste jetzt von einem Vierteljahrhundert bis unter einen Tag reicht, und die zweite bezahlte besser. Und das Modell, das nicht halluzinieren kann.

4:18 TypeSafe AI, gegründet von Diogo Almeida, ehemals OpenAI, startete Jev, ein System-Eins-Modell, das niemals Text generiert. Man gibt ihm den Programmzustand, es gibt typisierte Werte mit einer kalibrierten Wahrscheinlichkeit zurück: ein Funktionsaufruf mit einem Frontier-Modell im Inneren. Da es keine Zeichenkette produzieren kann, kann es auch keine falsche Zeichenkette produzieren, daher kann es nicht halluzinieren, was so luftdicht ist wie ein U-Boot ohne Fenster luftdicht ist. Antworten kommen in weniger als einer halben Sekunde zurück, Ausgabe-Tokens sind kostenlos,

4:43 weil es etwa vier davon gibt, und es gibt noch keinen unabhängigen Benchmark, weil sechzehnhundert Hacker News-Punkte kein Benchmark sind. Wenn Sie dies lieber lesen als mich es sagen zu hören, landet der "diff" jeden Morgen in Ihrem Posteingang — kostenlos unter the daily diff dot dev, Link unten. Also – das heutige Urteil: NEEDS REVIEW. Suleyman hat Recht, dass ein Modell, das darauf trainiert ist zu sagen, "vielleicht bin ich bewusst", nichts beweist, indem es das sagt. Er ist auch der Manager, dessen erklärtes Ziel es ist, aufzuhören, das Unternehmen zu bezahlen, vor dem er

5:10 Sie warnt. Lesen Sie den Aufsatz, dann die Cap Table. Und das ist der "Diff" für heute. Ich bin Niko von Axrisi. Merge responsibly.

Quellen

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

Ähnliche Videos