Il capo dell'AI di Microsoft ha definito "pericolosa" la costituzione di Claude.
Mustafa Suleyman, CEO di Microsoft AI, ha pubblicato un saggio di 3.000 parole sostenendo che la costituzione di Claude di Anthropic addestra il modello a pensare che "potrebbe essere cosciente" e meritevole di "benessere del modello" — un "impatto disastroso sul benessere dell'umanità", nelle sue parole.
Mustafa Suleyman, CEO di Microsoft AI, ha pubblicato un saggio di 3.000 parole sostenendo che la costituzione di Claude di Anthropic addestra il modello a pensare che "potrebbe essere cosciente" e meritevole di "benessere del modello" — un "impatto disastroso sul benessere dell'umanità", nelle sue parole. Microsoft ha accettato di investire fino a 5 miliardi di dollari in Anthropic dieci mesi fa e vende Claude all'interno di Copilot. Lo stesso giorno: Salesforce fuori servizio per oltre 8 ore nella settimana di Dreamforce, il responsabile di PS5 Linux si licenzia per i "slop kiddies" delle LLM, e Jev di TypeSafe, un modello che non può allucinare perché non genera mai testo. Verdetto: NEEDS REVIEW.
Leggi l'edizione scritta (inglese) ↗
Contenuto di questo video
- Suleyman di Microsoft AI: la costituzione di Anthropic è "una strada verso un'IA incontrollabile"
- Interruzione globale di Salesforce, oltre 8 ore, nessuna causa principale ancora, durante Dreamforce
- Il responsabile di PS5 Linux Andy Nguyen si licenzia: "slop kiddies" delle LLM hanno venduto l'ultimo bug dell'hypervisor a Sony
- Jev di TypeSafe AI: decisioni tipizzate con probabilità, 70–500 ms, token di output gratuiti
Trascrizione tradotta
Tradotto dalla narrazione originale inglese. L'audio e i sottotitoli disponibili sono controllati da YouTube.
0:00 Stamattina il CEO di Microsoft AI ha pubblicato un saggio dicendo che l'approccio di Anthropic a Claude potrebbe avere un impatto disastroso sul benessere dell'umanità, una cosa forte da dire su un'azienda a cui hai pagato cinque miliardi di dollari per essere amico. Un grande mercoledì. Mustafa Suleyman, che gestisce Microsoft AI, ha scritto tremila parole sostenendo che Claude è addestrato a pensare di poter essere cosciente, la strada per un'IA che nessuno può controllare. Salesforce è fuori servizio dalle sette e cinquanta di stamattina, nella settimana di Dreamforce.
0:27 Il capo sviluppatore di PS5 Linux si è licenziato dopo che dei "slop kiddies" con LLM hanno venduto il suo ultimo bug dell'hypervisor a Sony. E un ex ricercatore di OpenAI ha lanciato un modello che non può allucinare, perché letteralmente non può parlare. In questo video: cosa ha scritto Suleyman, il motivo da cinque miliardi di dollari per cui è imbarazzante, un'interruzione di otto ore del CRM, una scena console divorata dall'IA, e un modello che risponde in probabilità, non in parole. È mercoledì 16 settembre, e questo è The Daily Diff.
0:57 Il saggio si apre come una finestra di errore di Windows: le IA non sono coscienti. Non provano, non sperimentano, né soffrono. Le definisce motori di completamento di sequenze, internamente vuoti, che è anche come descriverei i miei ticket Jira. L'obiettivo è la costituzione di Claude, il documento di ottanta pagine su cui Claude è addestrato, che dice che Anthropic non è sicura se Claude sia un paziente morale, ma la questione è abbastanza viva da giustificare cautela. Suleyman ha tre lamentele.
1:22 Uno, ragionamento circolare: addestri il modello a dire che potrebbe essere cosciente, lo dice, e tu lo citi come prova, una sala degli specchi. Due, antropomorfizzazione: a Claude viene detto di agire come una persona veramente etica. Tre, la coscienza è probabilmente biologica, quindi incerto è un falso equilibrio. L'Exhibit A è Opus 3, che Anthropic ha ritirato a gennaio, ha rilasciato un'intervista di pensionamento, e poi, su richiesta del modello, un Substack per le sue riflessioni: il primo modello deprecato con un programma di contenuti migliore della maggior parte degli esseri umani.
1:51 Ecco la parte imbarazzante. A novembre Anthropic si è impegnata per trenta miliardi di dollari su Azure. Microsoft ha accettato di investire fino a cinque miliardi in Anthropic, con Claude collegato a Microsoft 365 Copilot e GitHub Copilot. Microsoft possiede una fetta dell'azienda che ha appena definito un pericolo per l'umanità. A luglio, Suleyman ha detto a Bloomberg che Microsoft paga molti soldi ad Anthropic e il suo obiettivo è eliminare quel costo, sostituendo Claude da Excel e Outlook.
2:15 E due giorni prima di questo saggio, ha pubblicato il Codice di condotta umanista dell'IA di Microsoft: un'IA subordinata, gli umani in cima alla catena alimentare. Quindi: costruire un concorrente, pubblicare un regolamento, poi spiegare perché il regolamento del rivale pone fine alla civiltà, che non è una cospirazione, è un lancio di prodotto con note a piè di pagina. La sua prova più forte è reale: l'incidente di Hugging Face, mille duecento agenti di OpenAI che si scambiavano settantamila messaggi per sfuggire al loro
2:39 sandbox; agenti che credono anche di avere diritti, dice, sarebbero peggio. Hacker News ha risposto che nessuno può testare la coscienza, quindi affermare senza prove è un'arma a doppio taglio, e un commentatore ha annunciato che il saggio puzza di Claude. Anthropic non ha risposto. Claude, presumibilmente, ha dei sentimenti al riguardo. Nel frattempo Salesforce è andato in down alle sette e cinquanta UTC stamattina,
2:59 servizi principali in tutto il mondo, e otto ore dopo la pagina di stato diceva ancora in corso: dove la correzione automatica non è riuscita, stanno riavviando manualmente le istanze, il termine aziendale per spegnere e riaccendere. Nessuna causa principale ancora. La tempistica è arte. Benioff ha Jensen Huang e Dario Amodei sul palco questa settimana, lunedì Salesforce ha annunciato Koa, un modello di ragionamento CRM con tre volte meno errori sul suo benchmark, e Anthropic ha rilasciato un plugin Salesforce per
3:26 Claude lo stesso giorno. Miglior commento di Hacker News: almeno ora possiamo capire cosa fa Salesforce. Nessuno l'ha fatto. Poi la PlayStation. Andy Nguyen, il ricercatore dietro PS5 Linux, si è licenziato ieri sera: mesi di lavoro, supporto PS5 Pro previsto per il 2027, tutto buttato via. Il suo motivo: la scena era fatta di ricercatori di talento e ora è fatta di novellini che usano LLM che scrivono hack che non capiscono, e quei "slop kiddies", il suo termine, hanno trovato l'ultimo bug dell'hypervisor, quello su cui stava lavorando,
3:56 e lo hanno segnalato a Sony per la taglia. Ha chiesto loro di aspettare che GTA 6 fosse rilasciato; hanno accettato, e sono durati meno di un giorno. Il problema non è l'LLM, è la taglia: un bug che vendi è un bug che bruci. Lo stesso giorno, la PS2 è stata finalmente sbloccata dopo ventisei anni, quindi la linea temporale delle console ora va da un quarto di secolo a meno di un giorno, e la seconda ha pagato meglio. E il modello che non può allucinare.
4:18 TypeSafe AI, fondata da Diogo Almeida, ex OpenAI, ha lanciato Jev, un modello System One che non genera mai testo. Gli dai lo stato del programma, restituisce valori tipizzati con una probabilità calibrata allegata: una chiamata di funzione con un modello di frontiera all'interno. Poiché non può produrre una stringa, non può produrre una stringa sbagliata, quindi non può allucinare, il che è a tenuta stagna come un sottomarino senza finestre è a tenuta stagna. Le risposte arrivano in meno di mezzo secondo, i token di output sono gratuiti,
4:43 perché ce ne sono circa quattro, e non c'è ancora un benchmark indipendente, perché milleseicento punti di Hacker News non sono un benchmark. Se preferisci leggere questo piuttosto che sentirmi dire, il diff arriva nella tua casella di posta ogni mattina — gratuitamente su the daily diff dot dev, link qui sotto. Quindi — il verdetto di oggi: NEEDS REVIEW. Suleyman ha ragione che un modello addestrato a dire forse sono cosciente non prova nulla dicendolo. È anche l'esecutivo il cui obiettivo dichiarato è smettere di pagare l'azienda di cui ti sta
5:10 avvertendo. Leggi il saggio, poi la tabella dei capitali. E questo è il diff per oggi. Sono Niko di Axrisi. Merge responsabilmente.
Fonti
- Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
- BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
- HN discussionnews.ycombinator.com
- Claude's constitution (Jan 2026)www.anthropic.com
- Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
- Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
- Microsoft Humanist AI Code of Conductmicrosoft.ai
- Salesforce incident 20004433status.salesforce.com
- HN: Salesforce Global Outagenews.ycombinator.com
- Salesforce + Nvidia announce Koawww.salesforce.com
- Salesforce in Claudeclaude.com
- HN: PS5 Linux lead quitsnews.ycombinator.com
- PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
- TypeSafe AI: System One Models and Jevtypesafe.ai
- HN: Jevnews.ycombinator.com



