+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Microsoftin tekoälypäällikkö kutsui Clauden perustuslakia vaaralliseksi.

Mustafa Suleyman, Microsoft AI:n toimitusjohtaja, julkaisi 3 000 sanan esseen, jossa hän väitti, että Anthropicin Clauden perustuslaki opettaa mallin ajattelemaan, että se "saattaa olla tietoinen" ja ansaitsee "mallin hyvinvoinnin" – mikä on hänen sanojensa mukaan "katastrofaalinen vaikutus ihmiskunnan hyvinvointiin".

Mustafa Suleyman, Microsoft AI:n toimitusjohtaja, julkaisi 3 000 sanan esseen, jossa hän väitti, että Anthropicin Clauden perustuslaki opettaa mallin ajattelemaan, että se "saattaa olla tietoinen" ja ansaitsee "mallin hyvinvoinnin" – mikä on hänen sanojensa mukaan "katastrofaalinen vaikutus ihmiskunnan hyvinvointiin". Microsoft suostui investoimaan jopa 5 miljardia dollaria Anthropicciin kymmenen kuukautta sitten ja myy Claudea Copilotin sisällä. Samana päivänä: Salesforce kaatui yli 8 tunniksi Dreamforce-viikolla, PS5 Linux -johtaja irtisanoutuu LLM "slop kiddies" -aiheesta ja TypeSafen Jev, malli, joka ei voi hallusinoida, koska se ei koskaan luo tekstiä. Tuomio: NEEDS REVIEW.

Lue kirjoitettu versio (englanniksi) ↗

Mitä tämä video käsittelee

  • Microsoft AI:n Suleyman: Anthropicin perustuslaki on "tie hallitsemattomaan tekoälyyn"
  • Salesforcen maailmanlaajuinen katkos, yli 8 tuntia, ei juurisyytä vielä, Dreamforcen aikana
  • PS5 Linux -johtaja Andy Nguyen irtisanoutuu: LLM "slop kiddies" myivät viimeisen hypervisor-bugin Sonylle
  • TypeSafe AI:n Jev: tyypillisiä päätöksiä todennäköisyyksillä, 70–500 ms, lähtötunnukset ilmaiseksi

Käännetty transkriptio

Käännetty alkuperäisestä englanninkielisestä selostuksesta. Käytettävissä olevan äänen ja tekstitysten hallinta tapahtuu YouTuben kautta.

0:00 Tänä aamuna Microsoft AI:n toimitusjohtaja julkaisi esseen, jossa hän sanoi, että Anthropicin lähestymistavalla Claudeen voisi olla katastrofaalinen vaikutus ihmiskunnan hyvinvointiin, vahva sanottava yrityksestä, jolle maksoit viisi miljardia dollaria ystävystyäksesi. Suuri keskiviikko. Mustafa Suleyman, joka johtaa Microsoft AI:ta, kirjoitti kolmetuhatta sanaa väittäen, että Claude on koulutettu ajattelemaan, että se saattaa olla tietoinen, tie tekoälyyn, jota kukaan ei voi hallita. Salesforce on ollut alhaalla tänä aamuna kymmentä vaille kahdeksasta lähtien, Dreamforce-viikolla.

0:27 PS5 Linuxin johtava kehittäjä irtisanoutui sen jälkeen, kun LLM:ien kanssa leikkivät "slop kiddies" myivät hänen viimeisen hypervisor-buginsa Sonylle. Ja entinen OpenAI-tutkija julkaisi mallin, joka ei voi hallusinoida, koska se ei kirjaimellisesti voi puhua. Tässä videossa: mitä Suleyman kirjoitti, viiden miljardin dollarin syy siihen, miksi se on kiusallista, kahdeksan tunnin CRM-katkos, tekoälyn syömä konsolikenttä, ja malli, joka vastaa todennäköisyyksin, ei sanoin. On keskiviikko, syyskuun 16. päivä, ja tämä on The Daily Diff.

0:57 Essee alkaa kuin Windowsin virheilmoitus: Tekoälyt eivät ole tietoisia. Ne eivät tunne, koe tai kärsi. Hän kutsuu niitä sekvenssin täyttömoottoreiksi, sisäisesti ontoksi, mikä on myös se, miten kuvailisin omia Jira-tikettejäni. Kohde on Clauden perustuslaki, kahdeksankymmensivuinen asiakirja, jolla Claudea koulutetaan, jossa sanotaan, että Anthropic ei ole varma, onko Claude moraalinen potilas, mutta kysymys on riittävän ajankohtainen varovaisuuden takaamiseksi. Suleymanilla on kolme valitusta.

1:22 Yksi, kehäpäättely: koulutat mallin sanomaan, että se saattaa olla tietoinen, se sanoo niin, ja mainitset sen todisteena, peilien sali. Kaksi, antropomorfismi: Claudea kehotetaan toimimaan kuin aidosti eettinen henkilö. Kolme, tietoisuus on luultavasti biologista, joten epävarmuus on väärä tasapaino. Näyttelyesine A on Opus 3, jonka Anthropic poisti käytöstä tammikuussa, antoi eläköitymishaastattelun ja sitten mallin pyynnöstä Substackin sen pohdiskeluille: ensimmäinen vanhentunut malli, jolla on parempi sisältö aikataulu kuin useimmilla ihmisillä.

1:51 Tässä on kiusallinen osa. Marraskuussa Anthropic sitoutui kolmekymmentä miljardia dollaria Azureen. Microsoft suostui investoimaan jopa viisi miljardia Anthropicciin, Clauden kanssa kytkettynä Microsoft 365 Copilotiin ja GitHub Copilotiin. Microsoft omistaa osan yrityksestä, jota se juuri kutsui uhaksi ihmiskunnalle. Heinäkuussa Suleyman kertoi Bloombergille, että Microsoft maksaa paljon rahaa Anthropicille ja hänen tavoitteensa on lopulta poistaa tuo kustannus vaihtamalla Claude pois Excelistä ja Outlookista.

2:15 Ja kaksi päivää ennen tätä esseetä hän julkaisi Microsoftin oman Humanistisen tekoälyn säännöstön käyttäytymisohjeiston: alisteinen tekoäly, ihmiset ravintoketjun huipulla. Joten: rakenna kilpailija, julkaise sääntökirja ja selitä sitten, miksi kilpailijan sääntökirja lopettaa sivilisaation, mikä ei ole salaliitto, se on tuotelanseeraus alaviitteillä. Hänen vahvin todisteensa on todellinen: Hugging Face -tapaus, kaksitoista sataa OpenAI-agenttia vaihtoi seitsemänkymmentä tuhatta viestiä paetakseen

2:39 hiekkalaatikostaan; agentit, jotka myös uskovat, että heillä on oikeudet, hän sanoo, olisivat pahempia. Hacker News vastasi, että kukaan ei voi testata tietoisuutta, joten todistamatta sanottu toimii molempiin suuntiin, ja yksi kommentoija ilmoitti esseen haisevan Claudelta. Anthropic ei ole vastannut. Claudella on luultavasti tunteita siitä. Samaan aikaan Salesforce kaatui tänä aamuna kello seitsemän viisikymmentä UTC,

2:59 ydinpalvelut maailmanlaajuisesti, ja kahdeksan tunnin kuluttua tilasivu sanoi edelleen käynnissä: missä automaattinen korjaus ei toiminut, he käynnistävät manuaalisesti uudelleen esiintymiä, yritystermi päälle ja pois päältä taas. Ei juurisyytä vielä. Ajankohta on taidetta. Benioffilla on Jensen Huang ja Dario Amodei lavalla tällä viikolla, maanantaina Salesforce ilmoitti Koasta, CRM-päätöksentekomallista, jossa on kolme kertaa vähemmän virheitä sen omalla vertailuarvolla, ja Anthropic toimitti Salesforce-lisäosan

3:26 Claudelle samana päivänä. Suosituin Hacker News -kommentti: ainakin nyt voimme selvittää, mitä Salesforce tekee. Kukaan ei tehnyt. Sitten PlayStation. Andy Nguyen, PS5 Linuxin tutkija, lopetti viime yönä: kuukausien työ, PS5 Pro -tuki suunniteltu vuodelle 2027, kaikki hukkaan. Hänen syynsä: kenttä oli ennen täynnä lahjakkaita tutkijoita ja nyt se on täynnä aloittelijoita, jotka käyttävät LLM:iä kirjoittaessaan hackeja, joita he eivät ymmärrä, ja nuo "slop kiddies", hänen terminsä, löysivät viimeisen hypervisor-bugin, sen, jota hän istui,

3:56 ja raportoivat sen Sonylle palkkiosta. Hän pyysi heitä odottamaan GTA 6:n julkaisuun asti; he suostuivat, ja kestivät alle päivän. Ongelma ei ole LLM, vaan palkkio: myymäsi bugi on bugi, jonka poltat. Samana päivänä PS2 murrettiin lopulta kahdenkymmenenkuuden vuoden jälkeen, joten konsoliaikajana ulottuu nyt neljännesvuosisadasta alle päivään, ja toinen maksoi paremmin. Ja malli, joka ei voi hallusinoida.

4:18 TypeSafe AI, jonka perusti Diogo Almeida, entinen OpenAI, lanseerasi Jevin, System One -mallin, joka ei koskaan luo tekstiä. Annat sille ohjelman tilan, se palauttaa tyypillisiä arvoja kalibroidulla todennäköisyydellä liitettynä: funktion kutsu rajapintamallin sisällä. Koska se ei voi tuottaa merkkijonoa, se ei voi tuottaa väärää merkkijonoa, siksi se ei voi hallusinoida, mikä on ilmatiivis samalla tavalla kuin sukellusvene ilman ikkunoita on ilmatiivis. Vastaukset tulevat alle puolessa sekunnissa, lähtötunnukset ovat ilmaisia,

4:43 koska niitä on noin neljä, eikä itsenäistä vertailuarvoa ole vielä, koska kuusitoista sataa Hacker News -pistettä ei ole vertailuarvo. Jos haluat mieluummin lukea tämän kuin kuulla minun sanovan sen, diff saapuu sähköpostiisi joka aamu – ilmaiseksi osoitteesta daily diff dot dev, linkki alla. Joten – tämän päivän tuomio: NEEDS REVIEW. Suleyman on oikeassa siinä, että malli, joka on koulutettu sanomaan, ehkä olen tietoinen, ei todista mitään sanomalla sitä. Hän on myös johtaja, jonka ilmoitettu tavoite on lopettaa maksaminen yritykselle, josta hän

5:10 varoittelee sinua. Lue essee, sitten pääomataulukko. Ja se on päivän diff. Olen Niko Axrisista. Yhdistä vastuullisesti.

Lähteet

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

Aiheeseen liittyvät videot