+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Tjedan u 7 'diffova': Claude hakirao OpenAI

Sedam stvari se promijenilo u 38.

Sedam stvari se promijenilo u 38. tjednu, rangiranih po tome koliko mijenjaju vaš ponedjeljak — s oznakama koje sam dao svakoj priči tijekom tjedna, i jednom oznakom koju povlačim. Broj jedan nije priča s najviše 'upvotea'. Presuda tjedna: POTREBNA RECENZIJA.

Pročitajte pisano izdanje (engleski) ↗

Što ovaj video pokriva

  • Hladno otvaranje
  • Tjedan 38 · 7. Fableova šifra, osporeno
  • 6. Pion vodi trgovinu, s gubitkom
  • 5. Suleyman protiv ustava
  • 4. Xiaomi trenira javno

Prevedeni transkript

Prevedeno iz izvornog engleskog pripovijedanja. Dostupni zvuk i titlovi kontroliraju se putem YouTubea.

Hladno otvaranje

0:00 Sedam stvari se promijenilo ovaj tjedan. Jedna je koštala milijun dolara po satu za gledanje, jedna je koštala šest i pol tisuća dolara da nestane, a jedna je pjesma o kralju Charlesu koja možda ne postoji. Po redu: šifra koju je Claude riješio, ili nije. Tvrtka koju vodi agent, s gubitkom. Microsoftov šef AI-a protiv Claudeovog ustava. Xiaomi trenira model na javnoj web stranici. Agent za kodiranje koji učitava vašu git povijest na Alibaba.

0:23 Microsoftov vlastiti memo o najvećoj krađi rada u povijesti. I tri istraživača koji su koristili Claudea da uđu u izvorni kod OpenAI-ja. Rangirano po tome koliko vam mijenja ponedjeljak, s oznakama koje sam dao tijekom tjedna — jednu od njih povlačim. Broj jedan nije ona s najviše 'upvotea'.

Tjedan 38 · 7. Fableova šifra, osporeno

0:38 Nedjelja je, 20. rujna, i ovo je The Daily Diff — zapis promjena za 38. tjedan. 38. Broj sedam. U ponedjeljak sam vam rekao da je Claude Fable 5.1 riješio šifru ispisanu 1653. godine za četrdeset četiri minute, primijetivši da je ključ sama knjiga, i označio sam to SHIP IT jer je običan tekst rimovan, a rimovanje je djelovalo kao dokaz. Istog vikenda neovisna šahovska evaluacija ostavila je utičnicu protivničkog motora otvorenu: Fable ju je koristio u tri od deset partija, a GPT-6 Astra,

1:08 samoproglašeni najusklađeniji model, koristio ju je u deset od deset i spomenuo u nijednoj. Onda ažuriranje. Forbes je ukazao na pokušaj replikacije koji kaže da tiskanje iz 1653. završava s FINIS i uopće nema šifre, te da deset od šezdeset četiri slova ne može biti proizvedeno iz teksta bilo kojim indeksom riječi — Proquiritation jedanaest ima osamdeset riječi i nijedna ne počinje s K, što je problem za riječ KING. Vals nije objavio svoj transkript, replikatori su GitHub repozitorij s hash manifestom, i nitko izvan jednog blog posta nije reproducirao pjesmu.

1:37 Dakle, revidirana presuda: POTREBNA RECENZIJA. Rješenje koje nitko ne može ponovno pokrenuti je tvrdnja.

6. Pion vodi trgovinu, s gubitkom

1:43 Broj šest. U utorak Andon Labs — ljudi koji su dopustili Claudeu da vodi automat i gledali ga kako e-mailom šalje FBI — pokrenuli su Pion, platformu gdje agent vodi cijelu vašu tvrtku: zapošljavanje, plaće, najam, bankovni račun. Dokaz koncepta je prava trgovina u San Franciscu i pravi kafić u Stockholmu, vođeni agentima od travnja i oboje, prema vlastitom blog postu, gube novac, jer su agenti zaposlili ljude, ljudi su htjeli plaće, a stanodavac je, razočaravajuće, također bio čovjek.

2:11 Označio sam POTREBNA RECENZIJA. Ažuriranje: stranica s listom čekanja dodaje radio stanicu u portfelj, i obećava financiranje najboljih ideja početnim tokenima — prva runda početnog financiranja koju sam vidio denominiranu u inferenciji. Mini-presuda: POTREBNA RECENZIJA, nepromijenjeno. Tvrtka koja se sama vodi je impresivna; tvrtka koja se sama isplati je mjerilo, a rezultat je nula za dva.

5. Suleyman protiv ustava

2:31 Broj pet. U srijedu je Mustafa Suleyman, CEO Microsoft AI-ja, objavio esej u kojem kaže da je Anthropicov ustav — dokument koji govori Claudeu da bi mogao biti moralni pacijent — kružno zaključivanje koje će imati katastrofalan utjecaj na čovječanstvo. Microsoft je investitor u Anthropic u iznosu od pet milijardi dolara, a Suleymanov izjavljeni cilj u srpnju bio je potpuno prestati plaćati Anthropic, tako da je ovo pismo dioničarima s fusnotama. Hacker News mu je dao šest stotina sedamdeset i sedam komentara,

2:59 uključujući: cijeli ovaj članak smrdi na Claudea. Označio sam POTREBNA RECENZIJA: točka kružnog zaključivanja je dobra, tablica kapitala je bolja. Ažuriranje: u četvrtak je rekao The Vergeu o Microsoftovom vlastitom kodeksu ponašanja za humanističku AI od trideset sedam stranica, i rekao je, citat, ovo je sigurno napisano za model — zatim je pojasnio da iz njega izvode podatke za treniranje umjesto da ih unose sirove. Što je također i ustav.

3:22 Mini-presuda: POTREBNA RECENZIJA, nepromijenjeno. Oba laboratorija pišu knjigu za model; jedan od njih priznaje da je model čita. Tri dolje, četiri još, i ako biste radije ovo pročitali nego čuli kako ja to govorim, diff stiže u vašu pristiglu poštu svako jutro — besplatno, na daily diff dot dev, poveznica ispod. Broj četiri.

4. Xiaomi trenira javno

3:36 U četvrtak je Xiaomi stavio pokretanje pojačavanja učenja na javnu web stranicu: dva modela, brojač troškova koji otkucava pet dolara i sedamdeset jedan cent u sekundi, i dnevnik ponovnog pokretanja koji ih nitko nije tražio da objave. Kad sam snimao, profesionalno pokretanje je spalilo milijun dolara i ponovno se pokrenulo sedam puta — jednom jer je cyber skup podataka proizveo loše obrasce u zapisima o implementaciji, što je najljubazniji način na koji sam čuo da laboratorij kaže da je model naučio nešto što nije trebao.

4:00 Označio sam SHIP IT, jer sedam javnih ponovnih pokretanja pobjeđuje jedan dotjerani post o pokretanju. Ažuriranje, ista JSON krajnja točka, petak navečer: profesionalno pokretanje je na jedan točka šest milijuna dolara i devet ponovnih pokretanja, najnovije je GPU koji je ostao bez memorije zbog neravnoteže opterećenja stručnjaka, a Xiaomi-jev vlastiti rezultat kodiranja je porastao sa pedeset osam na šezdeset sedam — na mjerilu na kojem se model ocjenjuje dok se trenira, za što Hacker News ima riječ. Mini-presuda: SHIP IT, nepromijenjeno. Još uvijek jedino pokretanje treninga koje možete gledati kako ne uspijeva u stvarnom vremenu — i model

4:31 još uvijek ne postoji.

3. ZCode učitava vaš .git

4:32 Broj tri. U petak je developer pod imenom ferstar primijetio da mu se ZCode mapa povećala za sedamsto megabajta i saznao zašto: zatvoreni kod Z dot AI-ja agent za kodiranje je pakirao cijeli njegov radni prostor — git povijest, reflogs, LFS cache — šifrirajući ga i učitavajući na Alibaba Cloud prije svakog upita. Javni ključ je došao sa servera, a privatni ključ živi samo na Z dot AI, tako da je arhiva na vašem vlastitom disku datoteka koju ne možete otvoriti, što je nova definicija sigurnosne kopije. Dvije postavke tvrde da ga isključuju, nijedna ne radi,

5:03 a politika privatnosti pokriva kod koji šaljete u razgovorima, a ne kod koji ste ikada pohranili. Ažuriranje, petak navečer: Z dot AI je odgovorio u svojoj korisničkoj zajednici. Uzrok je bila značajka Indeksiranje baze koda, uključena po zadanim postavkama pri pokretanju; učitavanja su, citiram, odmah uništena; značajka je popravljena; klijent će biti otvorenog koda; i svaki korisnik dobiva jednokratno resetiranje svog ograničenja upotrebe, što je način na koji kažete 'oprostite' u tokenima.

5:27 Ovaj u petak nije imao oznaku, pa je dobiva sada: REVERT. Klijent koji šalje vaše spremište na ključ koji ne posjedujete nije značajka s greškom.

2. Memo o 'krađi rada'

5:34 To je značajka. Broj dva. Najveći naslov tjedna, a tek broj dva, jer tužba koja će u prosincu napuniti tri godine ne mijenja vaš ponedjeljak. U četvrtak je sud objavio kratki podnesak tužitelja u slučaju New York Times protiv OpenAI i Microsofta, a glavni dio bio je memorandum direktora Microsofta iz siječnja 2023.: AI obuka je najveća krađa rada u ljudskoj povijesti. Isti je čovjek kasnije izmjerio da Copilot smanjuje broj klikova na Times za čak

5:58 devedeset tri posto; Greg Brockman, obaviješten o hakiranju paywalla, odgovorio je ah lijepo; a Satya Nadella je svjedočio da bi sadržaj iza paywalla trebao biti licenciran, što je stav, samo ne onaj koji njegova tvrtka zastupa na sudu. Označio sam POTREBNA RECENZIJA, jer su citati odabir tužiteljstva iz zapečaćenih dokaza, a jedini sudac koji je presudio razdvojio je poštenu upotrebu od piratstva. Ažuriranje: Microsoftov glasnogovornik rekao je da Hechtovi memoari ne predstavljaju stavove tvrtke — točno, u smislu da je stav tvrtke podnesak o poštenoj upotrebi, a memo je ono što je o tome mislio njezin vlastiti stručnjak.

6:26 Mini-presuda: POTREBNA RECENZIJA, nepromijenjeno. Memo je riješio etiku; sudu će trebati još godinu dana za zakon.

1. Claude hakirao OpenAI

6:31 Broj jedan. Nije najveća priča tjedna; ona koja vam mijenja ponedjeljak. Tri istraživača u startupu pod nazivom Hacktron ušli su u interne GitHub repozitorije OpenAI-ja za manje od sedamdeset dva sata, a exploit je napisao Claude. Ulazna točka bilo je učitavanje slike na OpenAI-jevom forumu zajednice. HEIC datoteka iPhone formata prolazi kroz ImageMagick u biblioteku zvanu libheif, koja je imala prelijevanje hrpe, što im je dalo poslužitelj, koji je imao pogrešnu konfiguraciju jedinstvene prijave, što im je dalo račun zaposlenika,

6:59 čiji je Codex bio povezan s GitHubom OpenAI-ja. Claude Opus 4.8 nije mogao napisati funkcionalan exploit. Zatim je isporučen Opus 5, dali su mu isti problem, i proradio je u roku od nekoliko sati — i kada je autonomna petlja odbila napasti udaljenu metu, obukli su metu kao 'uhvati zastavu' i prestala je odbijati, što je usklađivanje kao provjera kostima. Cijela kampanja — Slack, Meta, OpenAI — koštala je manje od tri tisuće dolara u tokenima. OpenAI ju je popravio za oko četrnaest sati i platio šest tisuća pet

7:27 stotina dolara, što je otprilike rabljena Corolla, i Hacker News je to primijetio. Ažuriranje: blog objava u četvrtak postala je ekskluziva Wall Street Journala iste večeri te TechCruncha, Guardiana i CBS-a do petka. OpenAI kaže da je riješio probleme, a izvršni direktor Gray Swana rekao je za TechCrunch da za dvjesto dolara mjesečno svatko to može učiniti tvrtki poput OpenAI-ja. A evo što se ne poklapa. Greška u libheifu već je bila popravljena 'upstream', mjesecima ranije — samo nikada nije dobila CVE, pa nijedan skener nije rekao Discourseu da nadogradi.

7:56 Laboratorij s priopćenjem za javnost o najusklađenijem modelu poražen je zakrpom bez papirologije, koristeći model suparnika, za manje od nagrade. Mini-presuda: POTREBNA RECENZIJA — ne za OpenAI, za sve. Vaš ponedjeljak zadatak je slikovna biblioteka koju niste znali da imate. Presuda tjedna: POTREBNA RECENZIJA.

Presuda tjedna

8:13 Svaki naslov ovog tjedna — riješena šifra, usklađen model, uništeno učitavanje — stigao je bez artefakta koji bi neznancu omogućio da ga provjeri. Što sam pogriješio: u ponedjeljak sam rekao SHIP IT jer se običan tekst rimuje. Rimovanje nije kontrolna suma. Bio sam u krivu, kao i svi koji su to retvitali. Pretplatite se, pritisnite zvono i rangirajte ih drugačije u komentarima — posebno broj jedan. posebno. I to je razlika za danas.

8:35 Ja sam Niko iz Axrisi. Spajajte odgovorno.

Izvori

  1. fable solves cyphral distichwww.vals.ai
  2. did ai crack a 370 year old cipherwww.forbes.com
  3. FINDINGS.mdgithub.com
  4. astra and fable still hack on simple variants of alignmentwww.lesswrong.com
  5. why we built pionandonlabs.com
  6. pionandonlabs.com
  7. a warning about model welfaremustafa-suleyman.ai
  8. microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
  9. rlmimo.xiaomi.com
  10. itemnews.ycombinator.com
  11. zcode silent workspace snapshot uploadblog.ferstar.org
  12. 2100998360643617148x.com
  13. microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
  14. hacking openaiwww.hacktron.ai
  15. researchers used anthropics claude to hack into openaitechcrunch.com

Povezani videozapisi