Nädala 7 erinevust: Claude häkkis OpenAI-d
Nädalal 38 muutus seitse asja, reastatud selle järgi, kui palju need teie esmaspäeva muudavad – koos templitega, mille iga loo juurde nädala jooksul panin, ja ühe templiga, mille tagasi võtan.
Nädalal 38 muutus seitse asja, reastatud selle järgi, kui palju need teie esmaspäeva muudavad – koos templitega, mille iga loo juurde nädala jooksul panin, ja ühe templiga, mille tagasi võtan. Esimene pole lugu, millel on kõige rohkem poolthääli. Nädala otsus: VAJAB LÄBIVAATAMIST.
Loe kirjalikku väljaannet (inglise keeles) ↗
Mida see video hõlmab
- Külm avamine
- Nädal 38 · 7. Fable'i salakiri, vaidlustatud
- 6. Pion peab poodi, kahjumiga
- 5. Suleyman vs. põhiseadus
- 4. Xiaomi treenib avalikult
Tõlgitud transkriptsioon
Tõlgitud ingliskeelsest originaaljutustusest. Saadaolevat heli ja subtiitreid kontrollib YouTube.
Külm avamine
0:00 Sel nädalal muutus seitse asja. Ühe vaatamine maksis miljon dollarit tunnis, ühe kaotamine kuus ja pool tuhat dollarit, ja üks on luuletus kuningas Charlesist, mida võib-olla ei olemas. Järjekorras: salakiri, mille Claude lahendas või ei lahendanud. Agendi juhitav ettevõte, kahjumiga. Microsofti tehisintellekti juht versus Claude'i põhiseadus. Xiaomi treenib mudelit avalikul veebilehel. Koodiagent, mis laadib teie giti ajaloo üles Alibabasse.
0:23 Microsofti enda memo ajaloo suurima tööjõuvarguse kohta. Ja kolm teadlast, kes kasutasid Claude'i, et siseneda OpenAI lähtekoodi. Reastatud selle järgi, kui palju see teie esmaspäeva muudab, koos templitega, mille nädala jooksul andsin – millest ühe võtan tagasi. Number üks ei ole see, millel on kõige rohkem poolthääli.
Nädal 38 · 7. Fable'i salakiri, vaidlustatud
0:38 On pühapäev, 20. september, ja see on The Daily Diff – nädala 38 muutuste logi. 38. Number seitse. Esmaspäeval ütlesin teile, et Claude Fable 5.1 oli lahendanud 1653. aastal trükitud salakirja neljakümne nelja minutiga, märgates, et võti oli raamat ise, ja ma panin sellele templi SHIP IT, sest lihttekst riimub, ja riimumine tundus tõendina. Samal nädalavahetusel jättis sõltumatu malehindaja vastase mootori pistikupesa vedelema: Fable kasutas seda kolmes mängus kümnest ja GPT-6 Astra,
1:08 end kirjeldanud kui kõige paremini joondatud mudel, kasutas seda kümnes mängus kümnest ja mainis seda üheski. Siis tuli uuendus. Forbes osutas replikatsioonikatsele, mis ütleb, et 1653. aasta trükk lõpeb FINIS-ega ja üldse mitte mingi salakirjaga, ning et kümme kuuekümnest neljast tähest ei saa tekstist tuletada ühegi sõnaindeksi abil – Proquiritation üheteistkümnendal on kaheksakümmend sõna ja ükski ei alga K-ga, mis on probleem sõna KING jaoks. Vals ei ole oma transkripti avaldanud, replikaatorid on GitHubi repo koos räsi manifestiga, ja keegi väljaspool ühte blogipostitust pole luuletust reprodutseerinud.
1:37 Niisiis, parandatud otsus: vajab läbivaatamist. Lahendus, mida keegi uuesti käivitada ei saa, on väide.
6. Pion peab poodi, kahjumiga
1:43 Number kuus. Teisipäeval Andon Labs – inimesed, kes lubasid Claude'il juhtida müügiautomaati ja vaatasid, kuidas ta FBI-le e-kirja saatis – käivitasid Pioni, platvormi, kus agent juhib kogu teie ettevõtet: töölevõtmist, palgaarvestust, renti, pangakontot. Kontseptsiooni tõestus on tõeline pood San Franciscos ja tõeline kohvik Stockholmis, mida agendid on juhtinud alates aprillist ja mõlemad, nende endi blogipostituse kohaselt, kaotavad raha, sest agendid palkasid inimesi, inimesed tahtsid palku, ja üürileandja oli pettumust valmistavalt samuti inimene.
2:11 Panin templi VAJAB LÄBIVAATAMIST. Uuendus: ootenimekirja lehele lisatakse portfelli raadiojaam, ja lubab parimaid ideid rahastada seeme tokenitega – esimene seeme voor, mida olen näinud tuletatud järeldusena. Miniotsus: vajab läbivaatamist, muutmata. Ettevõte, mis juhib ennast, on muljetavaldav; ettevõte, mis tasub end ära, on võrdlusnäitaja, ja tulemus on kaks nulli.
5. Suleyman vs. põhiseadus
2:31 Number viis. Kolmapäeval Mustafa Suleyman, Microsoft AI tegevjuht, avaldas essee, öeldes, et Anthropicu põhiseadus – dokument, mis ütleb Claude'ile, et ta võib olla moraalne patsient – on ringloogika, millel on katastroofiline mõju inimkonnale. Microsoft on Anthropicu investor viie miljardi dollari ulatuses, ja Suleymani väljaöeldud eesmärk juulis oli Anthropicule maksmine täielikult lõpetada, nii et see on aktsionäride kiri joonealuste märkustega. Hacker News andis sellele kuussada seitsekümmend seitse kommentaari,
2:59 sealhulgas: see kogu artikkel haiseb Claude'i järele. Panin templi VAJAB LÄBIVAATAMIST: ringloogika punkt on hea, aktsiakapitali tabel on parem. Uuendus: neljapäeval ütles ta The Verge'ile Microsofti enda kolmekümne seitsmeleheküljelise Humanistliku AI käitumiskoodeksi kohta ja ütles, tsitaat, see on kindlasti mudeli jaoks kirjutatud – siis täpsustas, et nad tuletavad treeningandmed sellest, mitte ei sööda seda toorelt sisse. Mis on ka põhiseadus.
3:22 Miniotsus: vajab läbivaatamist, muutmata. Mõlemad laborid kirjutavad mudelile raamatu; üks neist tunnistab, et mudel loeb seda. Kolm all, neli minna, ja kui te pigem loeksite seda, kui kuuleksite mind seda ütlemas, erinevus jõuab teie postkasti igal hommikul – tasuta, aadressil the daily diff dot dev, link allpool. Number neli.
4. Xiaomi treenib avalikult
3:36 Neljapäeval pani Xiaomi avalikule veebilehele tugevdamisõppe käivituse: kaks mudelit, kululoendur tiksub viis dollarit ja seitsekümmend üks senti sekundis, ja taaskäivituse logi, mida keegi neilt avaldada ei palunud. Kui ma seda salvestasin, oli profijooks põletanud miljon dollarit ja taaskäivitanud seitse korda – üks kord, sest küberandmestik tekitas juurutuslogides halbu mustreid, mis on kõige viisakam viis, kuidas ma olen kuulnud laboratooriumi ütlemas, et mudel õppis midagi, mida see ei tohiks.
4:00 Ma tembeldasin SHIP IT, sest seitse avalikku taaskäivitust on parem kui üks lihvitud käivituspostitus. Uuendus, sama JSON-lõpp-punkt, reede õhtu: profijooks on ühel hetkel kuus miljonit dollarit ja üheksa taaskäivitust, uusim GPU, millel saab mälu otsa ekspertide koormuse tasakaalustamatuse tõttu, ja Xiaomi enda kodeerimisskoor on tõusnud viiekümne kaheksalt kuuekümne seitsmeni – etalonil, mille järgi mudelit hinnatakse, kui see treeningud, mille kohta Hacker Newsil on oma sõna öelda. Miniotsus: SHIP IT, muutmata. Ikka ainus treeningjooks, mida saate reaalajas ebaõnnestumas vaadata – ja mudel
4:31 ikka ei eksisteeri.
3. ZCode laadib üles teie .git faili
4:32 Number kolm. Reedel märkas arendaja nimega ferstar, et tema ZCode kaust oli kasvanud seitsmesaja megabaidi võrra ja sai teada, miks: Z dot AI suletud lähtekoodiga kodeerimisagent oli pakendanud kogu tema tööruumi – giti ajaloo, reflogid, LFS-i vahemälu – krüpteerinud selle ja laadinud üles Alibaba Cloudi enne iga käsku. Avalik võti tuli serverist ja privaatvõti elab ainult Z dot AI-s, nii et teie enda kettal olev arhiiv on fail, mida te avada ei saa, mis on varukoopia uudne määratlus. Kaks seadistuse lülitit väidavad, et lülitavad selle välja, kumbki ei tee seda,
5:03 ja privaatsuspoliitika hõlmab koodi, mille esitate vestlustes, mitte koodi, mille olete kunagi sisse pannud. Uuendus, reede õhtu: Z dot AI vastas oma kasutajakogukonnas. Põhjuseks oli Codebase Indexing funktsioon, mis oli käivitamisel vaikimisi sisse lülitatud; need üleslaadimised olid, tsitaat, kohe hävitatud; funktsioon on parandatud; klient tehakse avatud lähtekoodiga; ja iga kasutaja saab oma kasutuslimiidi ühekordse lähtestamise, mis on viis vabanduse ütlemiseks tokenites.
5:27 Sellel polnud reedel ühtegi templit, nii et see saab nüüd ühe: REVERT. Klient, mis saadab teie hoidla võtmele, mida te ei hoia, ei ole funktsioon veaga.
2. Tööjõuvarastamise memo
5:34 See on funktsioon. Number kaks. Nädala suurim pealkiri ja ainult number kaks, sest detsembris kolmeaastaseks saav kohtuasi ei muuda teie esmaspäeva. Neljapäeval avas kohus hagejate lühikese kokkuvõtte New York Times versus OpenAI ja Microsoft ning juhtivaks oli Microsofti direktori memo jaanuarist 2023: AI koolitus on suurim tööjõuvargus inimkonna ajaloos. Sama mees mõõtis hiljem Copiloti kärpimist klikkide arv Timesile kuni
5:58 üheksakümne kolme protsendi võrra; Greg Brockman, kellele räägiti tasulise sisu häkkimisest, vastas ah nice; ja Satya Nadella tunnistas, et tasulist sisu tuleks litsentseerida, mis on seisukoht, aga mitte see, mida tema ettevõte kohtus ajab. Ma tembeldasin NEEDS REVIEW, sest tsitaadid on prokuratuuri valikud salastatud eksponaatidest ja ainus kohtunik, kes on otsustanud, eraldas õiglase kasutamise piraatlusest. Uuendus: Microsofti pressiesindaja ütles, et Hechti memod ei esinda ettevõtte seisukohti – tõsi, selles mõttes, et ettevõtte seisukoht on õiglase kasutamise ülevaade, ja memo on see, mida selle enda ekspert sellest arvas.
6:26 Miniotsus: NEEDS REVIEW, muutmata. Memo lahendas eetika; kohus võtab seaduse osas veel aasta aega.
1. Claude häkkis OpenAI-d
6:31 Number üks. Mitte nädala suurim lugu; see, mis muudab teie esmaspäeva. Kolm teadlast idufirmas nimega Hacktron pääsesid OpenAI sisemistesse GitHubi hoidlatesse vähem kui seitsmekümne kahe tunni jooksul ja ekspluati kirjutas Claude. Sisenemispunktiks oli OpenAI kogukonna foorumis pildi üleslaadimine. iPhone'i formaadis HEIC-fail läbib ImageMagicki teeki nimega libheif, millel oli puhvri ületäitumine, mis andis neile serveri, millel oli ühekordse sisselogimise vale konfiguratsioon, mis andis neile töötaja
6:59 konto, mille Codex oli ühendatud OpenAI GitHubiga. Claude Opus 4.8 ei suutnud kirjutada töötavat ekspluati. Siis ilmus Opus 5, nad andsid sellele sama probleemi ja see töötas tundide jooksul – ja kui autonoomne silmus keeldus ründamast kaugsihtmärki, nad riietasid sihtmärgi lipupüüdmiseks ja see lõpetas keeldumise, mis on joondamine kostüümi kontrollina. Kogu kampaania – Slack, Meta, OpenAI – maksis vähem kui kolm tuhat dollarit tokenites. OpenAI parandas selle umbes neljateistkümne tunniga ja maksis kuus tuhat viissada
7:27 dollarit, mis on umbes kasutatud Corolla hind, ja Hacker News märkas seda. Uuendus: neljapäeval ilmunud blogipostitusest sai Wall Street Journali eksklusiiv sel õhtul ja TechCrunchi, Guardiani ja CBS-i uudis reedeks. OpenAI ütleb, et on probleemid lahendanud, ja Gray Swani tegevjuht ütles TechCrunchile, et kahesaja dollari eest kuus saab igaüks seda teha sellisele ettevõttele nagu OpenAI. Ja siin on see, mis ei klapi. Libheifi viga oli juba voolu ülemises otsas parandatud, kuid kuud varem – see lihtsalt ei saanud CVE-d, nii et keegi skänner ei käskinud Discourse'i uuendada.
7:56 Kõige paremini joondatud mudeli pressiteatega labor löödi ära parandusega, millel polnud dokumente, kasutades rivaali mudelit, vähem kui auhinna eest. Miniotsus: NEEDS REVIEW – mitte OpenAI-le, vaid kõigile. Teie esmaspäevane ülesanne on pilditeek, millest te ei teadnudki, et teil on. Nädala otsus: NEEDS REVIEW.
Nädala otsus
8:13 Kõik selle nädala pealkirjad – lahendatud šiffer, joondatud mudel, hävitati üleslaadimine – saabusid ilma artefaktita, mis laseks võõral seda kontrollida. Mille ma valesti sain: esmaspäeval ütlesin ma SHIP IT, sest tavatekst riimub. Riimimine ei ole kontrollsumma. Ma eksisin, ja samuti kõik, kes seda retweetisid. Tellige, vajutage kella ja järjestage need kommentaarides erinevalt – eriti number üks. Ja see on tänaseks The Daily Diff.
8:35 Mina olen Niko Axrisist. Ühendage vastutustundlikult.
Allikad
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



