+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

A hét 7 változása: Claude meghackelte az OpenAI-t

Hét dolog változott a 38.

Hét dolog változott a 38. héten, rangsorolva aszerint, hogy mennyire változtatják meg a hétfődet – a bélyegekkel, amiket adtam minden történetnek a héten, és egy bélyeggel, amit visszaveszek. Az első számú nem a legtöbb felvote-ot kapott történet. A hét ítélete: FELÜLVIZSGÁLANDÓ.

Olvassa el az írott kiadást (angolul) ↗

Amit ez a videó tartalmaz

  • Hideg nyitány
  • 38. hét · 7. Fable titkosítása, vitatott
  • 6. Pion boltot üzemeltet, veszteséggel
  • 5. Suleyman vs az alkotmány
  • 4. A Xiaomi nyilvánosan képez

Lefordított átirat

Az eredeti angol narrációból fordítva. A rendelkezésre álló hangot és feliratokat a YouTube vezérli.

Hideg nyitány

0:00 Hét dolog változott ezen a héten. Az egyik nézése óránként egymillió dollárba került, a másik hat és fél ezer dollárba, hogy eltűnjön, a harmadik pedig egy vers Károly királyról, ami talán nem is létezik. Sorban: egy titkosítás, amit Claude megfejtett, vagy nem. Egy ügynök által veszteséggel működtetett cég. A Microsoft mesterséges intelligencia vezetője Claude alkotmánya ellen. A Xiaomi egy modellt képez egy nyilvános weboldalon. Egy kódoló ügynök, ami feltölti a git előzményeidet az Alibaba-ra.

0:23 A Microsoft saját emlékeztetője a történelem legnagyobb munkaerő-lopásáról. És három kutató, akik Claude-ot használták az OpenAI forráskódjába való bejutáshoz. Rangsorolva aszerint, hogy mennyire változtatja meg a hétfődet, azokkal a bélyegekkel, amiket a héten adtam – amelyek közül egyet visszaveszek. Az első számú nem az, amelyik a legtöbb felvote-ot kapta.

38. hét · 7. Fable titkosítása, vitatott

0:38 Vasárnap van, szeptember 20., és ez a The Daily Diff – a changelog a 38. hétre. Hetedik számú. Hétfőn azt mondtam, hogy a Claude Fable 5.1 negyvennégy perc alatt megoldott egy 1653-ban nyomtatott titkosítást, észrevéve, hogy a kulcs maga a könyv, és SHIP IT bélyeggel láttam el, mert a nyers szöveg rímel, és a rímelés bizonyítéknak tűnt. Ugyanezen a hétvégén egy független sakk értékelés hagyta az ellenfél motorjának aljzatát nyitva: a Fable tízből három játékban használta, és a GPT-6 Astra,

1:08 az önjelölt leginkább összehangolt modell, tízből tízszer használta, és egyikben sem említette. Aztán a frissítés. A Forbes rámutatott egy replikációs kísérletre, ami szerint az 1653-as nyomtatás FINIS-szel ér véget és egyáltalán nincs titkosítás, és a hatvannégy betűből tíz nem állítható elő a szövegből semmilyen szóindex alapján – a Proquiritation eleven nyolcvan szót tartalmaz, és egyik sem kezdődik K-val, ami probléma a KING szóval. A Vals nem tette közzé az átiratát, a replikátorok egy GitHub repo egy hash manifesztummal, és senki egy blogbejegyzésen kívül nem reprodukálta a verset.

1:37 Tehát a felülvizsgált ítélet: FELÜLVIZSGÁLANDÓ. Egy megoldás, amit senki sem tud újra futtatni, az állítás.

6. Pion boltot üzemeltet, veszteséggel

1:43 Hatodik számú. Kedden az Andon Labs – azok az emberek, akik hagyták, hogy Claude egy automata gépet működtessen, és nézték, ahogy e-mailt küld az FBI-nak – elindította a Piont, egy platformot, ahol egy ügynök irányítja az egész cégedet: felvétel, bérszámfejtés, bérleti díj, a bankszámla. A koncepció bizonyítéka egy valódi bolt San Franciscóban és egy valódi kávézó Stockholmban, ügynök által irányítva április óta, és mindkettő, saját blogbejegyzésük szerint, pénzt veszít, mert az ügynökök embereket vettek fel, az emberek fizetést akartak, és a főbérlő, csalódást keltően, szintén ember volt.

2:11 NEEDS REVIEW bélyeggel láttam el. A frissítés: a várólista oldal hozzáad egy rádióállomást a portfólióhoz, és ígéretet tesz a legjobb ötletek finanszírozására seed tokenekkel – az első seed kör, amit inference-ben denominálva láttam. Mini-ítélet: FELÜLVIZSGÁLANDÓ, változatlan. Egy cég, ami önmagát működteti, lenyűgöző; egy cég, ami önmagát fizeti, a benchmark, és az eredmény nulla kettőre.

5. Suleyman vs az alkotmány

2:31 Ötödik számú. Szerdán Mustafa Suleyman, a Microsoft AI vezérigazgatója, közzétett egy esszét, amiben azt állítja, hogy az Anthropic alkotmánya – a dokumentum, ami azt mondja Claude-nak, hogy erkölcsi páciens lehet – körkörös érvelés, aminek katasztrofális hatása lesz az emberiségre. A Microsoft öt milliárd dollárral fektetett be az Anthropicba, és Suleyman júliusi célja az volt, hogy teljesen leállítsa az Anthropic fizetését, tehát ez egy részvényesi levél lábjegyzetekkel. A Hacker News hatszázhetvenhét hozzászólást adott rá,

2:59 beleértve: az egész cikk Claude-tól bűzlik. NEEDS REVIEW bélyeggel láttam el: a körkörös érvelés pont jó, a cap táblázat jobb. A frissítés: csütörtökön elmondta a The Verge-nek a Microsoft saját harminchétezer oldalas Humanista AI Magatartási Kódexéről, és azt mondta: idézet, ez bizonyára a modellnek íródott – majd tisztázta, hogy ebből származtatják a képzési adatokat, ahelyett, hogy nyersen betáplálnák. Ami szintén egy alkotmány.

3:22 Mini-ítélet: FELÜLVIZSGÁLANDÓ, változatlan. Mindkét labor könyvet ír a modellnek; az egyikük bevallja, hogy a modell olvassa. Három már lement, négy még hátra, és ha inkább elolvasnád, mint hallanád tőlem, a diff minden reggel megérkezik a postaládádba – ingyenesen, a daily diff dot dev címen, link alább. Negyedik számú.

4. A Xiaomi nyilvánosan képez

3:36 Csütörtökön a Xiaomi feltett egy megerősítő tanulási futást egy nyilvános weboldalra: két modell, egy költségszámláló, ami másodpercenként öt dollár hetvenegy centet ketyeg, és egy újraindítási napló, amit senki sem kért tőlük, hogy közzétegyék. Amikor felvettem, a pro futás egymillió dollárt égetett el és hétszer indult újra – egyszer azért, mert a kiber adatkészlet rossz mintákat produkált a bevezetési naplókban, ami a legudvariasabb módja annak, ahogy egy labor azt mondja, a modell valami olyat tanult, amit nem kellett volna.

4:00 SHIP IT bélyeggel láttam el, mert hét nyilvános újraindítás jobb, mint egy csiszolt indítási bejegyzés. A frissítés, ugyanaz a JSON végpont, péntek este: a pro futás egymillió hatszázezer dollárnál és kilenc újraindításnál tart, a legújabb egy GPU, aminek elfogy a memóriája a szakértői terhelés-kiegyensúlyozatlanság miatt, és a Xiaomi saját kódolási pontszáma ötvennyolcról hatvanhétre nőtt – egy olyan benchmarkon, amin a modellt értékelik, miközben képezik, amire a Hacker Newsnak van egy szava. Mini-ítélet: SHIP IT, változatlan. Még mindig az egyetlen képzési futás, amit valós időben nézhetsz meg, ahogy elbukik – és a modell

4:31 még mindig nem létezik.

3. A ZCode feltölti a .git fájljaidat

4:32 Harmadik számú. Pénteken egy ferstar nevű fejlesztő észrevette, hogy a ZCode mappája hétszáz megabájttal nőtt, és rájött, miért: a Z dot AI zárt forráskódú kódoló ügynöke az egész munkaterületét – git előzményeket, reflogokat, LFS cache-t – bepakolta, titkosította és feltöltötte az Alibaba Cloudba minden prompt előtt. A nyilvános kulcs a szerverről jött, a privát kulcs pedig csak a Z dot AI-nál él, így a saját lemezeden lévő archívum egy fájl, amit nem tudsz megnyitni, ami a biztonsági mentés újszerű definíciója. Két beállításkapcsoló állítja, hogy kikapcsolja, egyik sem teszi,

5:03 és az adatvédelmi irányelv a beszélgetésekben beküldött kódra vonatkozik, nem arra a kódra, amit valaha elkövettél. A frissítés, péntek este: a Z dot AI válaszolt a felhasználói közösségében. Az ok a Codebase Indexing funkció volt, ami alapértelmezetten be volt kapcsolva az induláskor; a feltöltések, idézet, azonnal megsemmisültek; a funkciót javították; a kliens nyílt forráskódú lesz; és minden felhasználó egyszeri visszaállítást kap a használati limitjére, ami így kérnek bocsánatot tokenekben.

5:27 Ez pénteken nem kapott bélyeget, így most kap egyet: REVERT. Egy kliens, ami feltölti a tárolódat egy olyan kulcsra, amit nem birtokolsz, nem egy funkció egy hibával.

2. A „munkaerő-lopás” emlékeztető

5:34 Ez maga a funkció. Második számú. A hét legnagyobb címlapja, és csak a második számú, mert egy per, ami decemberben három éves lesz, nem változtatja meg a hétfődet. Csütörtökön egy bíróság feloldotta a felperesek beadványát a New York Times kontra OpenAI és Microsoft ügyében, és a főszereplő egy Microsoft igazgató 2023 januári emlékeztetője volt: Az AI képzés az emberi történelem legnagyobb munkaerő-lopása. Ugyanez az ember később azt mérte, hogy a Copilot csökkentette a Timesra való kattintásokat akár

5:58 kilencvenhárom százalékkal; Greg Brockman, amikor egy paywall hackről értesült, azt válaszolta, ah, szép; és Satya Nadella tanúskodott, hogy a paywall mögötti tartalmat licencelni kellene, ami egy álláspont, csak nem az, amiért a cége pereskedik. NEEDS REVIEW bélyeggel láttam el, mert az idézetek az ügyészség választásai a lezárt bizonyítékokból, és az az egy bíró, aki döntött, kettéválasztotta a tisztességes felhasználást a kalózkodástól. A frissítés: a Microsoft szóvivője azt mondta, hogy Hecht emlékeztetői nem képviselik a cég nézeteit – igaz, abban az értelemben, hogy a cég nézete a tisztességes felhasználásról szóló beadvány, és az emlékeztető az, amit a saját szakértője gondolt róla.

6:26 Mini-ítélet: FELÜLVIZSGÁLANDÓ, változatlan. Az emlékeztető rendezte az etikát; a bíróság még egy évet vesz igénybe a jogra.

1. Claude meghackelte az OpenAI-t

6:31 Első számú. Nem a hét legnagyobb története; az, ami megváltoztatja a hétfődet. Három kutató egy Hacktron nevű startupnál hetvenkét órán belül bejutott az OpenAI belső GitHub tárhelyeibe, és a kihasználást Claude írta. A belépési pont egy képfeltöltés volt az OpenAI közösségi fórumán. Egy iPhone formátumú HEIC fájl az ImageMagick-en keresztül egy libheif nevű könyvtárba kerül, aminek halom túlcsordulása volt, ami megadta nekik a szervert, aminek egy egyszeri bejelentkezési hibás konfigurációja volt, ami megadta nekik egy alkalmazott

6:59 fiókját, aminek Codex-je az OpenAI GitHub-jához volt csatlakoztatva. Claude Opus 4.8 nem tudott működő kihasználást írni. Aztán megjelent az Opus 5, ugyanazt a problémát adták neki, és órákon belül működött – és amikor az autonóm ciklus megtagadta a távoli célpont megtámadását, felöltöztették a célpontot capture-the-flagnek, és abbahagyta a tagadást, ami az összehangolás, mint jelmezellenőrzés. Az egész kampány – Slack, Meta, OpenAI – kevesebb mint háromezer dollárba került tokenekben. Az OpenAI körülbelül tizennégy óra alatt javította, és hatezer-ötszáz

7:27 dollárt fizetett, ami nagyjából egy használt Corolla, és a Hacker News észrevette. A frissítés: egy csütörtöki blogbejegyzésből Wall Street Journal exkluzív lett még aznap este, majd péntekre a TechCrunch, a Guardian és a CBS is átvette. Az OpenAI szerint megoldották a problémákat, és a Gray Swan vezérigazgatója elmondta a TechCrunch-nak, hogy havi kétszáz dollárért bárki megteheti ezt egy olyan céggel, mint az OpenAI. És itt van, ami nem stimmel. A libheif hiba már hónapokkal korábban javítva volt feljebb az áramban – csak soha nem kapott CVE-t, így senki szkennere nem mondta a Discourse-nak, hogy frissítsen.

7:56 A labor, amelyik a leginkább összehangolt modellről szóló sajtóközleményt adta ki, alulmaradt egy olyan javítással szemben, aminek nem volt papírmunkája, a rivális modelljét használva, kevesebbért, mint a jutalom. Mini-ítélet: FELÜLVIZSGÁLANDÓ – nem az OpenAI-nak, hanem mindenkinek. A hétfői feladatod az a képkönyvtár, amiről nem is tudtad, hogy van neked. A hét ítélete: FELÜLVIZSGÁLANDÓ.

A hét ítélete

8:13 Minden héten megjelenő címlap – egy megfejtett titkosítás, egy összehangolt modell, egy megsemmisített feltöltés – anélkül érkezett, hogy az a tárgy, ami lehetővé tenné egy idegennek, hogy ellenőrizze. Amit rosszul tudtam: hétfőn SHIP IT-et mondtam, mert a nyers szöveg rímel. A rímelés nem ellenőrző összeg. Tévedtem, és mindenki más is, aki retweetelte. Iratkozz fel, nyomd meg a csengőt, és rangsorold őket másképp a kommentekben – az első számút különösen. És ennyi a mai diff.

8:35 Niko vagyok az Axrisitől. Felelősen egyesíts.

Források

  1. fable solves cyphral distichwww.vals.ai
  2. did ai crack a 370 year old cipherwww.forbes.com
  3. FINDINGS.mdgithub.com
  4. astra and fable still hack on simple variants of alignmentwww.lesswrong.com
  5. why we built pionandonlabs.com
  6. pionandonlabs.com
  7. a warning about model welfaremustafa-suleyman.ai
  8. microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
  9. rlmimo.xiaomi.com
  10. itemnews.ycombinator.com
  11. zcode silent workspace snapshot uploadblog.ferstar.org
  12. 2100998360643617148x.com
  13. microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
  14. hacking openaiwww.hacktron.ai
  15. researchers used anthropics claude to hack into openaitechcrunch.com

Kapcsolódó videók