+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

OpenAI sier de løste Navier–Stokes. Dom: TRENGER VURDERING.

OpenAI sier at en intern modell, kjørt som rundt 10 000 samtidige agenter i 88 timer, produserte et Lean-verifisert bevis på at Navier–Stokes-ligningene blåser opp på endelig tid – et Millennium Prize-problem som har vært åpent siden 1934.

OpenAI sier at en intern modell, kjørt som rundt 10 000 samtidige agenter i 88 timer, produserte et Lean-verifisert bevis på at Navier–Stokes-ligningene blåser opp på endelig tid – et Millennium Prize-problem som har vært åpent siden 1934. Tolv timer tidligere publiserte Trist an Buckmaster fra NYU en fire-siders uttalelse om hvordan søndagstelefonen med OpenAI gikk ("Hvorfor skulle du ødelegge karrieren din?"), Terence Tao skrev at åpne problemer nå blir utvunnet som en ikke-fornybar ressurs, og en forsker innen Anthropic-f orhåndstrening sa opp på grunn av kappløpet. Også: Meta SHIP IT Muse, en personlig agent med egen VM. Dom: TRENGER VURDERING.

Les den skriftlige utgaven (engelsk) ↗

Hva denne videoen dekker

  • OpenAI: Navier–Stokes "blow-up", ~10 000 agenter, 88 timer, 130 milliarder utdata-tokener, Lean-verifisert
  • Buckmaster og Alpöge: ett år på samme tilnærming, et rykte og en søndagstelefon med to tilbud
  • Terence Tao: "selv ryktet om noen som jobber med et problem kan utløse en massiv mengde AI-drevet innsats for å løse det"
  • Jacob Coxon trekker seg fra Anthropic: begge laboratoriene "kappløper rett mot selvforbedrende superintelligens"
  • Meta SHIP IT Muse: en personlig agent på sin egen sky-VM, i WhatsApp, kun USA

Oversatt transkripsjon

Oversatt fra den originale engelske fortellingen. Tilgjengelig lyd og undertekster kontrolleres av YouTube.

0:00 I går annonserte OpenAI at deres AI løste et Millennium Prize-problem, nitti år åpent, én million dollar, på åttifem timer, og de to matematikerne som brukte et år på det samme problemet, fikk vite om det på en søndagstelefon som, ifølge en av dem, inkluderte: hvorfor skulle du ødelegge din karriere? Det var en lang mandag. Ved daggry la en NYU-professor ut en fire-siders uttalelse; seksten hundre poeng på Hacker News. På ettermiddagen publiserte OpenAI beviset.

0:26 Om kvelden sa Terence Tao at åpne problemer nå utvinnes som en ikke-fornybar ressurs, og over natten sa en Anthropic-forsker opp på X, førtifire millioner visninger, fordi begge laboratoriene er, sitat, spiller med livene våre. Meta SHIP IT også en personlig agent som bor i WhatsApp og har sin egen datamaskin. I denne videoen: beviset, telefonsamtalen, fotnoten, og setningen Terence Tao vil at laboratoriene skal høre.

0:49 Det er onsdag 9. september, og dette er The Daily Diff. Matematikken først. Navier–Stokes beskriver hvordan væsker beveger seg, og siden 1934 visste ingen om en glatt 3D-væske kan treffe en singularitet: hastigheten går mot uendelig på endelig tid. OpenAIs system sier ja. Start i ro, påfør en jevn kraft, hold energien endelig, og en virvel spiraler innover som spaghetti til hastigheten "blåser opp". Uttalelser C og D av Clay-formuleringen, i Lean,

1:16 sytten timer med Astra for å verifisere. Så væsker kan eksplodere, noe alle som har sølt kaffe på en MacBook visste, men nå er det i Lean. Hvordan: OpenAI har en ny intern modell som de kaller betydelig mer kapabel enn Astra, og 1. september hørte de et rykte om at to Millennium-problemer hadde blitt løst, så de rettet den mot alle åpne problemer. Navier–Stokes-gruppen: rundt ti tusen samtidige agenter, hundre og tretti milliarder utdata-tokener; tre hundre milliarder på tvers av alle

1:42 problemer. Til Astra-listepriser, femten millioner dollar i tokener for en én-million-dollar-premie OpenAI sier de ikke vil kreve, og med den marginen, hvem ville vel. Den andre siden. Tristan Buckmaster ved NYU og Levent Alpöge, som jobber i Anthropic, brukte et år på å drive en tilnærming av Córdoba og Martínez-Zoroa med Claude og Codex, og betalte OpenAI fra Buckmasters egne forskningsmidler. 15. august fikk de "blow-up" for Euler-ligningene; Buckmaster kaller det første LLM-beviset det mest grufulle han noensinne har lest,

2:10 og det ble verifisert i Lean 22. august. Så spredte et rykte seg, og 3. september sendte han e-post til OpenAI: det er oss, det er personlig, vi publiserer snart. På søndag kl. 12:45 ba OpenAI om å møtes når som helst i dag, og Sébastien Bubeck ble med. Buckmaster ble fortalt at modellen hadde bevist tvungne Navier–Stokes med svært lite menneskelig innspill, noe som i løpet av samtalen ble et helt team, lettere problemer først, en "prompt" skrevet av Codex, og en vanvittig mengde

2:36 datakraft. Han spurte når den første "prompten" ble sendt. Til slutt: de siste dagene, etter at informasjon om arbeidet vårt hadde nådd OpenAI. To tilbud fulgte. Ett: du publiserer Euler, vi publiserer Navier–Stokes dagen etter. To: Buckmaster alene skriver ned OpenAI-beviset, og, sier han, Bubeck ville to ganger ha Alpöge vekk fra artikkelen fordi han jobber i Anthropic. Han nektet og sa han ville gå offentlig. Svaret, ifølge uttalelsen: hvorfor skulle du ødelegge karrieren din,

3:00 så: hvis du ikke vil at jeg skal være snill, trenger jeg ikke å være snill. Normalt er dette setningen rett før et hestehode dukker opp i en seng. OpenAIs versjon: ingen så arbeidet deres, ingen brukerdata ble aksessert, og, fotnote, de kan ikke utelukke at anonymiserte data fra professorenes bruk av produktene deres bidro til å forbedre modellen. Alpöges vurdering: all ære til dem for å være ærlige. Sam Altman sier alle handlet med integritet og generøsitet, og det andre teamet

3:25 truet med grunnløse anklager om plagiari, stavet med én i. Så den offisielle posisjonen: vi kopierte ikke hjemmeleksene dine, vi hørte at du gjorde hjemmelekser. Terence Tao kalte professorenes resultat bemerkelsesverdig og bemerket at Buckmaster forklarte det for ham over telefonen, en forfriskende endring fra AI-baserte kommunikasjonsmåter. Så, fire innlegg: gode åpne problemer blir nå utvunnet som en ikke-fornybar ressurs, selv et rykte om at noen jobber med ett utløser en massiv AI-innsats for å løse det, så insentivet er å slutte å dele forskningsretninger,

3:55 noe som reverserer århundrer med åpen vitenskap. Tre grupper publiserte væske-"blow-up" på en helg; det neste papiret kan være en NDA. Det er stemningen Jacob Coxon sa opp i: tre år med forhåndstrening hos OpenAI, så Anthropic; ingen av selskapene handler ansvarlig, sier han, begge kappløper mot selvforbedrende superintelligens, og sluttspillet skal ikke lanseres fra et privat selskaps Slack. Førtifire millioner visninger, den dagen ett laboratorium satte ti tusen agenter på et rykte,

4:21 så tråden ble SHIP IT med en livedemo. I mellomtiden SHIP IT Meta Muse: en personlig agent på sin egen sky-VM med sin egen nettleser, og du snakker med den i WhatsApp. Kun USA, gratis for det meste. Meta lover en versjon som ikke engang Meta kan lese, senere i år, en veldig spesifikk måte å beskrive dette året på. Topp Hacker News-kommentar: Jeg vil ikke dele livet mitt med Meta på denne måten. Andre: den prøver stadig å selge meg en barnevogn.

4:45 Hvis du heller vil lese dette enn å høre meg si det, lander "diff-en" i innboksen din hver morgen – gratis på the daily diff dot dev, lenke nedenfor. Så – dagens dom: TRENGER VURDERING. Beviset kompilerer; historien gjør det ikke. Ti tusen agenter som løser et nitti år gammelt problem på en helg er årets kapasitetsresultat; å annonsere det med en søndagstelefon til de to personene du hørte om det fra, er det ikke.

5:07 Og det er The Daily Diff for i dag. Jeg er Niko fra Axrisi. Slå sammen ansvarlig.

Kilder

  1. OpenAI: On the Navier–Stokes Millennium Prize Problemopenai.com
  2. OpenAI Lean formalizationgithub.com
  3. Tristan Buckmaster, statement (PDF)cims.nyu.edu
  4. HN: Buckmaster statementnews.ycombinator.com
  5. HN: OpenAI postnews.ycombinator.com
  6. Terence Tao on the Alpöge–Buckmaster resultmathstodon.xyz
  7. Terence Tao: open problems mined non-renewablymathstodon.xyz
  8. HN: Tao threadnews.ycombinator.com
  9. Clay Mathematics Institute: Navier–Stokes problem statementwww.claymath.org
  10. GPT-6 Astra pricing (used for the token-bill arithmetic)openai.com
  11. Jacob Coxon's resignation threadx.com
  12. HN: I resigned from Anthropic todaynews.ycombinator.com
  13. Meta: Introducing Museabout.fb.com
  14. Museai.meta.com
  15. HN: Musenews.ycombinator.com

Relaterte videoer