+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Рекурсивдүү өзүн-өзү өркүндөтүү, ички сырлары

Google DeepMind "Dream-RSI: Өнүгүп жаткан дүйнөлөр аркылуу рекурсивдүү өзүн-өзү өркүндөтүү" аттуу эмгегин жарыялады — андагы коддоо модели эч качан өзгөрбөйт.

Google DeepMind "Dream-RSI: Өнүгүп жаткан дүйнөлөр аркылуу рекурсивдүү өзүн-өзү өркүндөтүү" аттуу эмгегин жарыялады — андагы коддоо модели эч качан өзгөрбөйт. Ички сырлары: бул фраза 60 жыл бою эмнени билдирген, Dream-RSIде эмне иштейт (жазылган издөө дарактарында "түш көргөн" Python изилдөө саясаты) жана 550 ордуна 317 агенттик чалуу эмне үчүн арзандатуу, ал эми көтөрүлүш эмес. Өкүм: NEEDS REVIEW.

Жазма басылышын окуу (Англисче) ↗

Бул видео эмнелерди камтыйт

  • 1965 → 2008: И. Ж. Гуддун "интеллектуалдык жарылуусу", Юдковскинин Seed AI'ы — өз салмагын кайра жаза турган машина
  • 2025: AlphaEvolve — 48 эселенген 4×4 матрицаны көбөйтүү, Google'дун эсептөө кубаттуулугунун 0.7% калыбына келтирилди, Gemini ядролору 23% ылдамыраак
  • 2026: Dream-RSI — саясат жакшырат, коддоочу, сот жана кайра жазуучу тоңдурулган; суроо "Илимий тапшырманы чечпе" дейт
  • X: "Google рекурсивдүү өзүн-өзү өркүндөтүүнү жаңы эле чечти" (819 жактыруу) vs HN: "муну RSI деп атообуз жаңылыштык окшойт"
  • Колдонулган сандар: §4.1 Lasso 550 → 317 агенттик чалуу, 3587 → 2931 мс; 1-таблица айлана таңгактоо 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× азыраак муундар, 2.09× чейин ылдамыраак; Тиркеме B.2 суроо (баары жогорудагы PDFтен)

Котормо стенограмма

Англис тилиндеги баштапкы баяндамадан которулган. Жеткиликтүү аудио жана коштомо жазуулар YouTube тарабынан көзөмөлдөнөт.

0:00 Рекурсивдүү өзүн-өзү өркүндөтүү — бул жасалма интеллект өзүн акылдуу кылат деген идея, андан кийин ошол акылдуу өзүн кайра колдонот, жана ушул жумада Google атында ошол эки сөз камтылган эмгекти жарыялады, анда моделдин салмагы эч качан кыймылдабайт. Үч сан. Anthropicтин башкы директору бул цикл жайдан бери иштеп жатканын айтат, бул анын бүтүндөй тармакты жайлатууга себеби. Google аны жаңы эле чечти деген твит бир күндө сегиз жүз жактырууну топтоду.

0:24 Ал эми эмгектин өзүнүн башкы жыйынтыгы 550 ордуна 317 модель чалуу, бул арзандатуу, ал эми көтөрүлүш эмес. Үч мүнөттө: бул фраза кайдан келип чыккан, Dream-RSI ичинде эмне иштейт, жана мукабасында RSI бар кийинки эмгекти кантип окуу керек. Бул The Daily Diff, ички сырлары. 1965-жыл. И. Ж. Гуд, Тьюрингдин жанында иштеген Блетчли Парктын статистиги, ультраинтеллектуалдык машина андан да жакшы машиналарды иштеп чыга алат деп жазат,

0:52 аны интеллектуалдык жарылуу жана адам жасай турган акыркы ойлоп табуу деп атайт, эгерде машина аны кантип башкаруу керектигин айтып бергенге жетиштүү момун болсо, бул "эгерде" дегенди адамдар үтүрдөн кийин окууну токтотушат. Кырк жыл бою бул фраза дал ушуну билдирген: өзүнүн булагын же салмагын түзөтүп, ар бир өткөн сайын акылдуураак чыккан система. Элиезер Юдковскинин 2008-жылдагы эссеси аны AI коопсуздугунун негизги сөзү кылды, жана аны сыноо үчүн эч кимде машина жок болчу, бул аныктама үчүн идеалдуу шарт. Андан кийин 2025-жылдын май айында DeepMind AlphaEvolve'ду жөнөттү,

1:23 код сунуштаган, бааланган, жеңүүчүлөрдү сактап калган жана аларды кайра мутациялаган Gemini агенти. Ал төрттөн төрткө чейинки татаал матрицаларды 48 кадамда көбөйттү, Страссен 1969-жылы койгон рекордду жаңыртты, жана ал Google'дун дүйнөлүк эсептөө кубаттуулугунун нөл бүтүн жети пайызын калыбына келтирет, бул Google'дун масштабында дивандын астынан табылган маалымат борбору. Gemini эми Gemini'ди үйрөтүүгө жардам берип жатты, жана фраза коопсуздук блогдорунан пресс-релиздерге тынч жылды. Dream-RSI ошол циклдин үстүнө контроллерди бекитет.

1:52 Саясат, иш жүзүндө Python программасы, чечет издөө дарагынын кайсы бутактарын кеңейтүү керектигин, канчасын параллелдүү жана качан баш тартуу керектигин. Gemini талапкер кодду жазат, жана туруктуу баалоочу аны баалайт. Ар бир иштетүү артында эмне аракет кылынганы жана анын баасы тууралуу даракты калтырат. Бул дарак кайра ойнотуу симуляторуна айланат: экинчи, ошондой эле тоңдурулган Gemini саясатты кайра жазат, жана жаңы саясат чыныгы GPU'ларда эмес, жазылган жыйынтыктарга каршы сыналат.

2:16 Эмгек муну түш көрүү деп атайт, жана бир чыныгы иштетүү миңдеген түш көргөндөрдү нөлдүк аткаруу чыгымы менен төлөйт. Жеңүүчү кайра онлайнга чыгат, жазылган дүйнөлөрдүн пулу өсөт, кайталоо. Ал эми Тиркеме B.2деги суроо өзүн-өзү өркүндөтүүчү AI'га жазуу жүзүндө мындай дейт: бир гана бул файлды түзөт, жана илимий тапшырманы чечпе. Өлчөндү. Lasso чечүүчү тапшырмасында, туруктуу изилдөө 3.6 секундага жетүү үчүн 550 Gemini чалуусун сарптады, Dream-RSI 2.9 секундага жетүү үчүн 317ди сарптады, жана экөө тең scikit-learn'ди жеңди.

2:46 KernelBench'те ал ошол эле ядро ылдамдыгына болжол менен 2.4 эсе азыраак муундар менен жетти. Ал эми айлана таңгактоодо ал 2.635983 баасын алды, бул так, алты ондукка чейин, AlphaEvolve экинчи версиясы былтыр алган баасы. Ошентип X аталышты окуду: Google рекурсивдүү өзүн-өзү өркүндөтүүнү жаңы эле чечти. Hacker News PDFти окуду: муну RSI деп атообуз жаңылыштык окшойт. Жана ошол эле жумада атаандаштын башкы директору цикл жайдан бери иштеп жатканын жана баары жайлашы керектигин айтты.

3:13 Үч сүйлөм, ошол эле эки сөз, үч башка машина. Ошентип, Дүйшөмбү, кийинки RSI эмгегин кантип окуу керек. Бир: кайсы объект өзгөрөт деп сураңыз, салмактар, код же издөө жөндөөлөрү; Dream-RSI үчүнчүсүн өзгөртөт. Эки: ким тоңдурулган деп сураңыз; бул жерде коддоочу, сот жана кайра жазуучу, үчөө тең. Үч: башкы сан эмненин бирдиги деп сураңыз. Үнөмдөлгөн эсептөө - оптимизация; модел буга чейин жете албаган эталон бул көтөрүлүш, жана аны азырынча эч ким жарыялай элек.

3:40 Өкүм, ички сырлары: NEEDS REVIEW. Цикл чыныгы, үнөмдөлгөн каражаттар өлчөнгөн, жана мукабадагы эки сөз эмгекте жок машинаны сүрөттөйт. Эгер сиз муну мен айтканды уккандан көрө окугуңуз келсе, diff электрондук почтаңызга күн сайын эртең менен бекер келет, the daily diff dot dev дарегинде, шилтеме ылдыйда. Кийинки эмнени ачуу керектигин комментарийлерде айтыңыз. Жана бул бүгүнкү diff. Мен Аксырыдан Нико.

4:00 Жоопкерчилик менен бириктирүү.

Булактар

  1. Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
  2. Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
  3. Hacker News thread (169 points)news.ycombinator.com
  4. Hugging Face papers (278 upvotes)huggingface.co
  5. I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
  6. Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
  7. Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
  8. Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
  9. Tweetx.com

Окшош видеолор