Рекурсивті өзін-өзі жетілдіру, тереңірек қарастыру
Google DeepMind "Dream-RSI: Өзгеріп отыратын әлемдер арқылы рекурсивті өзін-өзі жетілдіру" еңбегін жариялады — және оның ішіндегі кодтау моделі ешқашан өзгермейді.
Google DeepMind "Dream-RSI: Өзгеріп отыратын әлемдер арқылы рекурсивті өзін-өзі жетілдіру" еңбегін жариялады — және оның ішіндегі кодтау моделі ешқашан өзгермейді. Тереңірек қарастыру: бұл тіркес 60 жыл бойы нені білдірді, Dream-RSI-де (жазылған іздеу ағаштары бойынша "армандаған" Python барлау саясаты) іс жүзінде не қайталанады және неліктен 550 орнына 317 агент шақыруы өсім емес, жеңілдік болып табылады. Үкім: ҚАРАУ КЕРЕК.
Жазбаша басылымды оқыңыз (ағылшынша) ↗
Бұл бейне не туралы
- 1965 → 2008: И.Дж. Гудтың "интеллект жарылысы", Юдковскийдің бастапқы ЖИ — өз салмақтарын қайта жазатын машина
- 2025: AlphaEvolve — 48 көбейтулі 4×4 матрицаны көбейту, Google есептеуінің 0,7%-ы қалпына келтірілді, Gemini ядролары 23% жылдамырақ
- 2026: Dream-RSI — саясат жақсарады, кодтаушы, төреші және қайта жазушы толығымен тоқтатылған; сұрауда "Ғылыми міндетті шешпе" делінген
- X: "Google рекурсивті өзін-өзі жетілдіруді жаңа ғана шешті" (819 ұнату) vs HN: "мұны RSI деп атау жаңылыстыратын сияқты"
- Қолданылған сандар: §4.1 Lasso 550 → 317 агент шақыру, 3587 → 2931 мс; 1-кесте дөңгелек жинау 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× аз ұрпақ, 2.09× дейін жылдамырақ; B.2 қосымшасының сұрауы (бәрі жоғарыдағы PDF-тен)
Аударылған транскрипция
Бастапқы ағылшын тіліндегі баяндамадан аударылған. Қолжетімді аудио және субтитрлерді YouTube басқарады.
0:00 Рекурсивті өзін-өзі жетілдіру - бұл ЖИ-дің өзін-өзі ақылдырақ ету идеясы, содан кейін ақылдырақ өзін қайтадан қолдану, және осы аптада Google осы екі сөзді атауына енгізіп, моделінің салмағы ешқашан өзгермейтін мақала жариялады. Үш сан. Anthropic-тің бас директоры бұл цикл жаздан бері жұмыс істеп тұр дейді, бұл оның бүкіл индустрияны баяулату себебі. Google жаңа ғана шешті деп хабарлаған твит бір күнде сегіз жүз лайк жинады. бір күнде.
0:24 Ал мақаланың басты нәтижесі - 550 модель шақырудың орнына 317, бұл өсім емес, жеңілдік. Үш минут ішінде: бұл сөз тіркесі қайдан шыққаны, Dream-RSI ішінде не іс жүзінде қайталанатыны және мұқабасында RSI бар келесі мақаланы қалай оқуға болатыны. Бұл The Daily Diff, тереңірек қарастыру. 1965 жыл. И.Дж. Гуд, Тьюрингтің қасында жұмыс істеген Блетчли Парк статистигі, өте ақылды машина одан да жақсы машиналарды жасай алады деп жазады,
0:52 мұны интеллект жарылысы және адамзаттың соңғы өнертабысы деп атайды, егер машина оны қалай басқару керектігін айтуға жеткілікті мойынсұнғыш болса, бұл үтірден кейін оқуды тоқтататын адамдар үшін берілген шарт. Қырық жыл бойы бұл сөз тіркесі дәл осыны білдірді: өз көзін немесе салмағын өңдейтін және әр өту сайын ақылдырақ шығатын жүйе. Элиезер Юдковскийдің 2008 жылғы эссесі оны ЖИ қауіпсіздігінің негізгі сөзіне айналдырды, және ешкімде оны сынауға арналған машина болмады, бұл анықтама үшін идеалды жағдай. Содан кейін 2025 жылдың мамырында DeepMind AlphaEvolve-ті шығарды,
1:23 код ұсынатын, оны бағалайтын, жеңімпаздарды сақтайтын және оларды қайта мутациялайтын Gemini агенті. Ол төрт-төрттік күрделі матрицаларды 48 қадамда көбейтті, Штрассеннің 1969 жылы орнатқан рекордын жаңартып, Google-дың бүкіл әлемдегі есептеуінің нөл бүтін жеті пайызын қалпына келтіреді, бұл Google ауқымында диванда табылған деректер орталығы. диванда табылған деректер орталығы. Gemini енді Gemini-ді үйретуге көмектесті, және бұл тіркес қауіпсіздік блогтарынан баспасөз хабарламаларына ауысты. Dream-RSI бұл циклдің үстіне контроллерді бекітеді.
1:52 Саясат, нақты Python бағдарламасы, іздеу ағашының қай тармақтарын кеңейтуді, қаншасын қатарластыруды және қашан бас тартуды шешеді. кеңейтуді, қаншасын қатарластыруды және қашан бас тартуды шешеді. Gemini кандидаттық кодты жазады, және тұрақты бағалаушы оны бағалайды. Әрбір іске қосу артында не сынақтан өткені мен оның бағасы туралы ағаш қалдырады. Бұл ағаш қайта ойнату симуляторына айналады: екінші, дәл сондай қатып қалған Gemini саясатты қайта жазады, және жаңа саясат нақты GPU-да емес, жазылған нәтижелерге қарсы тексеріледі. нақты GPU-да емес.
2:16 Мақала мұны армандау деп атайды, және бір нақты іске қосу мыңдаған армандаған нәтижелерді нөлдік орындау құнымен өтейді. Жеңімпаз қайта желіге шығады, жазылған әлемдер қоры өседі, қайталаңыз. Ал B.2 қосымшасындағы сұрау өзін-өзі жетілдіруші ЖИ-ге жазбаша түрде: тек осы бір файлды өңдеңіз және ғылыми міндетті шешпеңіз деп айтады. Өлшенген. Lasso шешуші міндетінде, тұрақты барлау 3,6 секундқа жету үшін 550 Gemini шақыруын жұмсады, Dream-RSI 2,9 секундқа жету үшін 317 жұмсады, және екеуі де scikit-learn-ді жеңді. және екеуі де scikit-learn-ді жеңді.
2:46 KernelBench-те ол шамамен 2,4 есе аз ұрпақпен бірдей ядролық жылдамдыққа жетті. аз ұрпақпен. Ал дөңгелек жинауда ол 2,635983 ұпай жинады, бұл дәл, алты ондыққа дейін, AlphaEvolve екінші нұсқасы былтыр қанша ұпай жинағанын көрсетеді. алты ондыққа дейін, AlphaEvolve екінші нұсқасы былтыр қанша ұпай жинағанын көрсетеді. Сонымен X атауын оқыды: Google рекурсивті өзін-өзі жетілдіруді жаңа ғана шешті. Hacker News PDF-ті оқыды: мұны RSI деп атау жаңылыстыратын сияқты. Ал сол аптада бәсекелестің бас директоры цикл жаздан бері жұмыс істеп тұр деп айтты және барлығы баяулауы керек.
3:13 Үш сөйлем, сол екі сөз, үш түрлі машина. Сонымен, дүйсенбі, келесі RSI мақаласын қалай оқуға болады. Бірінші: қандай объектілер өзгереді, салмақтар, код немесе іздеу параметрлері; Dream-RSI үшіншісін өзгертеді. Екінші: кім тоқтатылған деп сұраңыз; мұнда ол кодтаушы, төреші және қайта жазушы, барлығы үшеуі. Үшінші: басты сан ненің бірлігі екенін сұраңыз. Үнемделген есептеу - оңтайландыру; модель бұрын жете алмаған көрсеткіш өсім болып табылады, және ешкім мұны әлі жариялаған жоқ.
3:40 Үкім, тереңірек қарастыру: қарау керек. Цикл шынайы, үнемдеулер өлшенген, және мұқабадағы екі сөз мақалада жоқ машинаны сипаттайды. Егер сіз мұны менің айтқанымнан гөрі оқығыңыз келсе, diff әр таңда сіздің пошта жәшігіңізге келеді, thedailydiff.dev сайтында тегін, сілтеме төменде. Келесі не ашу керектігін түсініктемелерде айтыңыз. Бүгінгі diff осымен аяқталды. Мен Axrisi-ден Нико.
4:00 Жауапкершілікпен біріктіріңіз.
Дереккөздер
- Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
- Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
- Hacker News thread (169 points)news.ycombinator.com
- Hugging Face papers (278 upvotes)huggingface.co
- I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
- Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
- Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
- Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
- Tweetx.com



