ការកែលម្អខ្លួនឯងឡើងវិញ ក្រោមគម្រប
Google DeepMind បានបោះពុម្ពផ្សាយ "Dream-RSI: ការកែលម្អខ្លួនឯងឡើងវិញតាមរយៈពិភពលោកដែលកំពុងរីកចម្រើន" — ហើយគំរូកូដនៅខាងក្នុងវាមិនដែលផ្លាស់ប្តូរឡើយ។
Google DeepMind បានបោះពុម្ពផ្សាយ "Dream-RSI: ការកែលម្អខ្លួនឯងឡើងវិញតាមរយៈពិភពលោកដែលកំពុងរីកចម្រើន" — ហើយគំរូកូដនៅខាងក្នុងវាមិនដែលផ្លាស់ប្តូរឡើយ។ ក្រោមគម្រប: អ្វីដែលឃ្លានេះមានន័យសម្រាប់រយៈពេល 60 ឆ្នាំ អ្វីដែលពិតជាកើតឡើងដដែលៗនៅក្នុង Dream-RSI (គោលការណ៍ស្វែងរក Python ដែល "សុបិន" លើមែកធាងស្វែងរកដែលបានកត់ត្រា) និងមូលហេតុដែលការហៅភ្នាក់ងារ 317 ជំនួសឱ្យ 550 គឺជាការបញ្ចុះតម្លៃ មិនមែនជាការចាប់ផ្តើមនោះទេ។ សាលក្រម: ត្រូវការពិនិត្យឡើងវិញ។
អានបោះពុម្ពជាលាយលក្ខណ៍អក្សរ (អង់គ្លេស) ↗
អ្វីដែលវីដេអូនេះគ្របដណ្ដប់
- ឆ្នាំ 1965 → 2008: ការផ្ទុះបញ្ញារបស់ I. J. Good, AI គ្រាប់ពូជរបស់ Yudkowsky — ម៉ាស៊ីនដែលសរសេរទម្ងន់របស់ខ្លួនឯងឡើងវិញ
- ឆ្នាំ 2025: AlphaEvolve — ការគុណម៉ាទ្រីស 4×4 ចំនួន 48 ដង, 0.7% នៃទិន្នន័យគណនារបស់ Google ត្រូវបានសង្គ្រោះ, Gemini kernels លឿនជាង 23%
- ឆ្នាំ 2026: Dream-RSI — គោលការណ៍មានភាពប្រសើរឡើង, អ្នកសរសេរកូដ, ចៅក្រម និងអ្នកសរសេរឡើងវិញទាំងអស់ត្រូវបានបង្កក; សេចក្តីណែនាំបាននិយាយថា "កុំដោះស្រាយកិច្ចការវិទ្យាសាស្ត្រ"
- X: "Google ទើបតែបំបែកការកែលម្អខ្លួនឯងឡើងវិញ" (819 like) ទល់នឹង HN: "ការហៅនេះថា RSI ហាក់ដូចជាយល់ច្រឡំ"
- លេខដែលបានប្រើ: §4.1 Lasso 550 → ការហៅភ្នាក់ងារ 317 ដង, 3587 → 2931 ms; តារាងទី 1 ការវេចខ្ចប់រង្វង់ 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× ជំនាន់តិចជាង, លឿនជាងរហូតដល់ 2.09×; ឧបសម្ព័ន្ធ B.2 សេចក្តីណែនាំ (ទាំងអស់ពី PDF ខាងលើ)
កំណត់ត្រាដែលបានបកប្រែ
បកប្រែចេញពីការនិទានដើមជាភាសាអង់គ្លេស។ សំឡេង និងចំណងជើងរងដែលមានគឺស្ថិតនៅក្រោមការគ្រប់គ្រងរបស់ YouTube។
0:00 ការកែលម្អខ្លួនឯងឡើងវិញ គឺជាគំនិតដែលថា AI ធ្វើឱ្យខ្លួនវាកាន់តែឆ្លាតវៃ, បន្ទាប់មកប្រើខ្លួនឯងដែលឆ្លាតវៃជាង ដើម្បីធ្វើវាម្ដងទៀត ហើយសប្តាហ៍នេះ Google បានបោះពុម្ពផ្សាយ ក្រដាសដែលមានពាក្យពីរនោះនៅក្នុងចំណងជើង ដែលទម្ងន់របស់ម៉ូដែលមិនដែល ផ្លាស់ប្តូរឡើយ។ លេខបី។ នាយកប្រតិបត្តិរបស់ Anthropic និយាយថា វដ្តនេះបានដំណើរការតាំងពីដើមរដូវក្តៅមកម្ល៉េះ, ដែលជាហេតុផលរបស់គាត់ក្នុងការបន្ថយល្បឿនឧស្សាហកម្មទាំងមូល។ ធ្វីតដែលប្រកាសថា Google ទើបតែបំបែកវា បានប្រមូលការចូលចិត្តប្រាំបីរយ ក្នុងមួយថ្ងៃ។
0:24 ហើយលទ្ធផលចំណងជើងរបស់ក្រដាសនោះគឺ 317 ម៉ូដែលហៅជំនួសឱ្យ 550, ដែលជាការបញ្ចុះតម្លៃ មិនមែនជាការចាប់ផ្តើមនោះទេ។ ក្នុងរយៈពេលបីនាទី: កន្លែងដែលឃ្លានេះបានមកពីណា អ្វីដែលពិតជាកើតឡើងដដែលៗនៅខាងក្នុង Dream-RSI, និងរបៀបអានក្រដាសបន្ទាប់ដែលមាន RSI នៅលើគម្រប។ នេះគឺ The Daily Diff, ក្រោមគម្រប។ ឆ្នាំ 1965. I. J. Good, អ្នកស្ថិតិ Bletchley Park ដែលធ្វើការនៅក្បែរ Turing, សរសេរថា ម៉ាស៊ីនដែលមានបញ្ញាខ្ពស់អាចរចនាម៉ាស៊ីនដែលប្រសើរជាងមុន,
0:52 ហៅវាថាការផ្ទុះបញ្ញា និងការបង្កើតចុងក្រោយដែលមនុស្សត្រូវការបង្កើត, ដោយផ្តល់ឱ្យថាម៉ាស៊ីននេះចេះស្តាប់បង្គាប់គ្រប់គ្រាន់ដើម្បីប្រាប់យើងពីរបៀបគ្រប់គ្រងវា, ដែលជាអ្វីដែលមនុស្សឈប់អានបន្ទាប់ពីសញ្ញាក្បៀស។ សម្រាប់រយៈពេលសែសិបឆ្នាំ ឃ្លានេះមានន័យដូចគ្នាថា: ប្រព័ន្ធដែលកែសម្រួល ប្រភព ឬទម្ងន់របស់ខ្លួនឯង ហើយចេញមកឆ្លាតវៃជាងមុនរាល់ពេល។ អត្ថបទរបស់ Eliezer Yudkowsky ឆ្នាំ 2008 បានធ្វើឱ្យវាក្លាយជាពាក្យសំខាន់នៃសុវត្ថិភាព AI, ហើយគ្មាននរណាម្នាក់មានម៉ាស៊ីនដើម្បីសាកល្បងវានោះទេ ដែលជាលក្ខខណ្ឌដ៏ល្អសម្រាប់ និយមន័យ។ បន្ទាប់មកនៅខែឧសភា ឆ្នាំ 2025 DeepMind បានចេញផ្សាយ AlphaEvolve,
1:23 ភ្នាក់ងារ Gemini ដែលស្នើកូដ ទទួលបានពិន្ទុ រក្សាអ្នកឈ្នះ និងផ្លាស់ប្តូរ ពួកវាម្ដងទៀត។ វាបានគុណម៉ាទ្រីសស្មុគស្មាញបួនគុណបួនក្នុង 48 ជំហាន, បំបែកកំណត់ត្រា Strassen ដែលបានកំណត់នៅឆ្នាំ 1969, ហើយវាអាចសង្គ្រោះប្រហែលសូន្យ ចំណុចប្រាំពីរភាគរយនៃទិន្នន័យគណនារបស់ Google នៅទូទាំងពិភពលោក ដែលនៅកម្រិតរបស់ Google គឺ មជ្ឈមណ្ឌលទិន្នន័យដែលរកឃើញនៅក្រោមសាឡុង។ Gemini ឥឡូវនេះកំពុងជួយបណ្តុះបណ្តាល Gemini, ហើយឃ្លានេះបានផ្លាស់ប្តូរដោយស្ងៀមស្ងាត់ពីប្លុកសុវត្ថិភាព ទៅក្នុងសេចក្តីប្រកាសព័ត៌មាន។ Dream-RSI បំពាក់ឧបករណ៍បញ្ជាពីលើវដ្តនោះ។
1:52 គោលការណ៍មួយ កម្មវិធី Python ពិតប្រាកដមួយ សម្រេចចិត្ត ថាមែកធាងស្វែងរកមួយណាដែលត្រូវ ពង្រីក, ប៉ុន្មានស្របគ្នា, និងពេលណាត្រូវបោះបង់។ Gemini សរសេរកូដបេក្ខជន, ហើយអ្នកវាយតម្លៃថេរវាយតម្លៃវា។ រាល់ការរត់ទុកចោលនូវមែកធាងនៃអ្វីដែលត្រូវបានព្យាយាម និងអ្វីដែលវាបានវាយតម្លៃ។ មែកធាងនោះក្លាយជាម៉ាស៊ីនពិសោធន៍ចាក់សារឡើងវិញ: Gemini ទីពីរដែលបង្កកដូចគ្នា សរសេរឡើងវិញ គោលការណ៍, ហើយគោលការណ៍ថ្មីត្រូវបានសាកល្បងប្រឆាំងនឹងលទ្ធផលដែលបានកត់ត្រាជំនួសឱ្យ នៅលើ GPUs ពិតប្រាកដ។
2:16 ក្រដាសនេះហៅវាថាការសុបិន, ហើយការរត់ពិតប្រាកដមួយបង់ថ្លៃសម្រាប់ការសុបិនរាប់ពាន់ ដោយគ្មានថ្លៃប្រតិបត្តិការ។ អ្នកឈ្នះត្រឡប់មកអ៊ីនធឺណិតវិញ អាងនៃពិភពលោកដែលបានកត់ត្រាកើនឡើង ធ្វើម្តងទៀត។ ហើយសេចក្តីណែនាំក្នុងឧបសម្ព័ន្ធ B.2 ប្រាប់ AI ដែលកែលម្អខ្លួនឯង, ជាលាយលក្ខណ៍អក្សរ: កែសម្រួលតែឯកសារនេះមួយប៉ុណ្ណោះ, ហើយកុំដោះស្រាយកិច្ចការវិទ្យាសាស្ត្រ។ វាស់វែង។ លើកិច្ចការដោះស្រាយ Lasso, ការស្វែងរកថេរបានចំណាយ 550 ការហៅ Gemini ដើម្បី ឈានដល់ 3.6 វិនាទី, Dream-RSI បានចំណាយ 317 ដើម្បីឈានដល់ 2.9, ហើយទាំងពីរបានយកឈ្នះ scikit-learn ។
2:46 លើ KernelBench វាបានឈានដល់ល្បឿន kernel ដូចគ្នាជាមួយនឹងប្រហែល 2.4 ដង ជំនាន់តិចជាង។ ហើយលើការវេចខ្ចប់រង្វង់វាបានពិន្ទុ 2.6359 83, ដែលពិតប្រាកដ, ដល់ប្រាំមួយទសភាគ, អ្វីដែល AlphaEvolve កំណែពីរ បានពិន្ទុឆ្នាំមុន។ ដូច្នេះ X បានអានចំណងជើង: Google ទើបតែបំបែកការកែលម្អខ្លួនឯងឡើងវិញ។ Hacker News បានអាន PDF: ការហៅនេះថា RSI ហាក់ដូចជាយល់ច្រឡំ។ ហើយក្នុងសប្តាហ៍ដដែល នាយកប្រតិបត្តិនៃគូប្រជែងម្នាក់បាននិយាយថា វដ្តនេះបានដំណើរការតាំងពីដើមរដូវក្តៅមកម្ល៉េះ ហើយមនុស្សគ្រប់គ្នាគួរតែបន្ថយល្បឿន។
3:13 បីប្រយោគ, ពាក្យពីរដូចគ្នា, ម៉ាស៊ីនបីផ្សេងគ្នា។ ដូច្នេះ, ថ្ងៃច័ន្ទ, របៀបអានក្រដាស RSI បន្ទាប់។ ទីមួយ: សួរថាវត្ថុអ្វីដែលផ្លាស់ប្តូរ, ទម្ងន់, កូដ, ឬការកំណត់ស្វែងរក; Dream-RSI ផ្លាស់ប្តូរទីបី។ ទីពីរ: សួរថាអ្នកណាដែលបង្កក; នៅទីនេះគឺអ្នកសរសេរកូដ, ចៅក្រម និងអ្នកសរសេរឡើងវិញ, ទាំងបី។ ទីបី: សួរថាតើលេខចំណងជើងជាឯកតារបស់អ្វី។ ការគណនាដែលបានសន្សំគឺជាការបង្កើនប្រសិទ្ធភាព; គោលដៅដែលម៉ូដែលមិនអាចទៅដល់ពីមុនគឺ ការចាប់ផ្តើម, ហើយគ្មាននរណាម្នាក់បានបោះពុម្ពផ្សាយវានៅឡើយទេ។
3:40 សាលក្រម, ក្រោមគម្រប: ត្រូវការពិនិត្យឡើងវិញ។ វដ្តនេះពិតប្រាកដ, ការសន្សំត្រូវបានវាស់វែង, ហើយពាក្យពីរនៅលើគម្រប ពណ៌នាអំពីម៉ាស៊ីនដែលមិនមាននៅក្នុងក្រដាស។ ប្រសិនបើអ្នកចង់អាននេះជាជាងស្តាប់ខ្ញុំនិយាយ, diff ទៅដល់ប្រអប់សំបុត្ររបស់អ្នក រៀងរាល់ព្រឹក, ឥតគិតថ្លៃនៅ the daily diff dot dev, តំណភ្ជាប់ខាងក្រោម។ ប្រាប់ខ្ញុំពីអ្វីដែលត្រូវបើកបន្ទាប់នៅក្នុងមតិយោបល់។ ហើយនោះគឺជា diff សម្រាប់ថ្ងៃនេះ។ ខ្ញុំ Niko មកពី Axrisi ។
4:00 បញ្ចូលគ្នាយ៉ាងមានការទទួលខុសត្រូវ។
ប្រភព
- Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
- Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
- Hacker News thread (169 points)news.ycombinator.com
- Hugging Face papers (278 upvotes)huggingface.co
- I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
- Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
- Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
- Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
- Tweetx.com



