ການປັບປຸງຕົນເອງແບບ recursive, ພາຍໃນ
Google DeepMind ໄດ້ເຜີຍແຜ່ "Dream-RSI: ການປັບປຸງຕົນເອງແບບ recursive ຜ່ານໂລກທີ່ພັດທະນາ" — ແລະຮູບແບບການເຂົ້າລະຫັດພາຍໃນນັ້ນບໍ່ເຄີຍປ່ຽນແປງ.
Google DeepMind ໄດ້ເຜີຍແຜ່ "Dream-RSI: ການປັບປຸງຕົນເອງແບບ recursive ຜ່ານໂລກທີ່ພັດທະນາ" — ແລະຮູບແບບການເຂົ້າລະຫັດພາຍໃນນັ້ນບໍ່ເຄີຍປ່ຽນແປງ. ພາຍໃນ: ປະໂຫຍກນີ້ໝາຍເຖິງຫຍັງເປັນເວລາ 60 ປີ, ສິ່ງທີ່ໝູນວຽນແທ້ໆໃນ Dream-RSI (ນະໂຍບາຍການສຳຫຼວດ Python ທີ່ "ຝັນ" ຜ່ານຕົ້ນໄມ້ຄົ້ນຫາທີ່ຖືກບັນທຶກໄວ້), ແລະເປັນຫຍັງການຮຽກໃຊ້ຕົວແທນ 317 ຄັ້ງ ແທນທີ່ຈະເປັນ 550 ຄັ້ງ ຈຶ່ງເປັນສ່ວນຫຼຸດ, ບໍ່ແມ່ນການເພີ່ມຂຶ້ນ. ຄຳຕັດສິນ: NEEDS REVIEW.
ອ່ານສະບັບລາຍລັກອັກສອນ (ພາສາອັງກິດ) ↗
ສິ່ງທີ່ວິດີໂອນີ້ກວມເອົາ
- 1965 → 2008: ການລະເບີດຂອງຄວາມສະຫຼາດຂອງ I. J. Good, AI ພື້ນຖານຂອງ Yudkowsky — ເຄື່ອງຈັກທີ່ຂຽນນ້ຳໜັກຂອງຕົນເອງຄືນໃໝ່
- 2025: AlphaEvolve — ການຄູນເມຕຣິກ 4×4 48 ຄັ້ງ, 0.7% ຂອງຄອມພິວເຕີຂອງ Google ຖືກກູ້ຄືນ, Gemini kernels ເລັວກວ່າ 23%
- 2026: Dream-RSI — ນະໂຍບາຍປັບປຸງ, ຜູ້ເຂົ້າລະຫັດ, ຜູ້ພິພາກສາ ແລະ ຜູ້ຂຽນຄືນໃໝ່ຖືກຢຸດທັງໝົດ; ຄຳສັ່ງບອກວ່າ "ຢ່າແກ້ໄຂວຽກວິທະຍາສາດ"
- X: "Google ຫາກໍພົບວິທີການປັບປຸງຕົນເອງແບບ recursive" (819 ຖືກໃຈ) ທຽບກັບ HN: "ການເອີ້ນສິ່ງນີ້ວ່າ RSI ເບິ່ງຄືວ່າເຂົ້າໃຈຜິດ"
- ຕົວເລກທີ່ໃຊ້: §4.1 Lasso 550 → 317 ການຮຽກໃຊ້ຕົວແທນ, 3587 → 2931 ms; ຕາຕະລາງ 1 ການຈັດວົງມົນ 2.635983 = AlphaEvolveV2; §4.3 KernelBench 2.43× / 1.79× ການສ້າງໜ້ອຍລົງ, ເລັວກວ່າເຖິງ 2.09×; ພາກຂະຫຍາຍ B.2 ຄຳສັ່ງ (ທັງໝົດຈາກ PDF ຂ້າງເທິງ)
ບົດບັນທຶກທີ່ແປແລ້ວ
ແປຈາກຄຳບັນຍາຍຕົ້ນສະບັບພາສາອັງກິດ. ສຽງ ແລະ ຄຳບັນຍາຍທີ່ມີໃຫ້ແມ່ນຄວບຄຸມໂດຍ YouTube.
0:00 ການປັບປຸງຕົນເອງແບບ recursive ແມ່ນແນວຄວາມຄິດທີ່ AI ເຮັດໃຫ້ຕົນເອງສະຫຼາດຂຶ້ນ, ຈາກນັ້ນໃຊ້ຕົວເອງທີ່ສະຫຼາດຂຶ້ນນັ້ນເຮັດອີກຄັ້ງ, ແລະອາທິດນີ້ Google ໄດ້ເຜີຍແຜ່ ເອກະສານທີ່ມີສອງຄຳນັ້ນໃນຫົວຂໍ້, ເຊິ່ງນ້ຳໜັກຂອງຮູບແບບບໍ່ເຄີຍ ເຄື່ອນຍ້າຍ. ສາມຕົວເລກ. CEO ຂອງ Anthropic ກ່າວວ່າວົງຈອນນີ້ໄດ້ດຳເນີນມາຕັ້ງແຕ່ລະດູຮ້ອນ, ເຊິ່ງເປັນເຫດຜົນທີ່ລາວຕ້ອງການຊະລໍອຸດສາຫະກຳທັງໝົດ. ທະວິດທີ່ປະກາດວ່າ Google ຫາກໍພົບວິທີການນັ້ນໄດ້ເກັບກຳແປດຮ້ອຍຖືກໃຈ ໃນໜຶ່ງມື້.
0:24 ແລະຜົນຫຼັກຂອງເອກະສານເອງແມ່ນ 317 ການຮຽກໃຊ້ຮູບແບບ ແທນທີ່ຈະເປັນ 550, ເຊິ່ງເປັນສ່ວນຫຼຸດ, ບໍ່ແມ່ນການເພີ່ມຂຶ້ນ. ໃນສາມນາທີ: ປະໂຫຍກນີ້ມາຈາກໃສ, ສິ່ງທີ່ໝູນວຽນແທ້ໆພາຍໃນ Dream-RSI, ແລະວິທີການອ່ານເອກະສານຕໍ່ໄປທີ່ມີ RSI ຢູ່ໜ້າປົກ. ນີ້ຄື The Daily Diff, ພາຍໃນ. 1965. I. J. Good, ນັກສະຖິຕິ Bletchley Park ທີ່ເຮັດວຽກຢູ່ຂ້າງ Turing, ຂຽນວ່າເຄື່ອງຈັກທີ່ສະຫຼາດສຸດໆສາມາດອອກແບບເຄື່ອງຈັກທີ່ດີກວ່າໄດ້ອີກ,
0:52 ເອີ້ນວ່າມັນເປັນການລະເບີດຂອງຄວາມສະຫຼາດ ແລະການປະດິດສຸດທ້າຍທີ່ມະນຸດຕ້ອງການເຮັດ, ສະໜອງໃຫ້ເຄື່ອງຈັກນັ້ນເຊື່ອງ່າຍພໍທີ່ຈະບອກພວກເຮົາວິທີການຄວບຄຸມມັນ, ເຊິ່ງແມ່ນຄຳວ່າ 'ສະໜອງໃຫ້' ຄົນຢຸດອ່ານຫຼັງຈາກເຄື່ອງໝາຍຈຸດ. ເປັນເວລາສີ່ສິບປີ, ປະໂຫຍກນີ້ໝາຍເຖິງສິ່ງນັ້ນແທ້ໆ: ລະບົບທີ່ແກ້ໄຂຂອງຕົນເອງ ແຫຼ່ງທີ່ມາ ຫຼື ນ້ຳໜັກ ແລະ ອອກມາສະຫຼາດຂຶ້ນທຸກຄັ້ງ. ບົດຂຽນປີ 2008 ຂອງ Eliezer Yudkowsky ໄດ້ເຮັດໃຫ້ມັນເປັນຄຳສັບຫຼັກຂອງ AI ຄວາມປອດໄພ, ແລະບໍ່ມີໃຜມີເຄື່ອງຈັກທີ່ຈະທົດສອບມັນ, ເຊິ່ງເປັນເງື່ອນໄຂທີ່ເໝາະສົມສຳລັບ ຄໍານິຍາມ. ຈາກນັ້ນໃນເດືອນພຶດສະພາ 2025 DeepMind ໄດ້ສົ່ງ AlphaEvolve,
1:23 ຕົວແທນ Gemini ທີ່ສະເໜີລະຫັດ, ໄດ້ຄະແນນ, ເກັບຜູ້ຊະນະ ແລະປ່ຽນແປງ ພວກມັນອີກຄັ້ງ. ມັນໄດ້ຄູນເມຕຣິກສະລັບສັບສີ່ຄູນສີ່ໃນ 48 ຂັ້ນຕອນ, ເອົາຊະນະສະຖິຕິທີ່ Strassen ຕັ້ງໄວ້ໃນປີ 1969, ແລະມັນກູ້ຄືນໄດ້ປະມານສູນ ຈຸດເຈັດເປີເຊັນຂອງຄອມພິວເຕີທົ່ວໂລກຂອງ Google, ເຊິ່ງໃນລະດັບຂອງ Google ແມ່ນ ສູນຂໍ້ມູນທີ່ພົບຢູ່ໃຕ້ໂຊຟາ. Gemini ຕອນນີ້ກຳລັງຊ່ວຍຝຶກ Gemini, ແລະປະໂຫຍກດັ່ງກ່າວໄດ້ຍ້າຍຈາກບລັອກຄວາມປອດໄພ ໄປສູ່ການຖະແຫຼງຂ່າວຢ່າງງຽບໆ. Dream-RSI ຕິດຕັ້ງຕົວຄວບຄຸມຢູ່ເທິງວົງຈອນນັ້ນ.
1:52 ນະໂຍບາຍ, ໂຄງການ Python ຕົວຈິງ, ຕັດສິນໃຈ ວ່າຈະຂະຫຍາຍກິ່ງງ່າໃດຂອງຕົ້ນໄມ້ຄົ້ນຫາ, ຈຳນວນເທົ່າໃດຂະໜານກັນ, ແລະເວລາໃດທີ່ຈະຍອມແພ້. Gemini ຂຽນລະຫັດຜູ້ສະໝັກ, ແລະຜູ້ປະເມີນທີ່ຖືກກຳນົດໄວ້ໃຫ້ຄະແນນມັນ. ທຸກໆການດຳເນີນການປ່ອຍໃຫ້ມີຕົ້ນໄມ້ຂອງສິ່ງທີ່ໄດ້ລອງ ແລະຄະແນນຂອງມັນ. ຕົ້ນໄມ້ນັ້ນກາຍເປັນເຄື່ອງຈຳລອງການຫຼິ້ນຄືນ: Gemini ທີສອງ, ທີ່ຖືກຢຸດໄວ້ເຊັ່ນດຽວກັນ, ຂຽນຄືນ ນະໂຍບາຍ, ແລະນະໂຍບາຍໃໝ່ຖືກທົດສອບກັບຜົນໄດ້ຮັບທີ່ຖືກບັນທຶກໄວ້ ແທນທີ່ຈະ ຢູ່ໃນ GPUs ຕົວຈິງ.
2:16 ເອກະສານນີ້ເອີ້ນວ່າການຝັນ, ແລະການດຳເນີນການຕົວຈິງໜຶ່ງຄັ້ງຈ່າຍຄ່າການຝັນເປັນພັນໆຄັ້ງ ໂດຍບໍ່ມີຄ່າໃຊ້ຈ່າຍໃນການປະຕິບັດ. ຜູ້ຊະນະກັບຄືນອອນລາຍ, ສະນ້ຳຂອງໂລກທີ່ຖືກບັນທຶກໄວ້ເຕີບໃຫຍ່, ຊ້ຳອີກ. ແລະຄຳສັ່ງໃນພາກຂະຫຍາຍ B.2 ບອກ AI ທີ່ປັບປຸງຕົນເອງ, ເປັນລາຍລັກອັກສອນ: ແກ້ໄຂໄຟລ໌ນີ້ພຽງອັນດຽວ, ແລະຢ່າແກ້ໄຂວຽກວິທະຍາສາດ. ວັດແທກແລ້ວ. ໃນວຽກງານແກ້ໄຂ Lasso, ການສຳຫຼວດແບບຄົງທີ່ໃຊ້ການຮຽກໃຊ້ Gemini 550 ຄັ້ງເພື່ອ ບັນລຸສາມຈຸດຫົກວິນາທີ, Dream-RSI ໃຊ້ 317 ຄັ້ງເພື່ອບັນລຸສອງຈຸດເກົ້າ, ແລະທັງສອງເອົາຊະນະ scikit-learn.
2:46 ໃນ KernelBench ມັນບັນລຸຄວາມໄວ kernel ດຽວກັນດ້ວຍປະມານສອງຈຸດສີ່ເທົ່າ ການສ້າງໜ້ອຍລົງ. ແລະໃນການຈັດວົງມົນມັນໄດ້ຄະແນນສອງຈຸດຫົກສາມຫ້າເກົ້າ ແປດສາມ, ເຊິ່ງແມ່ນແທ້ໆ, ເຖິງຫົກຕົວເລກທົດສະນິຍົມ, ສິ່ງທີ່ AlphaEvolve ລຸ້ນສອງ ໄດ້ຄະແນນເມື່ອປີກາຍ. ດັ່ງນັ້ນ X ອ່ານຫົວຂໍ້: Google ຫາກໍພົບວິທີການປັບປຸງຕົນເອງແບບ recursive. Hacker News ອ່ານ PDF: ການເອີ້ນສິ່ງນີ້ວ່າ RSI ເບິ່ງຄືວ່າເຂົ້າໃຈຜິດ. ແລະໃນອາທິດດຽວກັນ CEO ຂອງຄູ່ແຂ່ງກ່າວວ່າວົງຈອນນີ້ໄດ້ດຳເນີນມາຕັ້ງແຕ່ລະດູຮ້ອນ ແລະທຸກຄົນຄວນຊະລໍລົງ.
3:13 ສາມປະໂຫຍກ, ສອງຄຳດຽວກັນ, ສາມເຄື່ອງຈັກທີ່ແຕກຕ່າງກັນ. ດັ່ງນັ້ນ, ວັນຈັນ, ວິທີການອ່ານເອກະສານ RSI ຕໍ່ໄປ. ໜຶ່ງ: ຖາມວ່າວັດຖຸໃດປ່ຽນແປງ, ນ້ຳໜັກ, ລະຫັດ, ຫຼືການຕັ້ງຄ່າການຄົ້ນຫາ; Dream-RSI ປ່ຽນແປງອັນທີສາມ. ສອງ: ຖາມວ່າໃຜຖືກຢຸດ; ຢູ່ທີ່ນີ້ແມ່ນຜູ້ຂຽນໂຄງການ, ຜູ້ພິພາກສາ ແລະ ຜູ້ຂຽນຄືນໃໝ່, ທັງສາມ. ສາມ: ຖາມວ່າຕົວເລກຫົວຂໍ້ແມ່ນຫົວໜ່ວຍຂອງຫຍັງ. ການຄຳນວນທີ່ປະຢັດໄດ້ແມ່ນການເພີ່ມປະສິດທິພາບ; ມາດຕະຖານທີ່ຮູບແບບບໍ່ສາມາດບັນລຸໄດ້ມາກ່ອນແມ່ນ ການເພີ່ມຂຶ້ນ, ແລະຍັງບໍ່ມີໃຜເຜີຍແຜ່ອັນນັ້ນເທື່ອ.
3:40 ຄຳຕັດສິນ, ພາຍໃນ: ຕ້ອງການການທົບທວນ. ວົງຈອນແມ່ນຂອງແທ້, ການປະຢັດໄດ້ຖືກວັດແທກ, ແລະສອງຄຳຢູ່ໜ້າປົກ ອະທິບາຍເຄື່ອງຈັກທີ່ບໍ່ມີຢູ່ໃນເອກະສານ. ຖ້າທ່ານຕ້ອງການອ່ານສິ່ງນີ້ຫຼາຍກວ່າທີ່ຈະໄດ້ຍິນຂ້ອຍເວົ້າ, The Daily Diff ຈະສົ່ງໄປຫາອີເມລຂອງທ່ານ ທຸກໆເຊົ້າ, ຟຣີທີ່ thedailydiff.dev, ລິ້ງຢູ່ລຸ່ມນີ້. ບອກຂ້ອຍວ່າຈະເປີດຫຍັງຕໍ່ໄປໃນຄຳເຫັນ. ແລະນັ້ນຄື diff ສໍາລັບມື້ນີ້. ຂ້ອຍ Niko ຈາກ Axrisi.
4:00 ລວມເຂົ້າກັນຢ່າງມີຄວາມຮັບຜິດຊອບ.
ແຫຼ່ງຂໍ້ມູນ
- Paper: Dream-RSI (Zheng et al., Google / Google DeepMind / UMD / UVA, 14 Sep 2026)arxiv.org
- Code (293 stars, no license) — https://github.com/zhengkid/Dream-RSI · project pagedream-rsi.com
- Hacker News thread (169 points)news.ycombinator.com
- Hugging Face papers (278 upvotes)huggingface.co
- I. J. Good, 1965, "Speculations Concerning the First Ultraintelligent Machine"en.wikipedia.org
- Eliezer Yudkowsky, "Recursive Self-Improvement", LessWrong, 1 Dec 2008www.lesswrong.com
- Google DeepMind, AlphaEvolve (14 May 2025): 0.7% compute, 48 multiplications, 23% kernel speed-updeepmind.google
- Dario Amodei, "We Must Pace the Frontier" (12 Sep 2026)darioamodei.com
- Tweetx.com



