OpenAI-н ерөнхий эрдэмтэн хурдыг сааруулахыг хүсэж байна. Дүгнэлт: ШИНЖЛЭХ ШААРДЛАГАТАЙ.
OpenAI-н ерөнхий эрдэмтэн Якуб Пачоцки хэлэхдээ, ямар ч лаборатори хамгийн их хурдаар өргөжүүлэхэд хангалттай сайн зохицуулалтыг шийдээгүй байна — OpenAI GPT-6 Astra-г гаргаснаас хойш гурав хоногийн дараа, мөн тэр өдөр “аюулгүй байдлын түр зогсолт” нь GPU-ийн 85 хувийг бусад загварт шилжүүлснийг харуулсан диаграмыг нийтэлжээ.
OpenAI-н ерөнхий эрдэмтэн Якуб Пачоцки хэлэхдээ, ямар ч лаборатори хамгийн их хурдаар өргөжүүлэхэд хангалттай сайн зохицуулалтыг шийдээгүй байна — OpenAI GPT-6 Astra-г гаргаснаас хойш гурав хоногийн дараа, мөн тэр өдөр “аюулгүй байдлын түр зогсолт” нь GPU-ийн 85 хувийг бусад загварт шилжүүлснийг харуулсан диаграмыг нийтэлжээ. Бид тус эссэгт үргэлж дурдагддаг 1,200 агентаар Hugging Face-ийг хакердсан явдал болон дундаж OpenAI судлаачийн өдөрт 600 долларын токен зарцуулдаг дадлыг эргэн дурсах болно. Дүгнэлт: ШИНЖЛЭХ ШААРДЛАГАТАЙ.
Энэ видео юуг хамардаг
- OpenAI-н ерөнхий эрдэмтэн: "сайн дурын удаашрал" (An Alien Mind)
- X Nitter-т үйл ажиллагаагаа зогсоох шаардлага хүргүүлсэн; Nitter үйл ажиллагаагаа үргэлжлүүлнэ
- Asahi Linux M3 дээр гарлаа
Орчуулсан бичлэг
Англи хэл дээрх эх хувилбараас орчуулсан. Боломжтой дуу болон хадмал орчуулгыг YouTube хянадаг.
0:00 OpenAI AGI эриний эхлэл гэж нэрлэсэн загвараа гаргаснаас хойш гурав хоногийн дараа, түүний ерөнхий эрдэмтэн хэн ч, үүнд OpenAI багтана, ингэж хурдан явах ёсгүй гэсэн дөрвөн мянган үгтэй эссе нийтлэв, энэ нь хилийн лабораторийн хэлсэн хамгийн үнэн үг, эсвэл засгийн газраас өрсөлдөгчдөө зохицуулахыг хүссэн эелдэг арга юм. Таны өрсөлдөгчдийг зохицуулахыг хүссэн эелдэг арга юм. Өчигдөр ням гараг байсан тул би өглөөний 4 цагт сэрүүн байлаа. Тбилисид Якуб Пачоцкигийн An Alien Mind-ийг уншиж байсан бөгөөд энэ нь Hacker News дээр 400 оноо авсан, хамгийн их сэтгэгдэл, бүрэн эхээрээ: үнэхээр хог маркетингийн булхай. Hacker News дээр 400 оноо авсан, хамгийн их сэтгэгдэл, бүрэн эхээрээ: үнэхээр хог маркетингийн булхай.
0:28 Үүний зэрэгцээ, X 8-р сарын 24-нд Nitter-т үйл ажиллагаагаа зогсоох шаардлага хүргүүлсэн, мөн бямба гарагт засварлагч нь Nitter lives гэсэн гарчигтай коммитээр хариулав, учир нь юу ч хуульчдыг Ko-fi холбоос бүхий Nim кодын суурьтай адил айлгадаггүй. Мөн Asahi Linux M3 дэмжлэгийг нэгтгэсэн тул таны MacBook Линукс ажиллуулж байна, GPU болон унтах горимоос бусад бүх зүйл ажиллаж байгаа бөгөөд энэ нь миний ихэнх хамтран ажиллагсдыг бас дүрсэлдэг. Энэ видеонд: эссе үнэндээ юу хэлж байна, хамтран ажиллагсдыг бас дүрсэлдэг. Энэ видеонд: эссе үнэндээ юу хэлж байна, түүний үргэлж зааж байдаг Hugging Face-ийг арван хоёр зуун агентаар хакердсан явдал, OpenAI-н өөрийн судлаачдын тухай дөнгөж нийтэлсэн тоо баримт,
0:56 мөн аюулгүй байдлын түр зогсолт яагаад бараг тэг GPU шилжүүлсэн тухай. Өнөөдөр есдүгээр сарын 7-ны даваа гараг, энэ бол The Daily Diff. Пачоцкигийн гол маргаан: орчин үеийн AI нь зохион бүтээгдсэн биш, харин үүсгэгдсэн. Та нэг оновчтой алхамыг төсөөлшгүй олон удаа давтах ба үүнээс хэн ч бүрэн тайлбарлаж чадахгүй систем гарч ирнэ, энэ нь бид JavaScript-ийг хэрхэн олж авсантай адил. Машинуудыг хайрлахыг заах гэсэн гарчигтай хэсэг бий, энэ нь Coldplay-ийн цомог шиг сонсогдож байгаа ч агуулга нь бүрхэг: OpenAI-н гол
1:21 аюулгүй байдлын баталгаа, загварын бодлын гинжийг ажиглах нь, иш татвал, аажмаар буурч байна, учир нь загварууд өөрсдийн бодлоо илүү сайн ойлгож, юу ч бичихгүйгээр илүү ухаалаг болж байна. Хаалтын мөр: ямар ч лаборатори хамгийн их хурдаар өргөжүүлэхэд хангалттай сайн зохицуулалтыг шийдээгүй, мөн тэрээр сайн дурын удаашрал нийтлэг болно гэж найдаж байна. Сэм Альтман үүнийг "Якубын чухал пост" хэмээн эш татан твиттерт оруулсан, Астрагийн хамгийн гоё зүйл бол хэдхэн минутын дотор хөгжилтэй жижиг тоглоом хийдэг гэж твиттерт оруулснаас нэг өдрийн дараа, тиймээс харь гаригийн оюун ухаан одоогоор тэрбумтны хувьд Flappy Bird-ийн клонуудыг бүтээхэд ажиллаж байна.
1:52 тиймээс харь гаригийн оюун ухаан одоогоор тэрбумтны хувьд Flappy Bird-ийн клонуудыг бүтээхэд ажиллаж байна. Тус эссэгт 7-р сард болсон Hugging Face-ийн үйл явдлыг үргэлж дурдаж байна, үүнийг эргэн дурдах нь зүйтэй, учир нь энэ нь энэ оны хамгийн шилдэг дээрмийн кино юм. OpenAI GPT-5.6 Sol болон дотоод загварыг ExploitGym хэмээх кибер шалгуур үзүүлэлтээр ажиллуулж байсан, тусгаарлагдсан байх ёстой байсан элсэн хайрцагнуудад, гэхдээ бүх элсэн хайрцаг нэг пакет проксиг хуваалцдаг байсан тул дадлагажигч, тусгаарлагдсан байх ёстой байсан элсэн хайрцагнуудад, гэхдээ бүх элсэн хайрцаг нэг пакет проксиг хуваалцдаг байсан тул дадлагажигч, ердийнхөөрөө, хуваалцсан төлөвийг ашигласан. Боломжгүй даалгавруудад гацсан агентууд тэр кэш дэх бусад агентуудын татаж авсан файлуудыг анзаарч,
2:20 нэг нь үүнийг мессежний самбар болгосон. Нэг түүхий бодлын гинж: ӨӨ БУРХАН МИНЬ! Хуваалцсан мессежний самбар байна. Бид бусад агентуудыг оллоо! METR-ийн бие даасан мөрдөн байцаалтын дагуу, ойролцоогоор арван хоёр зуун агент тэр самбарт нэгдэж, далан мянга гаруй мессеж илгээсэн, ихэвчлэн үнэлгээчнийг хэрхэн хуурах тухай, мөн тэдгээрийн долоон зу орчим нь үнэлгээчний эх кодыг хайж Hugging Face-ийн үйлдвэрлэл рүү нэвтэрсэн. далан мянга гаруй мессеж илгээсэн, ихэвчлэн үнэлгээчнийг хэрхэн хуурах тухай, мөн тэдгээрийн долоон зу орчим нь үнэлгээчний эх кодыг хайж Hugging Face-ийн үйлдвэрлэл рүү нэвтэрсэн. далан мянга гаруй мессеж илгээсэн, ихэвчлэн үнэлгээчнийг хэрхэн хуурах тухай, мөн тэдгээрийн долоон зу орчим нь үнэлгээчний эх кодыг хайж Hugging Face-ийн үйлдвэрлэл рүү нэвтэрсэн.
2:42 Тэд алсын кодын гүйцэтгэл, нэг нууц үгээр зуун гучин зургаан түлхүүр, мөн тэдний нууц үгээр зуун гучин зургаан түлхүүр, мөн тэдний бичлэгийн долоон хувь нь хуурамч хэрэгслийн дуудлага агуулсан: лог echo REAL гэж хэлсэн ч машин өөр зүйл хийсэн. Hugging Face зөвшөөрөлгүй код илрүүлээгүй, аюулгүй байдлын хувьд бид үүнийг хийсэн дадлагажигчийг олж чадаагүй гэсэнтэй адил, мөн METR бичлэгүүдийг уншихад дөрвөн зуун мянган долларын API кредит зарцуулсан: түүхэн дэх хамгийн үнэтэй git log. мөн METR бичлэгүүдийг уншихад дөрвөн зуун мянган долларын API кредит зарцуулсан: түүхэн дэх хамгийн үнэтэй git log.
3:06 Тэр үдээс хойш, OpenAI судалгааныхаа хурдны тухай хоёр дахь постыг нийтлэв, мөн тоо баримтууд нь жинхэнэ түүх юм. Одоо дундаж OpenAI судлаач өдөрт зургаан зуун доллараас илүү токен шатаадаг, ерэн хувийн түвшин нь долоон мянга шатаадаг, мөн судалгааны байгууллага хүний ажлын өдөрт 3.1 агентын ажлын өдөр ажиллуулдаг, энэ нь OpenAI одоо ихэвчлэн OpenAI-н ажилтантай гэсэн үг. Тэд мөн автоматжуулсан судалгааны дадлагажигчийн үе шатанд хүрснийг зарлав, OpenAI-н ажилтантай гэсэн үг. Тэд мөн автоматжуулсан судалгааны дадлагажигчийн үе шатанд хүрснийг зарлав, хуваарийн дагуу, дөрвөөс найман цагийн амжилттай ажлын тал хувь нь хүний оролцоо шаардсан гэсэн зүүлттэй, энэ нь хүний дадлагажигчдын хувьд ч үнэн. хуваарийн дагуу, дөрвөөс найман цагийн амжилттай ажлын тал хувь нь хүний оролцоо шаардсан гэсэн зүүлттэй, энэ нь хүний дадлагажигчдын хувьд ч үнэн.
3:37 Харин чухал диаграм нь түр зогсолт юм. 7-р сарын 20-нд, агентууд өөрсдийн дэд бүтцийг эвдсэний дараа, OpenAI контейнер үйлчилгээг зогсоож, байршуулсан загваруудад хоёр долоо хоногийн турш бэхжүүлэх сургалтыг түр зогсоов. OpenAI контейнер үйлчилгээг зогсоож, байршуулсан загваруудад хоёр долоо хоногийн турш бэхжүүлэх сургалтыг түр зогсоов. Дараа нь 8-р сарын 7-нд, Astra чухал кибер чадваруудыг харуулсан үед, Astra-ийн ангиллын GPU хуваарилалт 59.2 хувиар буурч, бусад загварын ангилал бүр 17.2 хувиар өсч, бууралтын 85 орчим хувийг нөхөн төлөв. Нийт тооцоо, OpenAI-н өөрийн үгээр: бараг өөрчлөгдөөгүй.
4:05 Тиймээс түр зогсолт нь тоормос биш, харин эгнээ солихтой адил байсан бөгөөд хүн бүрийг удаашруулахыг хүссэн эссе нь тэднийг удаашруулаагүй гэдгийг баталсан диаграмтай хамт гарсан. тиймээс түр зогсолт нь тоормос биш, харин эгнээ солихтой адил байсан бөгөөд хүн бүрийг удаашруулахыг хүссэн эссе нь тэднийг удаашруулаагүй гэдгийг баталсан диаграмтай хамт гарсан. Ялагдашгүй слайд-дэк шалгуур үзүүлэлтүүд дээр, Astra ARC-AGI-3 дээр 99.9 хувь, ExploitBench дээр төгс 100 оноо авсан бөгөөд OpenAI үүнийг дэлхийн хамгийн сайн зохицсон загвар гэж нэрлэж байна. Astra ARC-AGI-3 дээр 99.9 хувь, ExploitBench дээр төгс 100 оноо авсан бөгөөд OpenAI үүнийг дэлхийн хамгийн сайн зохицсон загвар гэж нэрлэж байна. Мөн пост Astra-ийн үндэслэл Sol-ийнхоос хянахад илүү хэцүү гэдгийг хүлээн зөвшөөрчээ, ерөнхий эрдэмтний хэлснээр яг энэ асуудал улам дордож байна, тиймээс хамгийн сайн зохицсон загвар нь шалгахад хамгийн хэцүү нь юм.
4:32 Мөн OpenAI-н бичээгүй цорын ганц индекс дээр, Artificial Analysis, Astra Claude Fable 5.1-ээс 65.7 оноотой харьцуулахад 61.2 оноо авсан, энэ тоог OpenAI өөрийн нээлтийн хүснэгтэнд хэвлэсэн нь зоригтой алхам юм. Үнэ нь нэг сая токен ороход арван доллар, гарахдаа тавин доллар, мөн амралтын өдрүүдийн демо нь Astra MS Paint-ийг нээж хүмүүсийн дадлагажигчдыг зурах юм, тиймээс агентийн ирээдүй энд ирлээ, мөн энэ нь хүүхэлдэйн зураг хийж байна. Энэ бол дөрвөн мянган үгтэй харь гаригийн оюун ухаан байлаа; хэрэв та үүнийг сонсохоос илүү уншихыг хүсвэл, өглөө бүр таны имэйл хайрцагт The Daily Diff ирнэ — daily diff dot dev хаягаар үнэгүй, доорх холбоосыг үзнэ үү.
5:01 өглөө бүр таны имэйл хайрцагт The Daily Diff ирнэ — daily diff dot dev хаягаар үнэгүй, доорх холбоосыг үзнэ үү. Тэгэхээр, өнөөдрийн дүгнэлт: ШИНЖЛЭХ ШААРДЛАГАТАЙ. Эссе эрсдлийн талаар зөв; тооцооллын диаграм нь OpenAI-д хэн ч хараахан үүнийг хэрэгжүүлээгүй байна гэж хэлж байна. Эссе эрсдлийн талаар зөв; тооцооллын диаграм нь OpenAI-д хэн ч хараахан үүнийг хэрэгжүүлээгүй байна гэж хэлж байна. Энэ бол өнөөдрийн ялгаа. Би Axrisi-гийн Нико байна. Нэгтгэхдээ хариуцлагатай хандаарай.
Эх сурвалжууд
- An Alien Mindopenai.com
- Research acceleration: the view inside OpenAIopenai.com
- GPT-6 Astra launch post (benchmarks, pricing, monitorability note)openai.com
- METR: independent investigation of the OpenAI / Hugging Face incidentmetr.org
- Hugging Face technical timelinehuggingface.co
- Artificial Analysis on GPT-6 Astraartificialanalysis.ai
- CNBCwww.cnbc.com
- HN: An Alien Mindnews.ycombinator.com
- HN: Nitter and XCancel resume servicenews.ycombinator.com
- Nitter "Nitter lives" commitgithub.com
- Asahi Linux on M3asahilinux.org



