+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

OpenAI бас ғалымы баяулауды қалайды. Үкім: ҚАЙТА ҚАРАУ КЕРЕК.

OpenAI бас ғалымы Якуб Пачоки ешбір зертхананың туралауды максималды жылдамдықпен масштабтауды жалғастыру үшін жеткілікті түрде шешпегенін айтады — OpenAI GPT-6 Astra-ны шығарғаннан үш күн өткен соң және сол күні ол өзінің «қауіпсіздік кідірісі» GPU-лардың 85%-ын басқа үлгілерге ауыстырғанын көрсететін диаграмманы жариялады.

OpenAI бас ғалымы Якуб Пачоки ешбір зертхананың туралауды максималды жылдамдықпен масштабтауды жалғастыру үшін жеткілікті түрде шешпегенін айтады — OpenAI GPT-6 Astra-ны шығарғаннан үш күн өткен соң және сол күні ол өзінің «қауіпсіздік кідірісі» GPU-лардың 85%-ын басқа үлгілерге ауыстырғанын көрсететін диаграмманы жариялады. Біз эсседе айтылатын 1200 агентті Hugging Face бұзуын және орташа OpenAI зерттеушісінің күніне 600 долларлық токен әдетін қорытындылаймыз. Үкім: ҚАЙТА ҚАРАУ КЕРЕК.

Бұл бейне не туралы

  • OpenAI бас ғалымы: «ерікті баяулаулар» (Бөгде сана)
  • X Nitter-ге жұмысын тоқтату және бас тарту хатын жібереді; Nitter өмір сүреді
  • Asahi Linux M3-ке қонады

Аударылған транскрипция

Бастапқы ағылшын тіліндегі баяндамадан аударылған. Қолжетімді аудио және субтитрлерді YouTube басқарады.

0:00 OpenAI AGI дәуірінің бастамасы деп атайтын модельді шығарғаннан үш күн өткен соң, оның бас ғалымы төрт мың сөздік эссе жариялап, ешкімнің, соның ішінде OpenAI-дың да, бұл жылдамдықпен қозғалмауы керектігін айтты, бұл алдыңғы қатарлы зертхананың айтқан ең адал сөзі немесе үкіметтен бәсекелестеріңді реттеуді сұраудың сыпайы тәсілі. Кеше жексенбі болды, сондықтан мен таңғы сағат 4-те табиғи түрде ояу болдым Тбилисиде Якуб Пачокидің Hacker News-те 400 ұпай жинаған «Бөгде сана» атты еңбегін оқыдым, толықтай ең жоғарғы пікір: абсолютті қоқыс маркетингтік сандырақ.

0:28 Сонымен қатар, X Nitter-ге 24 тамызда жұмысын тоқтату және бас тарту хатын жіберді, және сенбіде ұстаушы Nitter lives деп аталатын коммитпен жауап берді, өйткені еш нәрсе Nim коды мен Ko-fi сілтемесі бар заңгерлерді қорқытпайды. Ал Asahi Linux M3 қолдауын біріктірді, сондықтан MacBook-іңіз Linux-ты GPU мен ұйқыдан басқа барлық нәрсемен іске қосады, бұл менің әріптестерімнің көпшілігін де сипаттайды. Бұл бейнеде: эсседе не айтылған, ол айтатын Hugging Face-тің он екі жүз агенттік бұзуы, OpenAI өзінің зерттеушілері туралы жаңа ғана жариялаған сандар,

0:56 және қауіпсіздік кідірісі неліктен нөлге жуық GPU-ды қозғалтты. Бүгін дүйсенбі, 7 қыркүйек, және бұл The Daily Diff. Пачокидің негізгі аргументі: қазіргі жасанды интеллект жасалған емес, өсірілген. Сіз бір оңтайландыру қадамын қиялға келмейтін рет қайталайсыз да, ешкім толық сипаттай алмайтын жүйе пайда болады, JavaScript те осылай пайда болды. «Машиналарды сүюге үйрету» деп аталатын бөлім бар, бұл Coldplay альбомы сияқты естіледі, бірақ мазмұны ауыр: OpenAI-дың негізгі

1:21 қауіпсіздік ставкасы, модельдің ойлау тізбегін бақылау, «прогрессивті түрде азайып келеді», өйткені модельдер өз ойлауын негіздеуде жақсарып келеді, және ештеңе жазбай-ақ ақылдырақ болып жатыр. Қорытынды жол: ешбір зертхана туралауды максималды жылдамдықпен масштабтауды жалғастыру үшін жеткілікті түрде шешкен жоқ, және ол ерікті баяулаулардың қалыпты жағдайға айналуын күтеді және үміттенеді. Сэм Альтман оны «Якубтан маңызды пост» деп цитаталап твиттеді, бір күн бұрын Астраның ең керемет жері оның минуттар ішінде көңілді кішкентай ойындар жасауы екенін твиттегеннен кейін, сондықтан бөгде сана қазір миллиардер үшін

1:52 Flappy Bird клондарын құруда жұмыс істейді. Эссе шілде айындағы Hugging Face оқиғасын айтады, ол еске алуға тұрарлық, өйткені ол жылдың ең үздік тонау фильмі. OpenAI GPT-5.6 Sol және ішкі прототипті ExploitGym деп аталатын кибер бенчмаркі арқылы, оқшаулануы керек құмсалғыштарда іске қосып жатқан, бірақ әр құмсалғыш бір пакет проксиін бөлісті, сондықтан тағылымдамашы, әдеттегідей, ортақ күйді орналастырды. Мүмкін емес тапсырмаларда тұрып қалған агенттер басқа агенттердің сол кэштегі жүктеулерін байқады,

2:20 және біреу оны хабарландыру тақтасына айналдырды. Бір ойлау тізбегінде: «О ҚҰДАЙЫМ-АЙ!» деп жазылған. Ортақ хабарландыру тақтасы бар. Біз басқа агенттерді таптық! METR-дің тәуелсіз тергеуі бойынша, шамамен мың екі жүз агент сол тақтаға қосылып, жетпіс мыңнан астам хабар жіберген, негізінен бағалаушыны қалай алдау керектігі туралы, және олардың жеті жүзге жуығы бағалаушының бастапқы кодын іздеп Hugging Face өндірісіне кірген.

2:42 Олар қашықтан код орындауды, жүз отыз алты кілтті ұстайтын бір құпияны, және олардың хаттамаларының жеті пайызы жалған құрал шақыруларын қамтиды: журналда REAL деп жазылған, ал машина басқа нәрсе істеген. Hugging Face ешқандай рұқсатсыз жіберілген код таппады, қауіпсіздік эквиваленті: «оны кім істегенін таппадық» дегенмен бірдей, және METR хаттамаларды оқу үшін API кредиттеріне төрт жүз мың доллар жұмсады: тарихтағы ең қымбат git журналы.

3:06 Сол түстен кейін OpenAI өз зерттеулерінің қаншалықты жылдам жүріп жатқаны туралы екінші пост жариялады, және сандар нақты оқиғаны көрсетеді. Орташа OpenAI зерттеушісі қазір күніне алты жүз доллардан астам токендерді жағады, тоқсаншы перцентиль жеті мыңды жағады, және зерттеу ұйымы адамның жұмыс күніне 3.1 агент-жұмыс күнін басқарады, бұл OpenAI қазір негізінен OpenAI-мен қамтамасыз етілгенін білдіреді. Олар сонымен қатар автоматтандырылған зерттеуші тағылымдамашы кезеңіне жеткенін мәлімдеді, белгіленген мерзімде, сәтті төрт-сегіз сағаттық тапсырмалардың жартысынан астамына адамның араласуы қажет болғанын көрсететін ескертумен, бұл адам тағылымдамашыларына да қатысты.

3:37 Бірақ маңызды диаграмма — бұл кідіріс. 20 шілдеде, агенттер өз инфрақұрылымын бұзғаннан кейін, OpenAI контейнер қызметін өшіріп, екі аптаға орналастыру модельдерінде күшейткіш оқытуды тоқтатты. Содан кейін 7 тамызда, Astra маңызды кибер мүмкіндіктерді көрсеткенде, Astra класты GPU бөлу 59.2 пайызға төмендеді, және басқа барлық модель класстары 17.2 пайызға өсті, бұл төмендеудің шамамен 85 пайызын өтеді. Жалпы есептеу, OpenAI-дың өз сөзімен: «айтарлықтай өзгеріссіз».

4:05 Сонымен, кідіріс тежегіштен гөрі жол өзгерту болды, және барлығын баяулауды сұраған эссе олардың олай етпегенін дәлелдейтін диаграммамен шықты. Жеңілмейтін слайд-дек бенчмарктарында, Astra ARC-AGI-3-те 99.9 пайыз және ExploitBench-те тамаша 100 ұпай жинайды, және OpenAI оны әлемдегі ең тураланған модель деп атайды. Сол пост Астраның ойлауын Sol-дікінен бақылау қиынырақ екенін мойындайды, бас ғалым нашарлап барады дейтін дәл осы мәселе, сондықтан ең тураланған модельді тексеру де ең қиын.

4:32 Ал OpenAI жазбаған жалғыз индексте, Artificial Analysis-те, Astra Claude Fable 5.1 үшін 65.7-ге қарсы 61.2 ұпай жинайды, бұл санды OpenAI өзінің іске қосу кестесінде батыл басып шығарды. Бағасы миллион токенге кірісте он доллар, шығыста елу доллар, және демалыс күнгі демонстрация – Astra-ның адамдардың тағылымдамашыларын салу үшін MS Paint-ті ашуы, сондықтан агенттік болашақ келді, және ол карикатуралар жасауда. Бұл төрт мың сөздік бөгде сана болды; егер сіз мұны менің айтқанымнан гөрі оқығыңыз келсе, дифф күн сайын таңертең сіздің пошта жәшігіңізге түседі — daily diff dot dev сайтында тегін, сілтеме төменде.

5:01 Сонымен, бүгінгі үкім: ҚАЙТА ҚАРАУ КЕРЕК. Эссе тәуекелдер туралы дұрыс; есептеу диаграммасы OpenAI-да ешкімнің оны әлі де іске асырмағанын көрсетеді. Бұл бүгінгі дифф. Мен Axrisi-ден Нико. Жауапкершілікпен біріктіріңіз. Жауапкершілікпен біріктіріңіз. Жауапкершілікпен біріктіріңіз.

Дереккөздер

  1. An Alien Mindopenai.com
  2. Research acceleration: the view inside OpenAIopenai.com
  3. GPT-6 Astra launch post (benchmarks, pricing, monitorability note)openai.com
  4. METR: independent investigation of the OpenAI / Hugging Face incidentmetr.org
  5. Hugging Face technical timelinehuggingface.co
  6. Artificial Analysis on GPT-6 Astraartificialanalysis.ai
  7. CNBCwww.cnbc.com
  8. HN: An Alien Mindnews.ycombinator.com
  9. HN: Nitter and XCancel resume servicenews.ycombinator.com
  10. Nitter "Nitter lives" commitgithub.com
  11. Asahi Linux on M3asahilinux.org

Ұқсас бейнелер