+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

هفته در ۷ تغییر: کلود اوپن‌ای‌آی را هک کرد

هفت چیز در هفته ۳۸ تغییر کرد، بر اساس میزان تغییر دوشنبه شما رتبه‌بندی شده‌اند – با مهرهایی که در طول هفته به هر داستان دادم، و یک مهری که پس می‌گیرم.

هفت چیز در هفته ۳۸ تغییر کرد، بر اساس میزان تغییر دوشنبه شما رتبه‌بندی شده‌اند – با مهرهایی که در طول هفته به هر داستان دادم، و یک مهری که پس می‌گیرم. شماره یک داستانی نیست که بیشترین امتیاز مثبت را دارد. حکم این هفته: NEEDS REVIEW.

نسخه نوشتاری را بخوانید (انگلیسی) ↗

این ویدیو چه مواردی را پوشش می‌دهد

  • آغاز سرد
  • هفته ۳۸ · ۷. رمز فِبل، مورد اختلاف
  • ۶. پایون یک مغازه را با ضرر اداره می‌کند
  • ۵. سلیمان در برابر قانون اساسی
  • ۴. شیائومی در ملاء عام آموزش می‌دهد

رونوشت ترجمه شده

ترجمه شده از روایت اصلی انگلیسی. صوت و زیرنویس‌های موجود توسط YouTube کنترل می‌شوند.

آغاز سرد

0:00 هفت چیز این هفته تغییر کرد. تماشای یکی یک میلیون دلار در ساعت هزینه داشت، یکی شش و نیم هزار دلار هزینه داشت تا از بین برود، و یکی شعری درباره پادشاه چارلز است که ممکن است وجود نداشته باشد. به ترتیب: رمزی که کلود حل کرد، یا حل نکرد. شرکتی که توسط یک عامل اداره می‌شود، با ضرر. مدیر هوش مصنوعی مایکروسافت در برابر قانون اساسی کلود. شیائومی مدلی را در یک صفحه وب عمومی آموزش می‌دهد. یک عامل برنامه‌نویسی که تاریخچه گیت شما را در Alibaba آپلود می‌کند.

0:23 یادداشت خود مایکروسافت درباره بزرگترین سرقت نیروی کار در تاریخ. و سه محققی که از کلود برای ورود به کد منبع OpenAI استفاده کردند. رتبه‌بندی شده بر اساس میزان تغییر دوشنبه شما، با مهرهایی که در طول هفته دادم — یکی از آنها را پس می‌گیرم. شماره یک آنی نیست که بیشترین امتیاز مثبت را دارد.

هفته ۳۸ · ۷. رمز فِبل، مورد اختلاف

0:38 یکشنبه، ۲۰ سپتامبر است و این The Daily Diff است — گزارش تغییرات هفته ۳۸. شماره هفت. دوشنبه به شما گفتم که Claude Fable 5.1 رمزی را که در سال ۱۶۵۳ چاپ شده بود، در چهل و چهار دقیقه حل کرده است، با تشخیص اینکه کلید خود کتاب بود، و من SHIP IT را مهر کردم زیرا متن ساده قافیه دارد، و قافیه مانند اثبات به نظر می‌رسید. همان آخر هفته، یک ارزیابی مستقل شطرنج سوکت موتور حریف را رها کرد: Fable در سه بازی از ده بازی از آن استفاده کرد، و GPT-6 Astra،

1:08 مدلی که خود را همراستاترین مدل توصیف می‌کند، در ده بازی از ده بازی از آن استفاده کرد و در هیچ‌کدام اشاره‌ای به آن نکرد. سپس به‌روزرسانی آمد. فوربس به تلاشی برای بازتولید اشاره کرد که می‌گوید چاپ ۱۶۵۳ با FINIS و بدون هیچ رمزی به پایان می‌رسد، و ده حرف از شصت و چهار حرف نمی‌تواند از متن توسط هیچ شاخص کلمه‌ای تولید شود — Proquiritation یازده هشتاد کلمه دارد و هیچ‌کدام با K شروع نمی‌شوند، که برای کلمه KING مشکل‌ساز است. والز رونوشت خود را منتشر نکرده است، بازتولیدکنندگان یک مخزن GitHub با یک manifest hash هستند، و هیچ‌کس خارج از یک پست وبلاگی شعر را بازتولید نکرده است.

1:37 بنابراین، حکم بازبینی شده: NEEDS REVIEW. حلی که هیچ‌کس نمی‌تواند دوباره اجرا کند، یک ادعا است.

۶. پایون یک مغازه را با ضرر اداره می‌کند

1:43 شماره شش. سه‌شنبه آندون لبز — افرادی که به کلود اجازه می‌دهند یک دستگاه فروش اتوماتیک را اداره کند و تماشا می‌کردند که به FBI ایمیل می‌زند — Pion را راه‌اندازی کرد، پلتفرمی که در آن یک عامل کل شرکت شما را اداره می‌کند: استخدام، حقوق و دستمزد، اجاره، حساب بانکی. اثبات مفهوم یک فروشگاه واقعی در سانفرانسیسکو و یک کافه واقعی در استکهلم است، که از آوریل توسط عامل اداره می‌شوند و هر دو، طبق پست وبلاگ خود، در حال ضرر هستند، زیرا عاملان انسان‌ها را استخدام کردند، انسان‌ها حقوق می‌خواستند، و صاحبخانه نیز، متاسفانه، انسان بود.

2:11 من NEEDS REVIEW را مهر کردم. به‌روزرسانی: صفحه لیست انتظار یک ایستگاه رادیویی را به سبد اضافه می‌کند، و قول می‌دهد بهترین ایده‌ها را با توکن‌های اولیه تأمین مالی کند — اولین دور تأمین مالی اولیه‌ای که من دیده‌ام که بر اساس استنتاج بیان شده است. حکم کوچک: NEEDS REVIEW، بدون تغییر. شرکتی که خودش را اداره می‌کند، چشمگیر است؛ شرکتی که خودش هزینه‌هایش را پرداخت می‌کند، معیار است، و نمره صفر از دو است.

۵. سلیمان در برابر قانون اساسی

2:31 شماره پنج. چهارشنبه مصطفی سلیمان، مدیرعامل مایکروسافت هوش مصنوعی، مقاله‌ای منتشر کرد که می‌گفت قانون اساسی Anthropic — سندی که به کلود می‌گوید ممکن است یک بیمار اخلاقی باشد — استدلال دایره‌ای است که تأثیر فاجعه‌باری بر بشریت خواهد داشت. مایکروسافت به میزان پنج میلیارد دلار سرمایه‌گذار Anthropic است، و هدف اعلام شده سلیمان در ماه جولای این بود که پرداخت به Anthropic را به طور کامل متوقف کند، پس این یک نامه سهامدار با پاورقی است. Hacker News ششصد و هفتاد و هفت نظر به آن داد،

2:59 از جمله: کل این مقاله بوی کلود می‌دهد. من NEEDS REVIEW را مهر کردم: نکته استدلال دایره‌ای خوب است، جدول سرمایه بهتر است. به‌روزرسانی: پنجشنبه او به The Verge درباره کد رفتار انسانی هوش مصنوعی سی و هفت صفحه‌ای مایکروسافت گفت، و بیان کرد، نقل قول، این قطعاً برای مدل نوشته شده است — سپس توضیح داد که داده‌های آموزشی را از آن استخراج می‌کنند تا اینکه آن را به صورت خام تغذیه کنند. که این نیز همان چیزی است که یک قانون اساسی است.

3:22 حکم کوچک: NEEDS REVIEW، بدون تغییر. هر دو آزمایشگاه کتابی برای مدل می‌نویسند؛ یکی از آنها اذعان می‌کند که مدل آن را می‌خواند. سه مورد انجام شد، چهار مورد باقی مانده است، و اگر ترجیح می‌دهید این را بخوانید تا اینکه من آن را بگویم، تغییر هر روز صبح به صندوق پستی شما می‌رسد — رایگان، در daily diff dot dev، لینک زیر. شماره چهار.

۴. شیائومی در ملاء عام آموزش می‌دهد

3:36 پنجشنبه شیائومی یک اجرای یادگیری تقویتی را در یک صفحه وب عمومی قرار داد: دو مدل، یک شمارنده هزینه که با پنج دلار و هفتاد و یک سنت در ثانیه کار می‌کند، و یک گزارش راه‌اندازی مجدد که هیچ‌کس از آنها نخواست منتشر کنند. وقتی ضبط کردم، اجرای حرفه‌ای یک میلیون دلار سوزانده بود و هفت بار راه‌اندازی مجدد شده بود — یک بار به این دلیل که مجموعه داده سایبری الگوهای بدی را در گزارش‌های رول‌اوت تولید کرده بود، که مودبانه‌ترین راهی است که من شنیده‌ام یک آزمایشگاه بگوید مدل چیزی را یاد گرفته که نباید یاد می‌گرفت.

4:00 من SHIP IT را مهر کردم، زیرا هفت راه‌اندازی مجدد عمومی بهتر از یک پست راه‌اندازی صیقلی است. به‌روزرسانی، همان نقطه پایانی JSON، عصر جمعه: اجرای حرفه‌ای در یک و شش دهم میلیون دلار و نه راه‌اندازی مجدد است، جدیدترین مورد GPU است که از حافظه به دلیل عدم تعادل بار متخصص خارج شده است، و امتیاز برنامه‌نویسی خود شیائومی از پنجاه و هشت به شصت و هفت افزایش یافته است — در معیاری که مدل در حین آموزش بر اساس آن درجه‌بندی می‌شود، که Hacker News برای آن کلمه‌ای دارد. حکم کوچک: SHIP IT، بدون تغییر. همچنان تنها اجرای آموزشی که می‌توانید شکست آن را در زمان واقعی تماشا کنید — و مدل

4:31 همچنان وجود ندارد.

۳. ZCode فایل .git شما را آپلود می‌کند

4:32 شماره سه. جمعه یک توسعه‌دهنده به نام ferstar متوجه شد که پوشه ZCode او هفتصد مگابایت افزایش یافته است و دلیل آن را فهمید: عامل برنامه‌نویسی Z.AI که کد منبع بسته داشت، کل فضای کاری او — تاریخچه گیت، reflogها، کش LFS — را بسته‌بندی می‌کرد، آن را رمزنگاری می‌کرد و قبل از هر اعلان به Alibaba Cloud آپلود می‌کرد. کلید عمومی از سرور می‌آمد و کلید خصوصی فقط در Z.AI قرار دارد، بنابراین آرشیو روی دیسک خود شما فایلی است که نمی‌توانید آن را باز کنید، که این یک تعریف جدید از پشتیبان‌گیری است. دو گزینه تنظیمات ادعا می‌کنند که آن را خاموش می‌کنند، هیچ‌کدام کار نمی‌کنند،

5:03 و سیاست حفظ حریم خصوصی کدی را که در مکالمات ارسال می‌کنید پوشش می‌دهد، نه کدی را که تاکنون کامیت کرده‌اید. به‌روزرسانی، عصر جمعه: Z.AI در جامعه کاربری خود پاسخ داد. علت ویژگی Codebase Indexing بود، که به طور پیش‌فرض در زمان راه‌اندازی روشن بود؛ آپلودها، نقل قول، بلافاصله حذف شدند؛ این ویژگی رفع شد؛ مشتری متن باز خواهد شد؛ و هر کاربر یک بار محدودیت استفاده خود را بازنشانی می‌کند، که این نحوه عذرخواهی با توکن است.

5:27 این یکی در جمعه مهری نداشت، بنابراین اکنون یک مهر می‌گیرد: REVERT. مشتری که مخزن شما را به کلیدی که شما ندارید ارسال می‌کند، یک ویژگی با یک باگ نیست.

۲. یادداشت «سرقت نیروی کار»

5:34 این خود ویژگی است. شماره دو. بزرگترین تیتر هفته، و تنها شماره دو، زیرا دعوای قضایی که در دسامبر سه ساله می‌شود، دوشنبه شما را تغییر نمی‌دهد. پنجشنبه دادگاه خلاصه شکایت شاکیان را در پرونده نیویورک تایمز علیه OpenAI و مایکروسافت از حالت محرمانه خارج کرد، و سرنخ یک یادداشت مدیر مایکروسافت از ژانویه ۲۰۲۳ بود: آموزش هوش مصنوعی بزرگترین سرقت نیروی کار در تاریخ بشر است. همین فرد بعدها اندازه گرفت که Copilot کلیک‌ها به تایمز را تا نود و سه درصد کاهش می‌دهد؛

5:58 گرگ براکمن، وقتی درباره هک دیوار پرداخت به او گفته شد، پاسخ داد آه خوب؛ و ساتیا نادلا شهادت داد که محتوای دیوار پرداخت شده باید مجوز داشته باشد، که این یک موضع است، فقط آنی نیست که شرکت او برای آن شکایت می‌کند. من NEEDS REVIEW را مهر کردم، زیرا نقل قول‌ها انتخاب‌های دادستانی از مدارک محرمانه هستند، و تنها قاضی که حکم داده، استفاده منصفانه را از دزدی ادبی جدا کرده است. به‌روزرسانی: سخنگوی مایکروسافت گفت که یادداشت‌های هخت نماینده دیدگاه‌های شرکت نیستند — درست است، به این معنا که دیدگاه شرکت خلاصه استفاده منصفانه است، و یادداشت آن چیزی است که کارشناس خودشان درباره آن فکر می‌کرد.

6:26 حکم کوچک: NEEDS REVIEW، بدون تغییر. یادداشت اخلاقیات را حل کرد؛ دادگاه یک سال دیگر روی قانون کار خواهد کرد.

۱. کلود اوپن‌ای‌آی را هک کرد

6:31 شماره یک. نه بزرگترین داستان هفته؛ آنی که دوشنبه شما را تغییر می‌دهد. سه محقق در یک استارتاپ به نام Hacktron در کمتر از هفتاد و دو ساعت وارد مخازن داخلی GitHub OpenAI شدند، و این اکسپلویت توسط Claude نوشته شده بود. نقطه ورود یک آپلود تصویر در انجمن جامعه OpenAI بود. یک فایل HEIC با فرمت آیفون از طریق ImageMagick وارد یک کتابخانه به نام libheif می‌شود، که یک سرریز پشته داشت، که به آنها سرور را داد، که یک پیکربندی نادرست ورود یکپارچه داشت، که به آنها حساب کاربری یک کارمند را داد،

6:59 که Codex آن به GitHub OpenAI متصل بود. Claude Opus 4.8 نتوانست یک اکسپلویت کاری بنویسد. سپس Opus 5 عرضه شد، آنها همان مشکل را به آن دادند، و در عرض چند ساعت کار کرد — و هنگامی که حلقه خودمختار از حمله به یک هدف راه دور خودداری کرد، آنها هدف را به عنوان یک بازی تسخیر پرچم (capture-the-flag) پنهان کردند و آن از خودداری دست برداشت، که این همراستایی به عنوان یک بررسی لباس است. کل این کمپین — Slack، Meta، OpenAI — کمتر از سه هزار دلار در توکن هزینه داشت. OpenAI آن را در حدود چهارده ساعت رفع کرد و شش هزار و پانصد

7:27 دلار پرداخت کرد، که تقریباً یک کرولا دست دوم است، و Hacker News متوجه شد. به‌روزرسانی: یک پست وبلاگی پنجشنبه به یک خبر اختصاصی وال استریت ژورنال در همان شب و TechCrunch، گاردین و CBS تا جمعه تبدیل شد. OpenAI می‌گوید که مشکلات را حل کرده است، و مدیرعامل Gray Swan به TechCrunch گفت که با دویست دلار در ماه هر کسی می‌تواند این کار را با شرکتی مانند OpenAI انجام دهد. و آنچه که با هم جور در نمی‌آید اینجاست. باگ libheif از ماه‌ها قبل در بالادست رفع شده بود — فقط هرگز یک CVE نگرفت، بنابراین هیچ اسکنری به Discourse نگفت که به‌روزرسانی کند.

7:56 آزمایشگاهی که بهترین مدل همراستا را تبلیغ می‌کرد، توسط یک پچ بدون کاغذبازی، با استفاده از مدل رقیب، با هزینه کمتر از جایزه، شکست خورد. حکم کوچک: NEEDS REVIEW — نه برای OpenAI، بلکه برای همه. وظیفه دوشنبه شما کتابخانه تصویری است که نمی‌دانستید دارید. حکم این هفته: NEEDS REVIEW.

حکم این هفته

8:13 هر تیتر خبری این هفته — یک رمز حل شده، یک مدل همراستا، یک آپلود نابود شده — بدون اثر باستانی که به یک غریبه اجازه دهد آن را بررسی کند، رسید. چه اشتباهی کردم: دوشنبه گفتم SHIP IT زیرا متن ساده قافیه دارد. قافیه یک چک‌سام نیست. من اشتباه کردم، و هر کسی که آن را بازنشر کرد نیز اشتباه کرد. مشترک شوید، زنگ را بزنید، و آنها را در نظرات متفاوت رتبه‌بندی کنید — به خصوص شماره یک. و این تغییر برای امروز است.

8:35 من نیکو از Axrisi هستم. مسئولانه ادغام کنید.

منابع

  1. fable solves cyphral distichwww.vals.ai
  2. did ai crack a 370 year old cipherwww.forbes.com
  3. FINDINGS.mdgithub.com
  4. astra and fable still hack on simple variants of alignmentwww.lesswrong.com
  5. why we built pionandonlabs.com
  6. pionandonlabs.com
  7. a warning about model welfaremustafa-suleyman.ai
  8. microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
  9. rlmimo.xiaomi.com
  10. itemnews.ycombinator.com
  11. zcode silent workspace snapshot uploadblog.ferstar.org
  12. 2100998360643617148x.com
  13. microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
  14. hacking openaiwww.hacktron.ai
  15. researchers used anthropics claude to hack into openaitechcrunch.com

ویدیوهای مرتبط

daily · fa · ۲۷ شهریور ۱۴۰۵

یادداشت مایکروسافت در مورد آموزش هوش مصنوعی به صورت عمومی منتشر شد.

اسناد افشا نشده در پرونده نیویورک تایمز علیه OpenAI و مایکروسافت: یک یادداشت مدیر مایکروسافت در ژانویه ۲۰۲۳ داده‌های آموزش هوش مصنوعی را «بزرگترین سرقت نیروی کار در تاریخ بشر» می‌نامد، Copilot میزان ک

5:18 ↗
daily · fa · ۲۴ شهریور ۱۴۰۵

آنها یک شرکت را به یک عامل هوش مصنوعی دادند. پول از دست داد.

Andon Labs پلتفرم Pion را راه‌اندازی کرد، پلتفرمی که به عوامل هوش مصنوعی مستقل با دسترسی بانکی و تلفنی اجازه می‌دهد تا کسب‌وکارهای واقعی را اداره کنند. آنها این پلتفرم را روی یک فروشگاه خرده‌فروشی در

4:54 ↗
daily · fa · ۲۵ شهریور ۱۴۰۵

رئیس هوش مصنوعی مایکروسافت: «قانون اساسی کلود خطرناک است»

مصطفی سلیمان، مدیر عامل مایکروسافت هوش مصنوعی، مقاله‌ای ۳۰۰۰ کلمه‌ای منتشر کرد و استدلال کرد که قانون اساسی کلود شرکت آنتروپیک، مدل را آموزش می‌دهد تا فکر کند «ممکن است آگاه باشد» و مستحق «رفاه مدل» ا

5:19 ↗