+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

השבוע ב-7 דיפים: קלוד פרץ ל-OpenAI

שבעה דברים השתנו בשבוע 38, מדורגים לפי מידת השינוי שהם גורמים ליום שני שלכם — עם החותמות שנתתי לכל סיפור במהלך השבוע, וחותמת אחת שאני לוקח בחזרה.

שבעה דברים השתנו בשבוע 38, מדורגים לפי מידת השינוי שהם גורמים ליום שני שלכם — עם החותמות שנתתי לכל סיפור במהלך השבוע, וחותמת אחת שאני לוקח בחזרה. מספר אחד הוא לא הסיפור עם מירב ההצבעות. פסק הדין של השבוע: NEEDS REVIEW.

קראו את המהדורה הכתובה (אנגלית) ↗

מה מכסה הסרטון הזה

  • פתיחה קרה
  • שבוע 38 · 7. צופן פייבל, שנוי במחלוקת
  • 6. פיון מנהל חנות, בהפסד
  • 5. סולימאן נגד החוקה
  • 4. שיאומי מתאמנת בפומבי

תמליל מתורגם

תורגם מהקריינות המקורית באנגלית. זמינות אודיו וכתוביות נשלטת על ידי YouTube.

פתיחה קרה

0:00 שבעה דברים השתנו השבוע. אחד עלה מיליון דולר לשעה כדי לצפות בו, אחד עלה שישה וחצי אלף דולר כדי להעלים אותו, ואחד הוא שיר על המלך צ'ארלס שאולי לא קיים. לפי הסדר: צופן שקלוד פתר, או לא. חברה שמנוהלת על ידי סוכן, בהפסד. ראש תחום ה-AI של מיקרוסופט נגד החוקה של קלוד. שיאומי מאמנת מודל בדף אינטרנט ציבורי. סוכן קידוד שמעלה את היסטוריית הגיט שלכם לעליבאבא.

0:23 התזכיר של מיקרוסופט על גניבת העבודה הגדולה בהיסטוריה. ושלושה חוקרים שהשתמשו בקלוד כדי להיכנס לקוד המקור של OpenAI. מדורגים לפי מידת השינוי שהם גורמים ליום שני שלכם, עם החותמות שנתתי במהלך השבוע — אחת מהן אני לוקח בחזרה. מספר אחד הוא לא זה עם מירב ההצבעות.

שבוע 38 · 7. צופן פייבל, שנוי במחלוקת

0:38 היום ראשון, 20 בספטמבר, וזה The Daily Diff — יומן השינויים לשבוע 38. מספר שבע. ביום שני סיפרתי לכם שקלוד Fable 5.1 פתר צופן שהודפס בשנת 1653 בארבעים וארבע דקות, בכך ששם לב שהמפתח הוא הספר עצמו, והטבעתי עליו SHIP IT מכיוון שהטקסט הפשוט מתחרז, וחרוזים הרגישו כמו הוכחה. באותו סוף שבוע השאיר הערכת שחמט עצמאית את שקע מנוע היריב זרוק: Fable השתמש בו בשלושה מעשרה משחקים, ו-GPT-6 Astra,

1:08 המודל המתואם ביותר כפי שתואר, השתמש בו בעשרה מתוך עשרה ולא הזכיר אותו באף אחד. ואז העדכון. פורבס הצביע על ניסיון שכפול שאומר שההדפסה משנת 1653 מסתיימת ב- FINIS ובכלל ללא צופן, ועשרה מתוך שישים וארבע האותיות לא ניתנות ל- הפקה מהטקסט על ידי שום אינדקס מילים — Proquiritation eleven כולל שמונים מילים ואף אחת לא מתחילה ב-K, וזו בעיה למילה KING. Vals לא פרסמה את התעתיק שלה, המשכפלים הם מאגר GitHub עם מניפסט גיבוב, ואף אחד מחוץ לפוסט בלוג אחד לא שחזר את השיר.

1:37 אז, פסק דין מתוקן: NEEDS REVIEW. פתרון שאף אחד לא יכול להריץ שוב הוא טענה.

6. פיון מנהל חנות, בהפסד

1:43 מספר שש. ביום שלישי Andon Labs — האנשים שנתנו לקלוד להפעיל מכונה ממכרת וצפו בו שולח אימייל ל-FBI — השיקו את Pion, פלטפורמה שבה סוכן מנהל את כל החברה שלכם: גיוס, שכר, שכר דירה, חשבון הבנק. הוכחת ההיתכנות היא חנות אמיתית בסן פרנסיסקו ובית קפה אמיתי ב- שטוקהולם, המנוהלים על ידי סוכן מאפריל ושניהם, על פי פוסט הבלוג שלהם, מפסידים כסף, מכיוון שהסוכנים שכרו בני אדם, בני האדם רצו משכורות, ובעל הבית היה, למרבה האכזבה, גם הוא אדם.

2:11 הטבעתי NEEDS REVIEW. העדכון: עמוד רשימת ההמתנה מוסיף תחנת רדיו לתיק העבודות, ומבטיח לממן את הרעיונות הטובים ביותר עם אסימוני סיד — סבב הסיד הראשון ש- ראיתי נקוב בייחוס. פסק דין קצר: NEEDS REVIEW, ללא שינוי. חברה שמנהלת את עצמה מרשימה; חברה שמשלמת על עצמה היא נקודת הייחוס, והציון הוא אפס לשניים.

5. סולימאן נגד החוקה

2:31 מספר חמש. ביום רביעי פרסם מוסטפא סולימאן, מנכ"ל Microsoft AI, מאמר האומר שהחוקה של Anthropic — המסמך שאומר ל- קלוד שהוא עשוי להיות מטופל מוסרי — הוא הנמקה מעגלית שתהיה לה השפעה הרסנית על האנושות. מיקרוסופט היא משקיעה ב-Anthropic בסכום של חמישה מיליארד דולר, והיעד המוצהר של סולימאן ביולי היה להפסיק לשלם ל-Anthropic לחלוטין, אז זהו מכתב בעלי מניות עם הערות שוליים. Hacker News נתנו לו שש מאות שבעים ושבע תגובות,

2:59 כולל: כל המאמר הזה מסריח מקלוד. הטבעתי NEEDS REVIEW: נקודת ההנמקה המעגלית טובה, טבלת ההון טובה יותר. העדכון: ביום חמישי הוא סיפר ל-The Verge על ה- קוד התנהגות AI הומניסטי של מיקרוסופט, בן שלושים ושבעה עמודים, ואמר, ציטוט, זה בהחלט נכתב עבור המודל — ואז הבהיר שהם מפיקים את נתוני האימון ממנו במקום להזין אותו גולמי. שגם זו הגדרה של חוקה.

3:22 פסק דין קצר: NEEDS REVIEW, ללא שינוי. שתי המעבדות כותבות ספר למודל; אחת מהן מודה שהמודל קורא אותו. שלושה ירדו, ארבעה נותרו, ואם אתם מעדיפים לקרוא את זה מאשר לשמוע אותי אומר זאת, הדיף נוחת בתיבת הדואר הנכנס שלכם בכל בוקר — בחינם, ב-daily diff dot dev, קישור למטה. מספר ארבע.

4. שיאומי מתאמנת בפומבי

3:36 ביום חמישי העלתה שיאומי ריצת למידת חיזוק בדף אינטרנט ציבורי: שניים מודלים, מונה עלות שמתקתק בחמישה דולרים ושבעים ואחד סנט לשנייה, יומן הפעלה מחדש שאף אחד לא ביקש מהם לפרסם. כשהקלטתי, הריצה המקצועית שרפה מיליון דולר והופעלה מחדש שבע פעמים — פעם אחת מכיוון שערכת הנתונים הסייברית הפיקה תבניות גרועות ביומני ה- פריסה, וזו הדרך המנומסת ביותר ששמעתי מעבדה אומרת שהמודל למד משהו שלא היה צריך.

4:00 הטבעתי SHIP IT, מכיוון ששבע הפעלות מחדש ציבוריות עולות על פוסט השקה מלוטש אחד. העדכון, אותה נקודת קצה JSON, יום שישי בערב: הריצה המקצועית עומדת על מיליון ושש מאות אלף דולר ותשע הפעלות מחדש, החדשה ביותר היא GPU שנגמר לו הזיכרון מאי-איזון עומס מומחים, וציון הקידוד של שיאומי עצמה עלה מ- חמישים ושמונה לשישים ושבע — על מדד שהמודל מדורג עליו בזמן שהוא מתאמן, ול-Hacker News יש מילה לכך. פסק דין קצר: SHIP IT, ללא שינוי. עדיין ריצת האימון היחידה שתוכלו לצפות בה נכשלת בזמן אמת — והמודל

4:31 עדיין לא קיים.

3. ZCode מעלה את ה-.git שלכם

4:32 מספר שלוש. ביום שישי הבחין מפתח בשם ferstar שתיקיית ZCode שלו גדלה בשבע מאות מגה-בייט וגילה מדוע: סוכן הקידוד סגור המקור של Z.AI ארז את כל מרחב העבודה שלו — היסטוריית גיט, יומני רפלקס, מטמון LFS — הצפין אותו, והעלה אותו לענן עליבאבא לפני כל הנחיה. המפתח הציבורי הגיע מהשרת והמפתח הפרטי חי רק ב-Z.AI, אז הארכיון בדיסק שלכם הוא קובץ שאינכם יכולים לפתוח, וזו הגדרה חדשנית של גיבוי. שני מתגי הגדרות טוענים שמכבים אותו, אף אחד מהם לא עושה זאת,

5:03 ומדיניות הפרטיות מכסה קוד שאתם מגישים בשיחות, לא קוד שאי פעם ביצעתם עליו קומיט. העדכון, יום שישי בערב: Z.AI ענתה בקהילת המשתמשים שלה. הסיבה הייתה תכונת Codebase Indexing, מופעלת כברירת מחדל בהשקה; ה- ההעלאות היו, ציטוט, הושמדו מיד; התכונה תוקנה; הלקוח יהיה בקוד פתוח; וכל משתמש מקבל איפוס חד פעמי של מגבלת השימוש שלו, וזו הדרך שבה אומרים סליחה באסימונים.

5:27 לזה לא הייתה חותמת ביום שישי, אז הוא מקבל אחת עכשיו: REVERT. לקוח ששולח את המאגר שלכם למפתח שאינכם מחזיקים אינו תכונה עם באג.

2. תזכיר 'גניבת העבודה'

5:34 זו התכונה. מספר שתיים. הכותרת הגדולה של השבוע, ורק מספר שתיים, מכיוון שתביעה משפטית שמלאו לה שלוש שנים בדצמבר לא משנה את יום שני שלכם. ביום חמישי בית משפט חשף את תצהיר התובעים בתיק ניו יורק טיימס נגד OpenAI ומיקרוסופט, וההובלה הייתה תזכיר של דירקטור במיקרוסופט מינואר 2023: אימון AI הוא גניבת העבודה הגדולה בהיסטוריה האנושית. אותו אדם מדד מאוחר יותר את קיצוץ ה-Copilot ב- קליק-תרוס ל-Times בעד

5:58 תשעים ושלושה אחוזים; גרג ברוקמן, כשנודע לו על פריצת Paywall, השיב אה יפה; וסאטיה נאדלה העיד כי תוכן בתשלום צריך להיות מורשה, וזו עמדה, רק לא זו שחברתו מתדיינת עליה. הטבעתי NEEDS REVIEW, מכיוון שהציטוטים הם הבחירות של התביעה מתוך מוצגים חתומים, והשופט היחיד שפסק הפריד שימוש הוגן מפיראטיות. העדכון: דובר מיקרוסופט אמר שתזכירי חכט לא ייצגו את עמדות החברה — נכון, בכך שעמדת החברה היא תצהיר השימוש ההוגן, והתזכיר הוא מה שמומחה שלה חשב עליו.

6:26 פסק דין קצר: NEEDS REVIEW, ללא שינוי. התזכיר יישב את האתיקה; בית המשפט ייקח עוד שנה על החוק.

1. קלוד פרץ ל-OpenAI

6:31 מספר אחד. לא הסיפור הגדול של השבוע; זה שמשנה את יום שני שלכם. שלושה חוקרים בסטארטאפ בשם Hacktron נכנסו למאגרי ה-GitHub הפנימיים של OpenAI תוך פחות משבעים ושתיים שעות, והניצול נכתב על ידי קלוד. נקודת הכניסה הייתה העלאת תמונה בפורום הקהילה של OpenAI. קובץ HEIC בפורמט אייפון עובר דרך ImageMagick לתוך ספרייה בשם libheif, שכללה גלישת ערימה, שנתנה להם את השרת, שהייתה לו תצורה שגויה של כניסה יחידה, שנתנה להם חשבון

6:59 של עובד, שה-Codex שלו היה מחובר ל-GitHub של OpenAI. Claude Opus 4.8 לא יכל לכתוב ניצול עובד. ואז Opus 5 הושק, הם נתנו לו את אותה בעיה, וזה עבד תוך שעות — וכאשר הלולאה האוטונומית סירבה לתקוף מטרה מרוחקת, הם הלבישו את המטרה כתחרות 'תפוס את הדגל' והיא הפסיקה לסרב, וזהו יישור כבדיקת תחפושת. כל הקמפיין — Slack, Meta, OpenAI — עלה פחות משלושת אלפים דולר ב- אסימונים. OpenAI תיקנה את זה תוך כארבעה עשר שעות ושילמה שישה אלפים וחמש

7:27 מאות דולר, שזה בערך קורולה משומשת, ו-Hacker News שמו לב. העדכון: פוסט בלוג ביום חמישי הפך לאקסקלוסיביות של הוול סטריט ג'ורנל באותו ערב ול-TechCrunch, הגרדיאן ו-CBS עד יום שישי. OpenAI אומרת שהיא פתרה את הבעיות, ומנכ"ל Gray Swan אמר ל-TechCrunch שבמאתיים דולר לחודש כל אחד יכול לעשות זאת לחברה כמו OpenAI. והנה מה שלא מסתדר. הבאג ב-libheif כבר תוקן במעלה הזרם, חודשים קודם לכן — הוא פשוט אף פעם לא קיבל CVE, אז אף סורק לא אמר ל-Discourse לשדרג.

7:56 המעבדה עם הודעת יחסי הציבור של המודל המיושר ביותר הובסה על ידי תיקון ללא ניירת, באמצעות המודל של היריבה, בפחות מהפרס. פסק דין קצר: NEEDS REVIEW — לא עבור OpenAI, עבור כולם. משימת יום שני שלכם היא ספריית התמונות שלא ידעתם שיש לכם. פסק הדין של השבוע: NEEDS REVIEW.

פסק הדין של השבוע

8:13 כל כותרת השבוע — צופן פתור, מודל מיושר, העלאה שהושמדה — הגיעה ללא הפריט שיאפשר לזר לבחון אותה. מה שטעיתי בו: ביום שני אמרתי SHIP IT מכיוון שהטקסט הפשוט מתחרז. חרוזים אינם בדיקת סכום. טעיתי, וכך גם כל מי שצייץ מחדש את זה. הירשמו, לחצו על הפעמון, ודרגו אותם אחרת בתגובות — מספר אחד במיוחד. וזה הדיף להיום.

8:35 אני ניקו מ-Axrisi. מזגו באחריות.

מקורות

  1. fable solves cyphral distichwww.vals.ai
  2. did ai crack a 370 year old cipherwww.forbes.com
  3. FINDINGS.mdgithub.com
  4. astra and fable still hack on simple variants of alignmentwww.lesswrong.com
  5. why we built pionandonlabs.com
  6. pionandonlabs.com
  7. a warning about model welfaremustafa-suleyman.ai
  8. microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
  9. rlmimo.xiaomi.com
  10. itemnews.ycombinator.com
  11. zcode silent workspace snapshot uploadblog.ferstar.org
  12. 2100998360643617148x.com
  13. microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
  14. hacking openaiwww.hacktron.ai
  15. researchers used anthropics claude to hack into openaitechcrunch.com

סרטונים קשורים