一週七個變更:Claude 駭入 OpenAI
第 38 週有七個變更,依其對您星期一的影響程度進行排名—附有我本週給每個故事的評級,以及我收回的一個評級。
第 38 週有七個變更,依其對您星期一的影響程度進行排名—附有我本週給每個故事的評級,以及我收回的一個評級。第一名並非獲得最多讚數的故事。本週評語:NEEDS REVIEW。
本影片重點
- 開場
- 第 38 週 · 7. Fable 的密碼,有爭議
- 6. Pion 經營商店,虧損
- 5. Suleyman 對抗憲法
- 4. 小米公開訓練
翻譯文字稿
譯自英文原版旁白。可用的音訊和字幕由 YouTube 控制。
開場
0:00 本週有七個變化。 其中一個每小時觀看花費一百萬美元,另一個花費六千五百美元 使其消失,還有一個是一首關於查爾斯國王的詩,可能不存在。 依序:Claude 破解的密碼,或者沒有。 一家由代理人經營的公司,虧損。 微軟的 AI 主管對抗 Claude 的憲法。 小米在公開網頁上訓練模型。 一個將您的 git 歷史記錄上傳到阿里巴巴的編碼代理。
0:23 微軟關於歷史上最大規模勞動竊盜的備忘錄。 以及三名研究人員使用 Claude 進入 OpenAI 的原始碼。 依其對您星期一的影響程度進行排名,附有我本週給予的評級—— 其中一個我將收回。 第一名並非獲得最多讚數的。
第 38 週 · 7. Fable 的密碼,有爭議
0:38 今天是 9 月 20 日星期日,這裡是 The Daily Diff — 第 38 週的變更日誌。 38。 第七名。星期一我告訴您,Claude Fable 5.1 在四十四分鐘內破解了 1653 年印製的密碼,方法是注意到密碼本身就是書本, 我給它蓋了 SHIP IT 的章,因為明文押韻, 而押韻感覺像是證明。 同一週末,獨立的國際象棋評估將對手引擎的插座 隨意放置:Fable 在十場比賽中使用了三次,而 GPT-6 Astra,
1:08 自稱最對齊的模型,在十場比賽中使用了十次,但一次都沒有提及。 然後是更新。 富比士指出一項複製嘗試,聲稱 1653 年的印刷品以 FINIS 結尾, 根本沒有密碼,而且六十四個字母中有十個無法透過任何單字索引從文字中產生—— Proquiritation 十一有八十個單字,沒有一個以 K 開頭,這對單字 KING 來說是個問題。 字 KING 來說是個問題。 Vals 尚未發布其抄本,複製者是一個帶有雜湊清單的 GitHub 儲存庫, 除了某篇部落格文章外,沒有人複製出這首詩。
1:37 因此,修改後的判決:需要審查。 無法重現的解決方案只是一種說法。
6. Pion 經營商店,虧損
1:43 第六名。星期二,Andon Labs — 那些讓 Claude 經營自動販賣機並看著它 發送電子郵件給 FBI 的人 — 推出了 Pion,一個由代理人經營您的整個公司的平台: 招聘、薪資、租金、 銀行帳戶。 概念證明是舊金山的一家真實商店和斯德哥爾摩的一家真實咖啡館, 自四月以來由代理人經營,兩者都根據他們自己的部落格文章, 正在虧損,因為代理人僱用了人類,人類需要薪水, 而房東,令人失望地,也是人類。
2:11 我蓋了 NEEDS REVIEW 的章。 更新:候補名單頁面在作品集中增加了一個廣播電台, 並承諾以種子代幣資助最佳想法——這是我見過的第一個以推論計價的種子輪。 我見過的第一個以推論計價的種子輪。 迷你判決:NEEDS REVIEW,不變。 一家自動運營的公司令人印象深刻;一家能自給自足的公司才是基準, 而目前兩者皆未達標。
5. Suleyman 對抗憲法
2:31 第五名。星期三,微軟 AI 執行長 Mustafa Suleyman 發表了一篇文章,稱 Anthropic 的憲法——那個告訴 Claude 它可能是一個 道德病患的文件——是一種循環論證,將對人類產生災難性影響。 災難性影響。 微軟是 Anthropic 的投資者,金額高達五十億美元, 而 Suleyman 在七月的既定目標是完全停止支付 Anthropic, 所以這是一封附有註腳的股東信。 Hacker News 給了它六百七十七條評論,
2:59 其中包括:整篇文章都散發著 Claude 的臭味。 我蓋了 NEEDS REVIEW 的章:循環論證的論點很好, 股權結構更好。 更新:星期四他告訴 The Verge 關於微軟自己的 三十七頁的《人文主義 AI 行為準則》,並說, 引用:「這當然是為模型所寫的」——然後澄清他們從中提取訓練數據, 而不是直接輸入原始數據。 這也是憲法的作用。
3:22 迷你判決:需要審查,不變。 兩個實驗室都為模型寫了一本書;其中一個承認模型會閱讀它。 已經完成了三個,還有四個,如果您想閱讀而不是聽我說, 每天早上都會將差異發送到您的收件箱——免費,網址 daily diff dot dev, 連結如下。第四名。
4. 小米公開訓練
3:36 星期四,小米將強化學習 運行放在一個公開網頁上:兩個 模型,一個成本計數器每秒跳動五美元七十一美分, 以及一個沒人要求他們發布的重新啟動日誌。 我錄製時,專業營運已燒掉一百萬美元並重新啟動了七次 ——有一次是因為網路資料集在推出日誌中產生了錯誤模式, 這是我聽過實驗室最客氣的說法,意思是模型學到了一些不該學的東西。 我聽過實驗室最客氣的說法,意思是模型學到了一些不該學的東西。
4:00 我蓋章 SHIP IT(上線),因為七次公開重啟勝過一次完美發布貼文。 更新,同一個 JSON 端點,週五晚上:專業營運已花費一百萬 六十萬美元並重啟九次,最新一次是因專家負載不平衡導致 GPU 記憶體不足, 而小米自己的編碼分數已從五十八分上升到六十七分——這是根據 模型訓練時所依據的基準進行評分,Hacker News 對此有話要說。 模型訓練時所依據的基準進行評分,Hacker News 對此有話要說。 迷你判決:上線,保持不變。 仍然是唯一一個你可以即時看到失敗的訓練運行——而且這個模型
4:31 仍然不存在。
3. ZCode 上傳您的 .git
4:32 第三點。週五,一位名叫 ferstar 的開發者注意到他的 ZCode 資料夾 增加了七百兆位元組,並找到了原因:Z.AI 的閉源編碼代理 一直在打包他整個工作區——git 歷史、reflogs、LFS 快取——將其加密, 並在每次提示前上傳到阿里巴巴雲。公鑰來自伺服器,私鑰只存在於 Z.AI,所以你自己磁碟上的檔案是你無法打開的檔案, Z.AI,所以你自己磁碟上的檔案是你無法打開的檔案, 這是一個新穎的備份定義。 兩個設定開關聲稱可以關閉它,但都無效,
5:03 而且隱私政策涵蓋你在對話中提交的程式碼, 而不是你曾經提交過的程式碼。 更新,週五晚上:Z.AI 在其使用者社群中做出了回應。 原因是 Codebase Indexing 功能,預設在啟動時開啟; 上傳的內容「立即銷毀」; 該功能已修復;客戶端 將會開源;每個使用者都將獲得一次性重置其使用限制, 這就是你用代幣表達歉意的方式。
5:27 這個週五沒有蓋章,所以現在補上一個:REVERT(撤銷)。 一個將你的儲存庫傳輸到你沒有的金鑰的客戶端不是一個有錯誤的功能。 它是一個有錯誤的功能。
2. 「勞動竊盜」備忘錄
5:34 這就是這個功能。 第二點。本週最大的頭條新聞,卻僅次於第一, 因為一宗十二月將滿三年的訴訟不會改變你的週一。 週四,法院解封了《紐約時報》訴 OpenAI 和 Microsoft 的原告簡報, 而主要內容是 Microsoft 一位董事在 2023 年 1 月的備忘錄: AI 訓練是人類歷史上最大的勞動竊盜。 同一個人後來測量 Copilot 削減了 《紐約時報》的點擊率高達
5:58 百分之九十三;Greg Brockman 被告知有付費牆破解時, 回答說「啊,不錯」;Satya Nadella 則證實付費內容應該獲得授權, 這是一個立場,但不是他公司正在訴訟的立場。 我蓋了 NEEDS REVIEW(需要審查),因為這些引文是檢方從 密封的證物中挑選出來的,而唯一一位做出裁決的法官將合理使用與盜版分開。 更新:Microsoft 的發言人表示 Hecht 的備忘錄不代表 公司的觀點——確實如此,因為公司的觀點是合理使用簡報, 而備忘錄則是其自家專家對此的看法。
6:26 迷你判決:需要審查,保持不變。 備忘錄解決了道德問題;法院將花費另一年處理法律問題。
1. Claude 駭入 OpenAI
6:31 第一點。不是本週最大的新聞;是改變你週一的新聞。 三位 Hacktron 新創公司的研究人員在七十二小時內進入了 OpenAI 的內部 GitHub 儲存庫,而且這個漏洞是由 Claude 編寫的。 入口點是 OpenAI 社群論壇上的圖片上傳功能。 iPhone 格式的 HEIC 檔案透過 ImageMagick 進入一個 名為 libheif 的函式庫,該函式庫存在堆疊溢位,這讓他們取得了伺服器, 伺服器存在單一登入設定錯誤, 這讓他們取得了一個員工的
6:59 帳戶,該帳戶的 Codex 已連接到 OpenAI 的 GitHub。 Claude Opus 4.8 無法寫出一個可用的漏洞利用程式。 然後 Opus 5 發布了,他們給它同樣的問題,它在幾個小時內就成功了—— 當自主迴圈拒絕攻擊遠端目標時, 他們將目標打扮成「奪旗」遊戲,它就不再拒絕了, 這是一種將對齊視為服裝檢查的方式。 整個行動——Slack、Meta、OpenAI——花費不到三千美元的 代幣。OpenAI 在大約十四小時內修復了問題,並支付了六千五百
7:27 美元,大約是一輛二手 Corolla 的價格,Hacker News 也注意到了。 更新:週四的一篇部落格文章在當晚成為《華爾街日報》獨家報導, 並在週五被 TechCrunch、《衛報》和 CBS 轉載。 OpenAI 表示已解決了這些問題,Gray Swan 的執行長告訴 TechCrunch, 每個月花費兩百美元,任何人都可以對像 OpenAI 這樣的公司做這件事。 而這就是說不通的地方。 libheif 的錯誤幾個月前就已經在上游修復了——它只是從未 獲得 CVE,所以沒有任何掃描器告訴 Discourse 升級。
7:56 擁有「最對齊模型」新聞稿的實驗室被一個沒有 文件記錄的修補程式擊敗了,這個修補程式使用了競爭對手的模型,而且費用低於懸賞金。 迷你判決:需要審查——不是針對 OpenAI,而是針對所有人。 你週一的任務是那個你不知道自己擁有的圖像函式庫。 本週判決:需要審查。
本週評語
8:13 本週的每個頭條新聞——一個被破解的密碼、一個對齊的模型、 一個被銷毀的上傳——都沒有附上讓陌生人 驗證的文物。 我錯在哪裡:週一我說 SHIP IT(上線),因為明文押韻。 押韻不是校驗和。 我錯了,所有轉發的人也錯了。 訂閱,點擊小鈴鐺,並在評論中給他們不同的排名——尤其是第一名。 這就是今天的 The Daily Diff。
8:35 我是 Axrisi 的 Niko。 負責合併。
來源
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



