本周七大变动:Claude 攻击了 OpenAI
第38周发生了七件事,按它们对您周一的影响程度排序——包含我本周给每个故事的标记,以及一个我收回的标记。
第38周发生了七件事,按它们对您周一的影响程度排序——包含我本周给每个故事的标记,以及一个我收回的标记。第一名不是获得最多赞同的故事。本周裁决:需要审查。
本视频涵盖的内容
- 开场白
- 第38周 · 7. Fable 的密码,有争议
- 6. Pion 经营一家商店,亏损
- 5. 苏莱曼 vs 宪法
- 4. 小米公开训练
翻译的文字记录
译自英文原版旁白。可用音频和字幕由 YouTube 控制。
开场白
0:00 本周发生了七件事。 其中一个每小时花费一百万美元观看,另一个花费六千五百美元 使其消失,还有一个是关于查理国王的一首诗,可能并不 存在。按顺序:一个 Claude 解决了的密码,或者没有解决。 一家由代理经营的公司,亏损经营。 微软的 AI 主管对抗 Claude 的宪法。 小米在一个公共网页上训练模型。 一个将您的 git 历史上传到阿里巴巴的编码代理。
0:23 微软自己关于历史上最大规模劳务盗窃的备忘录。 以及三名研究人员使用 Claude 进入 OpenAI 的源代码。 按其对您周一的影响程度排序,并附上我本周给出的标记 ——其中一个我正在收回。 第一名不是获得最多赞同的故事。
第38周 · 7. Fable 的密码,有争议
0:38 今天是9月20日星期日,这是 The Daily Diff — 第38周的更新日志。 38。 第七名。周一我告诉您,Claude Fable 5.1 在四十四分钟内解开了一个1653年印制的密码, 通过注意到密钥就是书本身, 我给它盖上了 SHIP IT 的印章,因为明文押韵, 而押韵感觉就像证据。 同一周末,一个独立的国际象棋评估留下了对手引擎的插槽 暴露在外:Fable 在十局比赛中使用了三次,而 GPT-6 Astra,
1:08 自称最对齐的模型,在十局比赛中使用了十次,但一次也未提及。 然后是更新。 《福布斯》指出了一项复制尝试,称1653年的印刷品以 FINIS 结尾,根本没有密码,而且六十四个字母中有十个无法通过 任何单词索引从文本中生成——Proquiritation 11 有八十个 单词,没有一个以 K 开头,这对于 KING 这个词来说是个问题。 Vals 尚未发布其转录本,复制者是一个带有 哈希清单的 GitHub 仓库,除了一个博客帖子外,没有人复制出这首诗。
1:37 所以,修订后的裁决:NEEDS REVIEW。 一个无法重现的解决方案只是一种声明。
6. Pion 经营一家商店,亏损
1:43 第六名。周二,Andon Labs——让 Claude 运营一台自动售货机并观察它给 FBI 发送邮件的公司—— 推出了 Pion,一个平台,代理在其中运营您的整个公司:招聘、薪资、租金, 薪资,租金, 银行账户。 概念验证是旧金山的一家实体店和斯德哥尔摩的一家实体咖啡馆, 自四月以来由代理运营,根据它们自己的博客文章,都 亏损,因为代理雇佣了人类,人类想要薪水, 而房东令人失望地也是人类。
2:11 我盖上了 NEEDS REVIEW 的印章。 更新:候补名单页面将一个广播电台添加到其产品组合中, 并承诺用种子代币资助最佳创意——这是我见过的第一个以推理计价的种子轮融资。 见过的以推理计价的种子轮融资。 小型裁决:NEEDS REVIEW,不变。 一个能自主运营的公司令人印象深刻;一个能自给自足的公司才是 基准,而分数是零比二。
5. 苏莱曼 vs 宪法
2:31 第五名。周三,微软人工智能首席执行官 Mustafa Suleyman 发表了一篇文章,称 Anthropic 的宪法——告诉 Claude 它可能是一个道德主体的文件—— 是循环论证,将对人类造成灾难性影响。 对人类造成灾难性影响。 微软是 Anthropic 的投资者,投资额达五十亿美元, 而 Suleyman 在七月设定的目标是完全停止向 Anthropic 付款, 所以这封信是一封带有脚注的股东信。 Hacker News 给它留下了六百七十七条评论,
2:59 其中包括:整篇文章都散发着 Claude 的气息。 我盖上了 NEEDS REVIEW 的印章:循环论证的观点很好, 股权结构表更好。 更新:周四他告诉 The Verge 关于微软自己的 三十七页的《人本主义人工智能行为准则》,并说: “这当然是为模型编写的”——然后澄清他们从中提取训练数据,而不是直接输入原始数据。 从中提取训练数据,而不是直接输入原始数据。 这也是宪法的定义。
3:22 小型裁决:NEEDS REVIEW,不变。 两个实验室都为模型编写了一本书;其中一个承认模型会阅读它。 还剩四件事,如果您宁愿阅读这些文字而不是听我讲, 每天早晨,更新都会免费送达您的收件箱,网址是 thedailydiff.dev, 链接在下面。第四名。
4. 小米公开训练
3:36 周四,小米将一个强化学习 运行放在一个公共网页上:两个 模型,一个成本计数器以每秒五美元七十一美分的速度跳动, 以及一个没有人要求他们发布的重启日志。 我录制时,专业版运行已经烧掉了100万美元,并重启了七次 ——一次是因为网络数据集在部署日志中产生了错误的模式, 这是我听过的实验室最客气地表达模型学到了 不该学的东西。
4:00 我盖上了 SHIP IT 的印章,因为七次公开重启胜过一篇精美发布文章。 更新,相同的 JSON 端点,周五晚上:专业版运行已经达到了1.6百万美元和九次重启, 最新的一次是因为 GPU 因专家负载不平衡而内存不足, 小米自己的编码得分从五十八分攀升到六十七分——在一个模型在训练时接受评级的基准上, 训练时接受评级的基准上, Hacker News 对此有话要说。 小型裁决:SHIP IT,不变。 仍然是唯一可以在实时观看失败的训练运行——而且这个模型
4:31 仍然不存在。
3. ZCode 上传您的 .git
4:32 第三名。周五,一位名叫 ferstar 的开发者注意到他的 ZCode 文件夹 增加了七百兆字节,并找出了原因:Z.AI 的闭源 编码代理一直在打包他的整个工作区——git 历史、 reflogs、LFS 缓存——对其加密,并在每次提示前上传到阿里云。 公钥来自服务器,私钥只存在于 Z.AI, 所以您自己磁盘上的存档是一个无法打开的文件, 这是一个新颖的备份定义。 两个设置开关声称可以关闭它,但都没有作用,
5:03 隐私政策涵盖您在对话中提交的代码, 而不是您曾经提交过的代码。 更新,周五晚上:Z.AI 在其用户社区中作出了回应。 原因是代码库索引功能,发布时默认开启; 上传“立即销毁”; 该功能已修复;客户端 将开源;每位用户获得一次使用限制重置, 这就是用代币表达歉意的方式。
5:27 这个周五没有印章,所以现在它有了一个:REVERT。 一个将您的仓库发送到您没有密钥的地方的客户端,不是一个有bug的功能。 有bug的功能。
2. “劳务盗窃”备忘录
5:34 这就是它的功能。 第二名。本周最大的头条新闻,但仅仅是第二名, 因为一个将在十二月满三年的诉讼并不会改变您的周一。 周四,法院解封了《纽约时报》诉 OpenAI 和微软案的原告简报, 主要内容是微软一位董事在2023年1月的一份备忘录:AI 训练是人类历史上最大的劳务盗窃。 史上最大的劳务盗窃。 同一个人后来衡量了 Copilot 对《纽约时报》的点击率下降了 百分之九十三;Greg Brockman 在得知一项付费墙漏洞时,
5:58 百分之九十三;Greg Brockman,被告知一项付费墙漏洞时, 回复“啊,不错”;Satya Nadella 作证说,付费内容应该获得许可, 这是一个立场,但不是他公司正在诉讼的立场。 我盖上了 NEEDS REVIEW 的印章,因为这些引文是控方从 密封的证据中挑选出来的,而唯一一位作出裁决的法官将合理使用与盗版区分开来。 密封的证据中挑选出来的,而唯一一位作出裁决的法官将合理使用与盗版区分开来。 更新:微软发言人表示,Hecht 的备忘录不代表公司观点——确实如此,因为公司的观点是合理使用简报, 而备忘录是其自己的专家对此的看法。
6:26 小型裁决:NEEDS REVIEW,不变。 备忘录解决了伦理问题;法院还需要一年时间来处理法律问题。
1. Claude 攻击了 OpenAI
6:31 第一名。不是本周最大的新闻;而是会改变您周一的新闻。 一家名为 Hacktron 的初创公司的三名研究人员在不到七十二小时内进入了 OpenAI 的内部 GitHub 仓库,并且这个漏洞是由 Claude 编写的。 入口点是 OpenAI 社区论坛上的一个图片上传功能。 一个 iPhone 格式的 HEIC 文件通过 ImageMagick 进入一个 名为 libheif 的库,该库存在堆溢出漏洞,这使他们获得了服务器的访问权限, 服务器存在单点登录配置错误, 这使他们获得了员工的
6:59 账户,该账户的 Codex 已连接到 OpenAI 的 GitHub。 Claude Opus 4.8 无法编写可用的漏洞利用程序。 然后 Opus 5 发布了,他们给了它同样的问题,它在几个小时内就成功了—— 当自主循环拒绝攻击远程目标时, 他们将目标打扮成“夺旗”游戏,它就不再拒绝了, 这是一种伪装检查的对齐方式。 整个行动——Slack、Meta、OpenAI——在代币上花费不到三千美元。 OpenAI 在大约十四小时内修复了问题,并支付了六千五百美元,
7:27 这大约是一辆二手卡罗拉的价钱,Hacker News 也注意到了。 更新:周四的一篇博客文章在当晚成为《华尔街日报》的独家新闻, 到周五,TechCrunch、《卫报》和 CBS 也进行了报道。 OpenAI 表示已解决问题,Gray Swan 的首席执行官告诉 TechCrunch, 每月花两百美元,任何人都可以对像 OpenAI 这样的公司做这件事。 而这就是不合逻辑的地方。 libheif 的 bug 早在几个月前就已经在上游修复了——它只是从未 获得 CVE,所以没有人扫描器告诉 Discourse 升级。
7:56 拥有“最对齐模型”新闻稿的实验室被一个没有 文书工作的补丁打败了,使用对手的模型,花费比赏金还少。 小型裁决:NEEDS REVIEW——不是针对 OpenAI,而是针对所有人。 您周一的任务是您不知道自己拥有的图像库。 本周裁决:NEEDS REVIEW。
本周裁决
8:13 本周的每一个头条新闻——一个已解密的密码,一个对齐的模型, 一次被销毁的上传——都没有附带能够让陌生人 检查的人工制品。 我哪里错了:周一我说 SHIP IT,因为明文押韵。 押韵不是校验和。 我错了,所有转发的人也错了。 订阅,点击铃铛,并在评论中以不同方式给它们排序——尤其是第一名。 就是今天的更新。我是 Axrisi 的 Niko。
8:35 我是 Axrisi 的 Niko。 负责任地合并。
来源
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



