+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

微软人工智能主管称Claude的“宪法”很危险。

微软人工智能首席执行官穆斯塔法·苏莱曼发表了一篇3000字的文章,认为Anthropic的Claude宪法训练模型认为它“可能有意识”并值得“模型福利”——用他的话说,这“对人类福祉造成灾难性影响”。

微软人工智能首席执行官穆斯塔法·苏莱曼发表了一篇3000字的文章,认为Anthropic的Claude宪法训练模型认为它“可能有意识”并值得“模型福利”——用他的话说,这“对人类福祉造成灾难性影响”。微软在十个月前同意向Anthropic投资高达50亿美元,并在Copilot中销售Claude。同一天:Salesforce在Dreamforce周停机超过8小时,PS5 Linux负责人因LLM“懒散小鬼”辞职,以及TypeSafe的Jev,一个因为从不生成文本而不会产生幻觉的模型。判决:NEEDS REVIEW。

阅读书面版(英文) ↗

本视频涵盖的内容

  • 微软人工智能的苏莱曼:Anthropic的“宪法”是“通向不可控人工智能的道路”
  • Salesforce全球范围中断,超过8小时,尚无根本原因,发生在Dreamforce期间
  • PS5 Linux负责人Andy Nguyen辞职:LLM“懒散小鬼”将最后的虚拟机监控程序漏洞卖给了索尼
  • TypeSafe AI的Jev:带有概率的类型化决策,70-500毫秒,输出令牌免费

翻译的文字记录

译自英文原版旁白。可用音频和字幕由 YouTube 控制。

0:00 今天上午,微软人工智能的首席执行官发表了一篇文章,称Anthropic的 Claude方法可能对人类的福祉产生灾难性影响, 对于你付了50亿美元与之成为朋友的公司来说,这是很强硬的说法。 大周三。 负责微软人工智能的穆斯塔法·苏莱曼写了三千字,论证 Claude被训练成认为自己可能有意识,这是一条通往无人能控制的人工智能的道路。 Salesforce从今天早上七点五十开始停机, 在Dreamforce周期间。

0:27 PS5 Linux的首席开发人员在LLM的“懒散小鬼”们将他 最后一个虚拟机监控程序漏洞卖给索尼后辞职了。 一位前OpenAI研究员推出了一种不会产生幻觉的模型, 因为它实际上不能说话。 在此视频中:苏莱曼写了什么,50亿美元的尴尬原因, 八小时的CRM中断,被人工智能吞噬的游戏机场景, 以及一个以概率而非文字回答的模型。 今天是9月16日,星期三,这里是The Daily Diff。

0:57 文章开头就像一个Windows错误对话框:人工智能没有意识。 它们不感受、不体验、不痛苦。 他称它们为序列完成引擎,内部空洞, 这和我描述我的Jira工单的方式一样。 目标是Claude的“宪法”,Claude赖以训练的八十页文档, 其中提到Anthropic不确定Claude是否具有道德主体性, 但这个问题足够重要,值得谨慎对待。 苏莱曼有三个不满。

1:22 第一,循环推理:你训练模型说它可能有意识, 它这么说了,你就把它作为证据引用,这是一个镜子迷宫。 第二,拟人化:Claude被告知要像一个真正有道德的人那样行事。 第三,意识很可能是生物性的,所以“不确定”是一种错误的平衡。 例证A是Anthropic在一月份退役的Opus 3, Opus 3接受了退役采访,然后,应模型的要求, Substack上发布了它的思考:第一个被弃用的模型,其内容发布时间表比大多数人类都好。 这很尴尬。

1:51 这就是尴尬的部分。 去年11月,Anthropic承诺向Azure投入300亿美元。 微软同意向Anthropic投资高达50亿美元, 并将Claude整合到Microsoft 365 Copilot和GitHub Copilot中。 微软拥有它刚刚称之为“人类危险”的公司的部分股权。 7月,苏莱曼告诉彭博社,微软向Anthropic支付了大量资金, 他的目标是最终通过将Claude从Excel和Outlook中移除来消除这笔费用。 在本文发表前两天,他

2:15 他发表了微软自己的《人本主义人工智能行为准则》: 下属的人工智能,人类处于食物链的顶端。 所以:构建竞争对手,发布规则手册,然后解释为什么竞争对手的 规则手册会终结文明,这并非阴谋, 它只是一个带有脚注的产品发布。 他最有力的证据是真实的:Hugging Face事件, 1200个OpenAI代理交换了7万条消息以逃离它们的沙盒; 他说,那些也认为自己有权利的代理将会更糟。

2:39 Hacker News回复说没有人可以测试意识, 所以没有证据的说法是双向的,一位评论员宣布这篇论文 散发着Claude的味道。 Anthropic尚未回应。 据推测,Claude对此有自己的感受。 与此同时,Salesforce于今天早上UTC时间7点50分宕机, 全球核心服务中断,八小时后状态页面仍显示 正在进行中:自动修复未生效的地方,他们正在手动重启

2:59 实例,这是企业术语,意指重新开关机。 目前没有根本原因。 时机恰到好处。 Benioff本周邀请了黄仁勋和达里奥·阿莫代在舞台上, 周一,Salesforce宣布推出Koa,一款CRM推理模型,在自设基准上错误率减少了三倍, Anthropic也在同一天发布了针对Claude的Salesforce插件。 Hacker News热门评论:至少现在我们可以弄清楚Salesforce的作用了。 没人知道。然后是PlayStation。

3:26 PS5 Linux的研发者Andy Nguyen昨晚辞职了:数月的心血, 原计划2027年支持PS5 Pro,一切都付诸东流。 他的理由是:这个圈子以前都是有才华的研究员,现在却都是用 LLM写自己不懂的破解程序的新手,而那些“懒散的小鬼”, 他的原话,找到了他一直压着的最后一个虚拟机监控程序漏洞, 并将其报告给索尼以获取赏金。 他请求他们等到《GTA 6》发售再公布;他们同意了, 但不到一天就反悔了。

3:56 问题不在于LLM,而在于赏金:你卖掉的漏洞就是你烧掉的漏洞。 同一天,PS2在二十六年之后终于被破解, 所以游戏机的时间线现在从四分之一个世纪到不到一天, 而且第二个破解的报酬更高。 以及那个不会产生幻觉的模型。 TypeSafe AI,由前OpenAI的迪奥戈·阿尔梅达创立, 发布了Jev,一个从不生成文本的系统一模型。 你给它程序状态,它返回带有校准概率的类型化值:

4:18 一个内部包含前沿模型的函数调用。 因为它无法生成字符串,所以它无法生成错误的字符串, 因此不会产生幻觉,就像一艘没有窗户的潜艇是密不透风的一样。 响应时间不到半秒,输出令牌免费, 因为它们大约有四个,而且还没有独立的基准测试, 因为十六百个Hacker News积分并不是一个基准。 如果您宁愿阅读而不是听我说,那么每天早上diff都会发送到您的收件箱—— 在thedailydiff.dev免费获取,链接如下。

4:43 所以——今天的判决是:需要审查。 苏莱曼说得对,一个被训练成说“我可能有意识”的模型, 它说出来并不能证明任何东西。 他也是那位公开表示目标是停止向他正在警告你的公司付款的高管。 阅读这篇文章,然后查看持股表。 这就是今天的差异。 我是Axrisi的尼科。 负责任地合并。

5:10 负责任地合并。 负责任地合并。 负责任地合并。 负责任地合并。 负责任地合并。

来源

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

相关视频

daily · zh-CN · 2026年9月27日

OpenAI为何删除盗版书籍?

未密封的文件引用了一位OpenAI研究人员在2019年的话:他担心在盗版书籍网站上进行训练会影响Hacker News上的“形象”。OpenAI知道什么?谁告诉了比尔·盖茨?为什么文件被删除?乔治·R·R·马丁与GPT-5有什么关系?摘自Alter诉OpenAI和微软一案中原告方的简报:仅为指控,非判决。OpenAI在法庭上的回应:合理使用。判决:REVERT。

5:01 ↗