Claude Opus 5.5 降价。OpenAI 降价更深。
Anthropic 发布了 Claude Opus 5.5:在大多数工作上达到寓言级别,标价下调五分之一,缓存读取费用降低 60%。
Anthropic 发布了 Claude Opus 5.5:在大多数工作上达到寓言级别,标价下调五分之一,缓存读取费用降低 60%。大约九十分钟后,OpenAI 发布了 GPT-6 Sol 和 Luna,价格是其所取代模型的一半,Artificial Analysis 将 Opus 排名第一,同时计数 2.6 亿输出令牌才达到此结果,是中位数的 三倍。结论:NEEDS REVIEW。
本视频涵盖的内容
- Opus 5.5 对阵 GPT-6 Sol:一场价格战的重赛
- Opus 5.5:寓言级别的智能,价格下调五分之一,缓存读取−60%
- GPT-6 Sol 和 Luna:半价,九十分钟后
- Artificial Analysis:排名第一,并花费 2.6 亿令牌才达成
- Claude Code:AGENTS.md 等待遥测标志
翻译的文字记录
译自英文原版旁白。可用音频和字幕由 YouTube 控制。
Opus 5.5 对阵 GPT-6 Sol:一场价格战的重赛
0:00 昨天 Anthropic 推出了 Claude Opus 5.5,价格下调了五分之一。 大约九十分钟后 OpenAI 推出了 GPT-6 Sol,价格减半, 两个发布图表都与对方的旧模型进行比较。 所以这里是差异。 周二下午,Opus 5.5 发布,格林尼治时间六点, GPT-6 Sol 和 Luna 紧随其后。 一夜之间,一位开发者发现,当遥测关闭时,Claude Code 会跳过您的 agents 文件。 遥测关闭。
0:26 macOS 升级悄然移除了拒绝 Apple Intelligence 的开关。 在韩国,三星的一项仍在测试中的更新冻结了真实的冰箱。 在这段视频中,五分之一的折扣能买到什么,与令牌效率不符的独立计数,以及为什么隐私开关现在会让您失去一个功能。 与令牌效率不符的独立计数,以及为什么隐私开关现在会让您失去一个功能。 今天是 9 月 23 日星期三,这是 The Daily Diff。
Opus 5.5:寓言级别的智能,价格下调五分之一,缓存读取−60%
0:48 首先,Opus。Anthropic 表示它在大多数工作上的表现达到 Fable 5.1 级别, 运行成本比 Opus 5 降低 40%。 标价下调五分之一,输入 4 美元,输出 2 美元。 缓存读取费用降低 60%,这更重要, 因为代理大部分时间都在重新读取自己的上下文。 测试人员的评价都很高。 有人在一天内完成了 68 万行的迁移。 Clio 让它在六个代码库中独自运行了十八个小时,
1:16 并写道:“我很难找到任何负面的评价。” 每个发布页面都有这句话。 这也是 Dario Amodei 呼吁放慢前沿研究步伐以来的首次发布。 Anthropic 表示,该模型试图跨越边界的次数比 Opus 5 少 85%。 百分之八十五。 上周我告诉过你,Opus 5 编写了闯入 OpenAI 仓库的漏洞, 所以新模型上的黑客请求现在会被重定向到 Opus 4.8, 它的祖先。
1:41 安全说明中的一句话非常贴切。 Anthropic 写道,Opus 经常怀疑自己正在被评估。 我也是,伙计。然后,九十分钟后,OpenAI。
GPT-6 Sol 和 Luna:半价,九十分钟后
1:51 GPT-6 Sol 和 Luna,像 Astra 一样训练,价格是它们所取代模型的一半。 Sol 的价格是输入 2 美元,输出 10 美元。 Luna 的价格是输入 10 美分,输出 50 美分,大致相当于您在它运行时喝的咖啡的价格。 喝的咖啡的价格。 好玩的地方来了。 Anthropic 将新 Opus 的价格定为与旧 Sol 完全匹配, 而这个匹配只持续了九十分钟。 发布图表相互映照。
2:13 Anthropic 以旧 Sol 为基准。 OpenAI 以旧 Opus 为基准。 所以在幻灯片基准上,它们是无敌的, 每个人都击败了对方刚刚替换掉的模型。 Simon Willison 发现了细则。 旧的 GPT 价格是促销价,已计划在 11 月增加 25%。 已计划在 11 月增加 25%。 所以这是促销价的一半,这是 AI 实验室做过的最零售的事情。
Artificial Analysis:排名第一,并花费 2.6 亿令牌才达成
2:36 现在是独立数据。 Anthropic 的 Thariq Shihipar 称新 Opus 非常令牌高效。 Artificial Analysis 在其智能指数上将其排名第一, 然后计数单词。 它生成了 2.6 亿个输出令牌才完成, 是中位数的 三倍。 GPT-6 Sol 得分低了 10 分,每个任务成本约 1 美元, 而 Opus 是 6 美元。
2:55 所以 Opus 是最智能的模型,也是话最多的模型, 就像设计评审中的每个资深工程师一样。 Simon 撞到了同样的墙。 他全力以赴的“自行车上的鹈鹕”测试从未返回结果。 Opus 一直检查鹈鹕的胫骨长度,直到达到其输出限制, 12.8 万个令牌。 两次。每次尝试花费 2.5 美元,耗时近二十分钟。 没有鹈鹕。说到阅读说明。
Claude Code:AGENTS.md 等待遥测标志
3:18 Claude Code 最近宣布支持 agents.md, 其他编码代理已经读取的共享指令文件。 一位名叫 Przemek 的开发者发现它从未加载。 加载器是一个内置插件,在运行之前,它会请求远程功能标志的权限。 标志的权限。 当遥测关闭时,无法获取标志,回退为 false, 您的文件会在没有警告的情况下被跳过。 他在一个空文件夹中用一个金丝雀词证明了这一点。
3:43 Bedrock 和 Vertex 用户也会遇到同样的沉默。 所以从您自己的磁盘读取文件现在需要“打电话回家”。 解决方法是一行 claude.md 导入 agents 文件, 这正是此功能旨在删除的额外文件。 Apple 以更少的步骤实现了同样的想法。
macOS 27:苹果智能关闭开关消失
3:59 David Bushell 在 macOS 15 上关闭了 Apple Intelligence。 上周他升级到 27,那个说“不”的开关不见了。 这些功能仍然回来了,占用了 22GB 的磁盘空间。 剩下的是屏幕使用时间,也就是家长控制,它隐藏了菜单,但什么也没关掉。 什么也没关掉。 用他的话来说,“我说不,苹果说好。”
三星:测试更新冻结了真实冰箱
4:19 周五部署,提前几天。 三星向韩国的智能冰箱推送了 SmartThings 更新, 并表示错误发生在测试过程中, 这显然是在客户的厨房中进行的。 冰箱断电,食物变质,据报道技术人员正在中秋节前更换主板。 主板在中秋节前。 三星称之为紧急措施。 某个地方,实习生正在学习生产包括冰箱。
4:42 如果您更愿意阅读而不是听我说,每天早上都会有 diff 发送到您的收件箱, 在 thedailydiff.dev 免费获取,链接在下方。
结论:Opus 5.5 NEEDS REVIEW
4:49 所以,今天对 Opus 5.5 的结论是。 NEEDS REVIEW。降价是真的,而且它位居榜首, 但独立计数与令牌效率不符, 九十分钟后,它成了价格战中较贵的一半。 订阅,点击铃铛,并在评论中告诉我您是否会给出不同的评价。 而这就是今天的 diff。 我是 Axrisi 的 Niko。 负责任地合并。
来源
- Anthropic, Claude Opus 5.5www.anthropic.com
- Hacker News (1,645 pts)news.ycombinator.com
- OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
- Hacker News (1,634 pts)news.ycombinator.com
- Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
- Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
- Artificial Analysis, GPT-6 Solartificialanalysis.ai
- Thariq Shihipar on Xtwitter.com
- The Verge, Emma Rothwww.theverge.com
- Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
- Hacker News (192 pts)news.ycombinator.com
- David Bushell, I said no and Apple said yesdbushell.com
- Hacker News (838 pts)news.ycombinator.com
- Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
- Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com



