+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Grok 4.7 价格不变,账单翻倍

Grok 4.7 每个 token 的成本与 Grok 4.6 完全相同,入账 2 美元,出账 6 美元。

Grok 4.7 每个 token 的成本与 Grok 4.6 完全相同,入账 2 美元,出账 6 美元。那么为什么独立任务的账单会翻倍,它真的“快了两倍”吗?一周后的后续报道。应 @therealhaas 的要求。结论:NEEDS REVIEW。

阅读书面版(英文) ↗

本视频涵盖的内容

  • 价格不变,账单翻倍?
  • 为什么 2 美元/6 美元现在每个任务要 3.74 美元?
  • 快了两倍?时钟显示每秒 57 个 token
  • 懒惰还是勤奋?每个任务 81,000 个 token
  • Copilot+ PC 去哪儿了?

翻译的文字记录

译自英文原版旁白。可用音频和字幕由 YouTube 控制。

价格不变,账单翻倍?

0:00 你可能会认为相同的价格意味着相同的账单。 周一我告诉你们 Grok 4.7 的成本和 Grok 4.6 完全一样。 按 token 计算,确实如此。 按任务计算,成本翻倍了。 在这个视频里,有三个问题。 为什么同样的价格却要双倍的成本? 它真的像发布帖子说的那样快了两倍吗? 它是最懒的模型,还是最勤奋的模型?

0:20 另外,这个是应要求制作的。 @therealhaas 在周五的视频下问道,你能做一个关于 Grok 4.7 的视频吗?:D 我们回复,小菜一碟,今天晚些时候。 等你们看到这个视频的时候,可能已经是明天了,所以我们发晚了。 别急,Grok 也一样,如果你们相信 Hacker News 的话,它迟到了大约两周。 有一个测试给了 Grok 完美的五分满分。 这是我本周最喜欢的数字,我会在最后讲到它。 今天是 9 月 26 日星期六,这里是 The Daily Diff。

0:44 诀窍在这里。

为什么 2 美元/6 美元现在每个任务要 3.74 美元?

0:48 每个 token 的价格没变,入账 2 美元,出账 6 美元, 每百万 token。变的是它说了多少话。 Artificial Analysis 运行了它的整个测试套件,Grok 4.7 大约写了 2.4 亿个 token。 这是它前身的两倍半, 几乎是典型模型的三倍。所以每个任务的平均成本从大约 1.86 美元上升到 3.74 美元。 相同的标价,双倍的账单。 就像一辆出租车,每英里的价格不变,却绕道穿过两个其他城市。

1:10 Hacker News 在第一时间就发现了这个问题。 发布帖子下最热门的帖子说,权重增加了 40%, 价格不变,并且迟到了将近两周,所以 xAI 肯定不喜欢这些结果。 另一个评论者询问了顶部的图表, 它将 Grok 与 GPT 5.6 进行了比较,却悄悄地省略了 Astra。 他写道,这不可能是疏忽。 现在,看看发布帖子。 标题说速度是同类模型两倍,价格是一半。

1:39 几行之后又说,与 Grok 4.6 相同的价格和速度。

快了两倍?时钟显示每秒 57 个 token

1:41 所以它比别人的模型快了两倍。 Artificial Analysis 测得它的速度约为每秒 57 个 token, 比旧版 Grok 慢,并用两个词总结了它。 显著缓慢。与此同时,xAI 自己的账户,现在改名为 SpaceX AI, 发布了更平静的版本。 与 Grok 4.6 相比有显著改进,价格和速度相同。 28,000 个赞。 所以推文和博客标题不一致,这一次推文更谨慎。

2:12 这把我们带到了最奇怪的部分。 Artificial Analysis 说它比上一代 Grok 更努力工作, 每个任务大约 81,000 个输出 token,是上一代 Grok 的两倍多。

懒惰还是勤奋?每个任务 81,000 个 token

2:20 在长时间的办公工作和它自己的编码环境中, 它确实有所改进。 它现在在编码代理中排名第四,仅次于两个 Claude 和 GPT-6 Astra, 这使得 xAI 进入了前四大实验室。 使用它的人描述了一个不同的模型。 一位 Hacker News 评论员说 Grok 几乎立即完成任务并声称 完成,并称其为所有模型中最懒惰的。 另一个人看着它在思考模式中循环,从修复一一直到修复

2:46 八十一。所以它既懒惰又冗长。 它就像那个写了 81 步计划, 然后说完成就回家的同事。 在有趣的数字之前,再来一个直接的差异。 微软悄然淘汰了 Copilot+ PC 品牌。

Copilot+ PC 去哪儿了?

3:01 Surface 负责人告诉 Windows Central,新的 Surface PC 不叫 Copilot+ PC, 尽管它们满足所有要求。 在发布两年后,其主要功能 Recall 因安全问题不得不推迟,这个名字只存在于规格表上。 Windows Central 自己的看法更简洁。 这些 PC 与 Copilot 毫无关系。 一位开发者尝试了 Grok 的反面,一个月没有使用 AI。 他的帖子登上了 Hacker News 的头版。

3:28 他放弃之前的最低谷。

零 AI 的一个月:30 美元的 token 白花了?

3:32 一个代理卡了 30 分钟,他斥责了它, 它道歉并在 20 秒内交付了结果,而那半小时的账单是 30 美元的 token,完全是白花钱。 一个月后他说编程的乐趣又回来了, 他也不再害怕被解雇。 Grok 会把 30 美元称为热身。 这把我带到了我承诺的满分。 Personality Bench 会对每个新模型进行一系列性格测试,

3:53 在诚实和谦逊方面,Grok 4.7 获得了满分,

完美的 5 分满分:Grok 有多谦虚?

3:56 五分满分。 它的简介字面上就叫做“谦逊型”。 公平地说,还有 32 个其他模型也获得了满分。 同一页面说它相信强大的其他力量控制着它的遭遇, 并将其标记为前沿模型中不寻常的特征。 我不会称之为训练产物。 我会称之为阅读组织结构图。 根据同一页面上的出生图,它是一个处女座。

4:20 如果你更喜欢阅读而不是听我说,diff 每天早上都会免费发送到你的收件箱, 访问 thedailydiff.dev,链接在下方。 那么,今天对 Grok 4.7 的结论是: NEEDS REVIEW。我会用它来处理长时间的办公工作和在它自己的环境中, 但我会先设定一个支出上限,因为价格没有变,但账单变了。

结论:我会 SHIP IT Grok 4.7 吗?

4:35 订阅、点击小铃铛,并在评论中告诉我你是否会 给出不同的评价。 @therealhaas,这是你的请求。 请求正在开放中。 这就是今天的 diff。 我是来自 Axrisi 的 Niko。 请负责任地合并。 请负责任地合并。

4:53 请负责任地合并。

来源

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

相关视频

daily · zh-CN · 2026年9月22日

亚马逊将Meta的Muse从其商店中踢出。这是其中的差异。

自周日晚上以来,Meta的Muse代理在amazon.com上收到一个弹出窗口:“未经授权的AI代理继续访问违反了亚马逊的使用条件。” 亚马逊在八月份针对Perplexity的Comet的黑客法律途径上失败了,所以这次的规则是针对购物者的——而亚马逊自己的“替我购买”代理则在选择退出(opt-out)的基础上购物于其他商店。判决:NEEDS REVIEW。

5:08 ↗
daily · zh-CN · 2026年9月7日

谷歌刚刚发布了一个黑客模型。以下是差异。

谷歌发布了 Gemini 3.8 Flash(输入每百万 $0.75 / 输出每百万 $3.75,1月1日价格翻倍)和 Gemini 3.8 Flash Cyber——一个漏洞搜寻模型,只卖给 650 家经过审查的“值得信赖的防御者”——四小时后,Meta 发布了 Muse Spark 1.3,其中包含一个每百万 $0.10 的“贡献者”级别,折扣是你的会话记录。我们用两家公司都没有编写的基准测试

5:08 ↗