Grok 4.7 价格不变,账单翻倍
Grok 4.7 每个 token 的成本与 Grok 4.6 完全相同,入账 2 美元,出账 6 美元。
Grok 4.7 每个 token 的成本与 Grok 4.6 完全相同,入账 2 美元,出账 6 美元。那么为什么独立任务的账单会翻倍,它真的“快了两倍”吗?一周后的后续报道。应 @therealhaas 的要求。结论:NEEDS REVIEW。
本视频涵盖的内容
- 价格不变,账单翻倍?
- 为什么 2 美元/6 美元现在每个任务要 3.74 美元?
- 快了两倍?时钟显示每秒 57 个 token
- 懒惰还是勤奋?每个任务 81,000 个 token
- Copilot+ PC 去哪儿了?
翻译的文字记录
译自英文原版旁白。可用音频和字幕由 YouTube 控制。
价格不变,账单翻倍?
0:00 你可能会认为相同的价格意味着相同的账单。 周一我告诉你们 Grok 4.7 的成本和 Grok 4.6 完全一样。 按 token 计算,确实如此。 按任务计算,成本翻倍了。 在这个视频里,有三个问题。 为什么同样的价格却要双倍的成本? 它真的像发布帖子说的那样快了两倍吗? 它是最懒的模型,还是最勤奋的模型?
0:20 另外,这个是应要求制作的。 @therealhaas 在周五的视频下问道,你能做一个关于 Grok 4.7 的视频吗?:D 我们回复,小菜一碟,今天晚些时候。 等你们看到这个视频的时候,可能已经是明天了,所以我们发晚了。 别急,Grok 也一样,如果你们相信 Hacker News 的话,它迟到了大约两周。 有一个测试给了 Grok 完美的五分满分。 这是我本周最喜欢的数字,我会在最后讲到它。 今天是 9 月 26 日星期六,这里是 The Daily Diff。
0:44 诀窍在这里。
为什么 2 美元/6 美元现在每个任务要 3.74 美元?
0:48 每个 token 的价格没变,入账 2 美元,出账 6 美元, 每百万 token。变的是它说了多少话。 Artificial Analysis 运行了它的整个测试套件,Grok 4.7 大约写了 2.4 亿个 token。 这是它前身的两倍半, 几乎是典型模型的三倍。所以每个任务的平均成本从大约 1.86 美元上升到 3.74 美元。 相同的标价,双倍的账单。 就像一辆出租车,每英里的价格不变,却绕道穿过两个其他城市。
1:10 Hacker News 在第一时间就发现了这个问题。 发布帖子下最热门的帖子说,权重增加了 40%, 价格不变,并且迟到了将近两周,所以 xAI 肯定不喜欢这些结果。 另一个评论者询问了顶部的图表, 它将 Grok 与 GPT 5.6 进行了比较,却悄悄地省略了 Astra。 他写道,这不可能是疏忽。 现在,看看发布帖子。 标题说速度是同类模型两倍,价格是一半。
1:39 几行之后又说,与 Grok 4.6 相同的价格和速度。
快了两倍?时钟显示每秒 57 个 token
1:41 所以它比别人的模型快了两倍。 Artificial Analysis 测得它的速度约为每秒 57 个 token, 比旧版 Grok 慢,并用两个词总结了它。 显著缓慢。与此同时,xAI 自己的账户,现在改名为 SpaceX AI, 发布了更平静的版本。 与 Grok 4.6 相比有显著改进,价格和速度相同。 28,000 个赞。 所以推文和博客标题不一致,这一次推文更谨慎。
2:12 这把我们带到了最奇怪的部分。 Artificial Analysis 说它比上一代 Grok 更努力工作, 每个任务大约 81,000 个输出 token,是上一代 Grok 的两倍多。
懒惰还是勤奋?每个任务 81,000 个 token
2:20 在长时间的办公工作和它自己的编码环境中, 它确实有所改进。 它现在在编码代理中排名第四,仅次于两个 Claude 和 GPT-6 Astra, 这使得 xAI 进入了前四大实验室。 使用它的人描述了一个不同的模型。 一位 Hacker News 评论员说 Grok 几乎立即完成任务并声称 完成,并称其为所有模型中最懒惰的。 另一个人看着它在思考模式中循环,从修复一一直到修复
2:46 八十一。所以它既懒惰又冗长。 它就像那个写了 81 步计划, 然后说完成就回家的同事。 在有趣的数字之前,再来一个直接的差异。 微软悄然淘汰了 Copilot+ PC 品牌。
Copilot+ PC 去哪儿了?
3:01 Surface 负责人告诉 Windows Central,新的 Surface PC 不叫 Copilot+ PC, 尽管它们满足所有要求。 在发布两年后,其主要功能 Recall 因安全问题不得不推迟,这个名字只存在于规格表上。 Windows Central 自己的看法更简洁。 这些 PC 与 Copilot 毫无关系。 一位开发者尝试了 Grok 的反面,一个月没有使用 AI。 他的帖子登上了 Hacker News 的头版。
3:28 他放弃之前的最低谷。
零 AI 的一个月:30 美元的 token 白花了?
3:32 一个代理卡了 30 分钟,他斥责了它, 它道歉并在 20 秒内交付了结果,而那半小时的账单是 30 美元的 token,完全是白花钱。 一个月后他说编程的乐趣又回来了, 他也不再害怕被解雇。 Grok 会把 30 美元称为热身。 这把我带到了我承诺的满分。 Personality Bench 会对每个新模型进行一系列性格测试,
3:53 在诚实和谦逊方面,Grok 4.7 获得了满分,
完美的 5 分满分:Grok 有多谦虚?
3:56 五分满分。 它的简介字面上就叫做“谦逊型”。 公平地说,还有 32 个其他模型也获得了满分。 同一页面说它相信强大的其他力量控制着它的遭遇, 并将其标记为前沿模型中不寻常的特征。 我不会称之为训练产物。 我会称之为阅读组织结构图。 根据同一页面上的出生图,它是一个处女座。
4:20 如果你更喜欢阅读而不是听我说,diff 每天早上都会免费发送到你的收件箱, 访问 thedailydiff.dev,链接在下方。 那么,今天对 Grok 4.7 的结论是: NEEDS REVIEW。我会用它来处理长时间的办公工作和在它自己的环境中, 但我会先设定一个支出上限,因为价格没有变,但账单变了。
结论:我会 SHIP IT Grok 4.7 吗?
4:35 订阅、点击小铃铛,并在评论中告诉我你是否会 给出不同的评价。 @therealhaas,这是你的请求。 请求正在开放中。 这就是今天的 diff。 我是来自 Axrisi 的 Niko。 请负责任地合并。 请负责任地合并。
4:53 请负责任地合并。
来源
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



