Grok 4.7 費用相同,但帳單翻倍
Grok 4.7 每代幣的成本與 Grok 4.6 完全相同,入賬 2 美元,出賬 6 美元。
Grok 4.7 每代幣的成本與 Grok 4.6 完全相同,入賬 2 美元,出賬 6 美元。那麼,為什麼每個任務的獨立帳單翻倍了,而且它真的「快兩倍」嗎?一週後的跟進報道。由 @therealhaas 要求。判決:需要審查。
本影片涵蓋的內容
- 價格一樣,帳單卻翻倍?
- 為什麼現在每個任務的 2 美元/6 美元會變成 3.74 美元?
- 快兩倍?時鐘顯示每秒 57 個代幣
- 懶惰還是勤奮?每個任務 81,000 個代幣
- Copilot+ PC 去了哪裡?
翻譯的文字記錄
從英文原文旁白翻譯。可用的音頻和字幕由 YouTube 控制。
價格一樣,帳單卻翻倍?
0:00 你會認為相同的價格意味著相同的帳單。 星期一我告訴過你,Grok 4.7 的成本與 Grok 4. 6 完全相同。按代幣計算,確實如此。 但按任務計算,成本翻倍了。 在這段影片中,有三個問題。 為什麼相同的價格卻要花費雙倍? 它真的像發布貼文說的那樣快兩倍嗎? 它是最懶的模型,還是最勤奮的模型?
0:20 此外,這是應要求製作的。 The real Haas 在星期五的影片下方問道,你能做一個關於 Grok 4. 7 的影片嗎? 我們回答說,輕而易舉,今天稍後。 等你看到這個時,可能已經是明天了,所以我們遲發了。 放鬆點,Grok 也一樣,如果相信 Hacker News,它遲了大約兩週。 一項測試給了 Grok 完美的五分滿分。 這是我本週最喜歡的數字,我會在影片結尾時談到它。
0:44 今天是 9 月 26 日星期六,這是 The Daily Diff。
為什麼現在每個任務的 2 美元/6 美元會變成 3.74 美元?
0:48 這是竅門。 每個代幣的價格沒有變動,入賬兩美元,出賬六美元, 每百萬個。變動的是它說了多少。 Artificial Analysis 運行了它的整個測試套件,Grok 4.7 寫了 大約兩億四千萬個代幣。 這是其前身 的兩倍半,幾乎是典型模型的三倍。 所以每個任務的平均成本從大約一美元八十六美分上升到三
1:10 美元七十四美分。相同的價格標籤,卻是雙倍的收據。 這就像一輛計程車,每英里的費率相同,卻繞道穿過兩 個其他城市。Hacker News 在第一小時就發現了。 發布下方最大的討論串說增加了百分之四十的權重, 價格不變,而且遲了將近兩週,所以 xAI 不會喜歡這些 結果。另一位評論者問及頂部的圖表, 該圖表與 GPT 5.6 進行比較,卻悄悄地省略了 Astra。 他寫道,這不可能是疏忽。
1:39 現在,發布貼文。
快兩倍?時鐘顯示每秒 57 個代幣
1:41 標題說速度快兩倍,價格是同類模型的一半。 幾行下面寫著,以與 Grok 4. 6 相同的價格和速度提供。所以它比其他人的模型快兩倍。 Artificial Analysis 測得它每秒大約 57 個代幣, 比舊的 Grok 慢,並用兩個詞總結了它。 顯著地慢。同時,xAI 自己的帳號,現在改名為 SpaceX AI, 發布了更平靜的版本。 與 Grok 4.6 相比有顯著改進,價格和速度相同。
2:12 二十八萬個讚。 所以推文和部落格標題有分歧,這次推文是 謹慎的那個。這就帶我們來到最奇怪的部分。
懶惰還是勤奮?每個任務 81,000 個代幣
2:20 Artificial Analysis 說它比上一個 Grok 更努力工作, 每個任務大約 81,000 個輸出代幣,是上一個的兩倍多。 而在長篇辦公室工作和它自己的編碼工具中, 它確實有所改進。 它現在在編碼代理中排名第四,僅次於兩個 Claudes 和 GPT 6 Astra, 這使得 xAI 位列前四大實驗室。 使用它的人描述了一個不同的模型。 一位 Hacker News 評論者說 Grok 幾乎立即完成任務並聲稱
2:46 已完成,並稱其為所有模型中最懶的。 另一位看著它在思考模式中循環,從修復一一直到修復 八十一。所以它既懶惰又冗長。 它就是那種寫了八十一項計劃的同事, 然後說完成就回家了。
Copilot+ PC 去了哪裡?
3:01 在講有趣的數字之前,還有一個直接的差異。 微軟已悄悄地淘汰了 Copilot Plus PC 品牌。 Surface 負責人告訴 Windows Central,新的 Surface PC 不稱為 Copilot Plus PC,儘管它們符合所有要求。 在一個推出時的重點功能 Recall, 因安全問題不得不推遲兩年後,這個名稱只存在於規格表中。 Windows Central 自己的看法更簡潔。 這些 PC 與 Copilot 毫無關係。
3:28 一位開發人員嘗試了 Grok 的反面,一個月沒有 AI。
一個月沒有 AI:30 美元的代幣白花了?
3:32 他的貼文登上了 Hacker News 的首頁。 在他辭職之前的低谷。 一個代理卡了三十分鐘,他斥責了它, 它道歉並在二十秒內完成任務,而那半小時的帳單 是三十美元的代幣,完全白費了。 一個月後他說程式設計的樂趣又回來了, 他也不再害怕被解僱。 Grok 會稱三十美元為熱身。
3:53 這就帶我來到我承諾的滿分。
完美的 5 分滿分:Grok 有多謙虛?
3:56 Personality Bench 讓每個新模型都經過一堆性格測試, 在誠實和謙遜方面,Grok 4.7 獲得滿分, 五分滿分。 它的檔案實際上稱為謙虛型。 公平地說,還有三十二個其他模型也獲得滿分。 同一頁面說它相信強大的他人控制著發生在它身上的事情, 並將其標記為前沿模型中不尋常的。 我不會稱之為訓練結果。
4:20 我會稱之為讀取組織結構圖。 根據同一頁面上的出生圖,它是處女座。 如果你寧願閱讀而不是聽我說,這篇文章每天早上都會發送到你的收件箱, 免費在 thedailydiff.dev,連結在下方。 那麼,今天對 Grok 4.7 的判決。
判決:我會推出 Grok 4.7 嗎?
4:35 需要審查。我會用它來處理長篇辦公室工作和它自己的工具中, 但我會先設定一個支出上限,因為價格沒有變,但 帳單變了。訂閱,點擊小鈴鐺,並在評論中告訴我,如果你會 有不同的評價。 The real Haas,這個是你的要求。 請求開放。 這就是今天的文章。 我是來自 Axrisi 的 Niko。
4:53 負責任地合併。
來源
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



