Grok 4.7 成本不變,帳單卻翻倍
Grok 4.7 每枚代幣的成本與 Grok 4.6 完全相同,輸入 2 美元,輸出 6 美元。
Grok 4.7 每枚代幣的成本與 Grok 4.6 完全相同,輸入 2 美元,輸出 6 美元。那為何每個任務的獨立帳單翻倍了?它真的「快兩倍」嗎?一週後的追蹤報導。由 @therealhaas 要求。評語:NEEDS REVIEW。
本影片重點
- 價格不變,帳單卻翻倍了?
- 為何 2 美元 / 6 美元的任務現在要價 3.74 美元?
- 快兩倍?時鐘顯示每秒 57 個代幣
- 懶惰還是勤奮?一個任務 81,000 個代幣
- Copilot+ PC 跑哪去了?
翻譯文字稿
譯自英文原版旁白。可用的音訊和字幕由 YouTube 控制。
價格不變,帳單卻翻倍了?
0:00 你可能會認為,價格不變就意味著帳單不變。 週一我告訴你,Grok 4.7 的成本與 Grok 4.6 完全 相同。就每枚代幣而言,確實如此。 就每個任務而言,成本卻翻倍了。 在這個影片中,有三個問題。 為何相同的價格會導致帳單翻倍? 它真的像發布文章所說的那樣快兩倍嗎? 它是最懶惰的模型,還是最勤奮的?
0:20 另外,這個是應要求製作的。 The real Haas 在週五的影片下問道,你能做一個關於 Grok 4.7 的影片嗎 :D。 我們回覆說,小菜一碟,今天稍晚。 等你看到這個的時候,可能已經是明天了,所以我們遲發了。 別緊張,Grok 也一樣,如果相信 Hacker News,它大約遲了兩週。 有一次測試給 Grok 滿分五分。 這是我本週最喜歡的數字,我會在最後提到它。
0:44 今天是 9 月 26 日星期六,這是 The Daily Diff。
為何 2 美元 / 6 美元的任務現在要價 3.74 美元?
0:48 訣竅在這裡。 每枚代幣的價格沒有變動,輸入 2 美元,輸出 6 美元, 每百萬。變動的是它說話的量。 Artificial Analysis 運行了其整個測試套件,Grok 4.7 寫了 大約 2.4 億枚代幣。 這是其前身 的 2.5 倍,幾乎是典型 模型的 3 倍。所以每個任務的平均成本從大約 1.86 美元升到 3.
1:10 74 美元。價格標籤相同,收據卻翻倍了。 這就像一輛計程車,每英里的費率相同,卻繞道經過兩個 其他城市。Hacker News 在發布後的第一個小時就發現了。 發布下最大的討論串說權重增加了 40%, 價格相同,並且遲了將近兩週,所以 xAI 不會喜歡這些 結果。另一個評論者詢問了頂部的圖表, 該圖表與 GPT 5.6 進行比較,卻悄悄地省略了 Astra。 他寫道,那不可能是疏忽。
1:39 現在,發布文章。
快兩倍?時鐘顯示每秒 57 個代幣
1:41 標題說快兩倍,價格是同類模型的一半。 幾行下面寫著,Grok 4.6 的價格和速度與 Grok 4.6 相同。 所以它比其他人的模型快兩倍。 Artificial Analysis 測得它每秒大約 57 枚代幣, 比舊的 Grok 慢,並用兩個詞總結。 明顯緩慢。同時,xAI 自己的帳戶,現在改名為 SpaceX AI, 發布了更平靜的版本。 Grok 4.6 的顯著改進,價格和速度相同。
2:12 28,000 個讚。 所以推文和部落格標題不一致,而這次推文是 謹慎的那個。這就引出了最奇怪的部分。
懶惰還是勤奮?一個任務 81,000 個代幣
2:20 Artificial Analysis 說它比上一個 Grok 更努力工作, 每個任務大約有 81,000 個輸出代幣,是上一個的兩倍多。 在長時間的辦公工作和它自己的編碼工具中, 它確實有所改進。 它現在在編碼代理中排名第四,僅次於兩個 Claude 和 GPT 6 Astra, 這讓 xAI 躋身前四大實驗室。 使用它的人描述的是一個不同的模型。 一位 Hacker News 評論者說 Grok 幾乎立即完成任務並聲稱
2:46 已完成,並稱其為所有模型中最懶惰的。 另一個人看著它在思考模式中循環,從修復一到修復 八十一。所以它既懶惰又冗長。 這就像寫了一個 81 個步驟計畫的同事, 然後說完了就回家了。
Copilot+ PC 跑哪去了?
3:01 在有趣數字出現之前,再做一個直接的差異。 微軟已悄悄地停用了 Copilot Plus PC 品牌。 Surface 負責人告訴 Windows Central,新的 Surface PC 不叫 Copilot Plus PC,儘管它們符合所有要求。 在發布兩年後,其標誌性功能 Recall, 因安全問題不得不推遲,這個名字只存在於規格表中。 Windows Central 自己的看法更簡潔。 這些 PC 與 Copilot 毫無關係。
3:28 還有一位開發人員嘗試了 Grok 的反面,一個月沒有 AI。
一個月沒有 AI:30 美元的代幣白花了?
3:32 他的文章登上了 Hacker News 頭版。 他放棄前的低谷。 一個代理卡住了 30 分鐘,他斥責了它, 它道歉並在 20 秒內完成,那半小時的帳單是 30 美元的代幣,卻什麼也沒做。 一個月後他說程式設計的樂趣回來了, 他也不再害怕被解僱。 Grok 會把 30 美元叫做熱身。
3:53 這就引出了我承諾的完美分數。
滿分 5 分中的完美 5 分:Grok 有多謙虛?
3:56 Personality Bench 對每個新模型進行一系列性格測試, 在誠實和謙遜方面,Grok 4.7 獲得了滿分, 五分之五。 它的檔案字面上被稱為謙遜型。 公平地說,還有 32 個其他模型也獲得了滿分。 同一頁面說它相信強大的他人控制著發生在它身上的事情, 並標記這對於一個前沿模型來說是不尋常的。 我不會稱之為訓練結果。
4:20 我會稱之為閱讀組織架構圖。 根據同一頁面上的出生圖,它是個處女座。 如果你寧願閱讀這個而不是聽我說,The Daily Diff 每天早上都會免費 寄到你的收件匣,網址是 daily diff dot dev,連結在下方。 那麼,今天對 Grok 4.7 的判斷是:
評語:我會 SHIP IT Grok 4.7 嗎?
4:35 NEEDS REVIEW。我會將它用於長時間的辦公工作和它自己的工具中, 但我會先設定一個支出上限,因為價格沒有變,但 帳單變了。訂閱,點擊鈴鐺,並在評論中告訴我你是否會 有不同的評價。 The real Haas,這個是你的。 請求開放。 這就是今天的 The Daily Diff。 我是來自 Axrisi 的 Niko。
4:53 謹慎合併。
來源
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



