Grok 4.7 có giá tương tự, nhưng hóa đơn tăng gấp đôi
Grok 4.7 có giá chính xác bằng Grok 4.6 trên mỗi token, 2 đô la đầu vào và 6 đô la đầu ra.
Grok 4.7 có giá chính xác bằng Grok 4.6 trên mỗi token, 2 đô la đầu vào và 6 đô la đầu ra. Vậy tại sao hóa đơn độc lập cho mỗi tác vụ lại tăng gấp đôi, và nó có thực sự "nhanh gấp đôi" không? Một bài theo dõi sau một tuần. Được yêu cầu bởi @therealhaas. Phán quyết: CẦN XEM XÉT.
Đọc phiên bản viết (tiếng Anh) ↗
Nội dung video này đề cập
- Cùng giá, hóa đơn gấp đôi?
- Tại sao $2 / $6 giờ lại tốn $3,74 một tác vụ?
- Nhanh gấp đôi? Đồng hồ cho thấy 57 token mỗi giây
- Lười biếng hay chăm chỉ? 81.000 token một tác vụ
- Máy tính Copilot+ PC đã đi đâu?
Bản ghi đã dịch
Được dịch từ lời tường thuật tiếng Anh gốc. Âm thanh và phụ đề có sẵn được điều khiển bởi YouTube.
Cùng giá, hóa đơn gấp đôi?
0:00 Bạn sẽ nghĩ rằng cùng một mức giá có nghĩa là cùng một hóa đơn. Vào thứ Hai, tôi đã nói với bạn rằng Grok 4.7 có giá chính xác bằng Grok 4.6. Trên mỗi token thì đúng là vậy. Trên mỗi tác vụ, nó tốn gấp đôi. Trong video này, ba câu hỏi. Tại sao cùng một mức giá lại tốn gấp đôi? Nó có thực sự nhanh gấp đôi, như bài đăng ra mắt nói không? Và nó là mô hình lười biếng nhất, hay chăm chỉ nhất?
0:20 Ngoài ra, cái này là theo yêu cầu. The real Haas đã hỏi dưới video hôm thứ Sáu, bạn có thể làm một video về Grok 4.7 không, chấm hỏi D. Chúng tôi trả lời, dễ ợt, lát nữa. Đến lúc bạn xem cái này, có lẽ là ngày mai, vậy nên chúng tôi đã giao trễ. Thư giãn đi, Grok cũng vậy, trễ khoảng hai tuần, nếu bạn tin Hacker News. Và một thử nghiệm đã cho Grok điểm tuyệt đối 5 trên 5. Đó là con số yêu thích của tôi trong tuần, và tôi sẽ nói đến nó ở cuối.
0:44 Hôm nay là thứ Bảy, ngày 26 tháng 9, và đây là The Daily Diff.
Tại sao $2 / $6 giờ lại tốn $3,74 một tác vụ?
0:48 Đây là thủ thuật. Giá trên mỗi token không thay đổi, 2 đô la đầu vào và 6 đô la đầu ra, trên một triệu. Điều thay đổi là mức độ nó "nói". Artificial Analysis đã chạy toàn bộ bộ thử nghiệm của mình, và Grok 4.7 đã viết khoảng 240 triệu token. Đó là 2,5 lần so với phiên bản tiền nhiệm của nó, và gần gấp ba lần một mô hình điển hình. Vậy nên chi phí trung bình trên mỗi tác vụ đã tăng từ khoảng 1,86 đô la lên 3
1:10 74 đô la. Cùng giá niêm yết, hóa đơn gấp đôi. Giống như một chiếc taxi với cùng một mức giá trên mỗi dặm nhưng lại đi đường ngắm cảnh qua hai thành phố khác. Hacker News đã phát hiện ra điều đó trong giờ đầu tiên. Chủ đề lớn nhất dưới bài ra mắt nói rằng 40% trọng số hơn, cùng giá, và gần hai tuần trễ, vậy nên xAI chắc hẳn không hài lòng với kết quả. Một người bình luận khác hỏi về biểu đồ ở trên, so sánh với GPT 5.6 và lặng lẽ bỏ qua Astra. Ông ấy viết, điều đó không thể là một sự bỏ sót.
1:39 Bây giờ, bài đăng ra mắt.
Nhanh gấp đôi? Đồng hồ cho thấy 57 token mỗi giây
1:41 Tiêu đề nói nhanh gấp đôi, với một nửa giá của các mô hình tương đương. Vài dòng xuống, nó nói được phục vụ với cùng mức giá và tốc độ như Grok 4. 6. Vậy nên nó nhanh gấp đôi so với mô hình của người khác. Artificial Analysis đã đo nó ở khoảng 57 token mỗi giây, chậm hơn Grok cũ, và tóm tắt nó trong hai từ. Chậm đáng kể. Trong khi đó, tài khoản riêng của xAI, giờ được gọi là SpaceX AI, đã đăng phiên bản bình tĩnh hơn. Một cải thiện đáng kể so với Grok 4.6, với cùng mức giá và tốc độ.
2:12 28 nghìn lượt thích. Vậy nên tweet và tiêu đề blog không đồng nhất, và lần này tweet lại là cái thận trọng hơn. Điều này đưa chúng ta đến phần kỳ lạ nhất.
Lười biếng hay chăm chỉ? 81.000 token một tác vụ
2:20 Artificial Analysis nói rằng nó làm việc chăm chỉ hơn Grok trước, khoảng 81 nghìn token đầu ra trên mỗi tác vụ, hơn gấp đôi so với cái trước. Và trong công việc văn phòng dài và trong hệ thống mã hóa riêng của nó, nó thực sự đã cải thiện. Giờ nó đứng thứ tư trong số các tác nhân mã hóa, sau hai Claude và GPT 6 Astra, và điều đó đặt xAI vào top bốn phòng thí nghiệm. Những người sử dụng nó mô tả một mô hình khác. Một người bình luận trên Hacker News nói Grok kết thúc các tác vụ gần như ngay lập tức và tuyên bố
2:46 xong, và gọi nó là kẻ lười biếng nhất trong số tất cả. Một người khác đã xem nó lặp lại trong chế độ suy nghĩ, từ sửa chữa một cho đến sửa chữa 81. Vậy nên nó vừa lười biếng vừa dài dòng. Nó là đồng nghiệp viết kế hoạch 81 bước, rồi nói xong và về nhà.
Máy tính Copilot+ PC đã đi đâu?
3:01 Một điểm khác biệt thẳng thắn nữa trước con số thú vị. Microsoft đã lặng lẽ khai tử thương hiệu Copilot+ PC. Ông chủ Surface nói với Windows Central rằng các PC Surface mới không được gọi là Copilot PC+, mặc dù chúng đáp ứng mọi yêu cầu. Hai năm sau một lần ra mắt mà tính năng chính, Recall, đã phải bị trì hoãn vì lý do bảo mật, cái tên chỉ còn sống trên các bảng thông số kỹ thuật. Nhận định riêng của Windows Central ngắn gọn hơn. Những PC này không liên quan gì đến Copilot.
3:28 Và một nhà phát triển đã thử điều ngược lại với Grok, một tháng không có AI.
Một tháng không có AI: $30 token vô ích?
3:32 Bài đăng của anh ấy đã lên trang nhất Hacker News. Điểm thấp nhất trước khi anh ấy bỏ việc. Một tác nhân bị kẹt trong ba mươi phút, anh ấy đã mắng nó, nó xin lỗi và trả lời trong hai mươi giây, và hóa đơn cho nửa giờ đó là ba mươi đô la token hoàn toàn vô ích. Một tháng sau, anh ấy nói rằng niềm vui lập trình đã trở lại, và anh ấy không còn sợ bị sa thải nữa. Grok sẽ gọi ba mươi đô la là khởi động.
3:53 Điều này đưa tôi đến điểm số hoàn hảo mà tôi đã hứa.
Hoàn hảo 5 trên 5: Grok khiêm tốn đến mức nào?
3:56 Personality Bench chạy mọi mô hình mới qua một loạt các bài kiểm tra tính cách, và về sự trung thực và khiêm tốn, Grok 4.7 đã đạt điểm tối đa, 5 trên 5. Hồ sơ của nó theo đúng nghĩa đen được gọi là loại khiêm tốn. Công bằng mà nói, 32 mô hình khác cũng đạt điểm tối đa. Cùng trang đó nói rằng nó tin rằng những người quyền lực kiểm soát những gì xảy ra với nó, và gắn cờ điều đó là bất thường đối với một mô hình tiên tiến. Tôi sẽ không gọi đó là một sai sót trong quá trình huấn luyện.
4:20 Tôi sẽ gọi đó là đọc biểu đồ tổ chức. Và theo biểu đồ ngày sinh trên cùng trang đó, nó là một Xử Nữ. Nếu bạn muốn đọc cái này hơn là nghe tôi nói, the diff sẽ đến hộp thư của bạn mỗi sáng, miễn phí tại the daily diff dot dev, liên kết bên dưới. Vậy, phán quyết hôm nay về Grok 4.7.
Phán quyết: liệu tôi có SHIP IT Grok 4.7 không?
4:35 CẦN XEM XÉT. Tôi sẽ sử dụng nó cho công việc văn phòng dài và trong hệ thống riêng của nó, nhưng tôi sẽ đặt một giới hạn chi tiêu trước, vì giá không thay đổi và hóa đơn thì có. Đăng ký, nhấn chuông, và cho tôi biết trong phần bình luận nếu bạn sẽ đóng dấu nó khác đi. Và the real Haas, cái này là của bạn. Yêu cầu đang mở. Và đó là the diff của ngày hôm nay. Tôi là Niko từ Axrisi.
4:53 Hợp nhất một cách có trách nhiệm.
Nguồn
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



