Grok 4.7 custa o mesmo, pero cobra o dobre
Grok 4.7 custa exactamente o mesmo por token que Grok 4.6, 2 $ de entrada e 6 $ de saída.
Grok 4.7 custa exactamente o mesmo por token que Grok 4.6, 2 $ de entrada e 6 $ de saída. Entón, por que a factura independente por tarefa se duplicou e é realmente "o dobre de rápido"? Un seguimento unha semana despois. Solicitado por @therealhaas. Veredito: NEEDS REVIEW.
Ler a edición escrita (inglés) ↗
Que abrangue este vídeo
- Mesmo prezo, o dobre da factura?
- Por que 2 $ / 6 $ custa agora 3.74 $ por tarefa?
- O dobre de rápido? O reloxo di 57 tokens por segundo
- Prezoso ou traballador? 81.000 tokens por tarefa
- Onde foi o Copilot+ PC?
Transcrición traducida
Traducido da narración orixinal en inglés. O audio e os subtítulos dispoñibles son controlados por YouTube.
Mesmo prezo, o dobre da factura?
0:00 Poderíase pensar que o mesmo prezo significa a mesma factura. O luns díxenvos que Grok 4.7 custa exactamente o mesmo que Grok 4. 6. Por token, si. Por tarefa, custa o dobre. Neste vídeo, tres preguntas. Por que o mesmo prezo custa o dobre? É realmente o dobre de rápido, como di a publicación de lanzamento? E é o modelo máis preguiceiro ou o máis traballador?
0:20 Ademais, este é por petición. The Real Haas preguntou no vídeo do venres, podes facer un vídeo sobre Grok 4. 7, dous puntos D. Respondemos, pan comido, máis tarde hoxe. Cando vexas isto, probablemente será mañá, así que enviamos tarde. Relaxa, tamén Grok, unhas dúas semanas tarde, se cres en Hacker News. E unha proba deulle a Grok un perfecto cinco sobre cinco. É o meu número favorito da semana, e chegarei a el ao final.
0:44 É sábado, vinte e seis de setembro, e este é The Daily Diff.
Por que 2 $ / 6 $ custa agora 3.74 $ por tarefa?
0:48 Aquí está o truco. O prezo por token non se moveu, dous dólares de entrada e seis de saída, por millón. O que se moveu é canto fala. Artificial Analysis executou todo o seu conxunto de probas, e Grok 4.7 escribiu uns douscentos corenta millóns de tokens. Iso é dúas veces e media o seu predecesor, e case tres veces un modelo típico. Así, o custo medio por tarefa pasou de aproximadamente un dólar oitenta e seis a tres
1:10 setenta e catro. O mesmo prezo, o dobre da factura. É un taxi coa mesma tarifa por milla que fai a ruta escénica a través de dúas outras cidades. Hacker News detectouno na primeira hora. O fío máis grande baixo o lanzamento di corenta por cento máis de pesos, o mesmo prezo, e case dúas semanas tarde, polo que a xAI non lle deben ter gustado os resultados. Outro comentarista preguntou sobre a gráfica de arriba, que compara con GPT 5.6 e deixa fóra a Astra. Iso, escribiu, non pode ser un descoido.
1:39 Agora, a publicación de lanzamento.
O dobre de rápido? O reloxo di 57 tokens por segundo
1:41 O titular di o dobre de rápido, á metade do prezo dos modelos comparables. Unhas liñas abaixo, di servido ao mesmo prezo e velocidade que Grok 4. 6. Así que é o dobre de rápido que o modelo doutro. Artificial Analysis cronometrouno en aproximadamente cincuenta e sete tokens por segundo, máis lento que o vello Grok, e resumiuno en dúas palabras. Notablemente lento. Mentres tanto, a propia conta de xAI, que agora se chama SpaceX AI, publicou a versión máis tranquila. Unha mellora notable sobre Grok 4.6, ao mesmo prezo e velocidade.
2:12 Vinte e oito mil gústame. Así que o tweet e o titular do blog non están de acordo, e por unha vez o tweet é o cauteloso. O que nos leva á parte máis estraña.
Prezoso ou traballador? 81.000 tokens por tarefa
2:20 Artificial Analysis di que traballa máis duro que o último Grok, uns oitenta e un mil tokens de saída por tarefa, máis do dobre que o anterior. E en traballos longos de oficina e no seu propio arnés de codificación, realmente mellorou. É o cuarto entre os axentes de codificación agora, detrás de dous Claudes e GPT 6 Astra, e iso sitúa a xAI entre os catro mellores laboratorios. As persoas que o usan describen un modelo diferente. Un comentarista de Hacker News di que Grok remata as tarefas case de inmediato e afirma
2:46 feito, e chámao o máis preguiceiro de todos. Outro observouno en bucle en modo de pensamento, desde a corrección un ata a corrección oitenta e un. Así que é preguiceiro e verboso ao mesmo tempo. É o compañeiro de traballo que escribe un plan de oitenta e un pasos, despois di feito e vai para casa.
Onde foi o Copilot+ PC?
3:01 Unha diferenza máis antes do número divertido. Microsoft retirou en silencio a marca Copilot+ PC. O xefe de Surface díxolle a Windows Central que os novos Surface PC non se chaman Copilot plus PC, aínda que cumpren todos os requisitos. Dous anos despois dun lanzamento cuxa característica principal, Recall, tivo que ser atrasada por seguridade, o nome vive só nas follas de especificacións. A propia opinión de Windows Central é máis curta. Estes PC non teñen nada que ver con Copilot.
3:28 E un desenvolvedor probou o contrario de Grok, un mes sen intelixencia artificial.
Un mes sen intelixencia artificial: 30 $ en tokens para nada?
3:32 A súa publicación chegou á primeira páxina de Hacker News. O punto baixo antes de que o deixase. Un axente quedou parado durante trinta minutos, rifouno, pediu desculpas e entregou en vinte segundos, e a factura desa media hora foi de trinta dólares en tokens para absolutamente nada. Un mes despois di que a alegría de programar volveu, e non ten medo de ser despedido. Grok chamaría a trinta dólares un quecemento.
3:53 O que me leva á puntuación perfecta que prometín.
O perfecto 5 sobre 5: que humilde é Grok?
3:56 Personality Bench executa cada novo modelo a través dunha pila de probas de personalidade, e en honestidade e humildade, Grok 4.7 obtivo a puntuación máxima, cinco sobre cinco. O seu perfil chámase literalmente o tipo humilde. Para ser xustos, outros trinta e dous modelos tamén obtiveron a puntuación máxima. A mesma páxina di que cre que outros poderosos controlan o que lle sucede, e sinala iso como inusual para un modelo de fronteira. Eu non o chamaría un artefacto de adestramento.
4:20 Chamaríalle ler o organigrama. E segundo a carta natal da mesma páxina, é virxe. Se prefires ler isto en vez de oírme dicilo, o diff chega á túa caixa de entrada cada mañá, de balde en thedailydiff.dev, ligazón debaixo. Entón, o veredito de hoxe sobre Grok 4.7.
Veredito: enviaría Grok 4.7?
4:35 NEEDS REVIEW. Eu usaríao para traballos longos de oficina e dentro do seu propio arnés, pero primeiro poñería un límite de gasto, porque o prezo non cambiou e a factura si. Subscríbete, preme na campá e dime nos comentarios se o terías selado de forma diferente. E o Real Haas, este foi teu. As peticións están abertas. E esa é a diferenza por hoxe. Son Niko de Axrisi.
4:53 Fusiona con responsabilidade.
Fontes
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



