Grok 4.7 custa o mesmo, mas a fatura dobra
Grok 4.7 custa exatamente o mesmo que Grok 4.6 por token, 2 $ de entrada e 6 $ de saída.
Grok 4.7 custa exatamente o mesmo que Grok 4.6 por token, 2 $ de entrada e 6 $ de saída. Então, por que a fatura independente por tarefa dobrou, e será que é realmente "duas vezes mais rápido"? Um acompanhamento uma semana depois. Pedido por @therealhaas. Veredito: NEEDS REVIEW.
Ler a edição escrita (Inglês) ↗
O que este vídeo aborda
- Mesmo preço, fatura a dobrar?
- Por que 2 $ / 6 $ custa agora 3,74 $ por tarefa?
- Duas vezes mais rápido? O relógio diz 57 tokens por segundo
- Preguiçoso ou trabalhador? 81.000 tokens por tarefa
- Para onde foi o Copilot+ PC?
Transcrição traduzida
Traduzido da narração original em inglês. Áudio e legendas disponíveis são controlados pelo YouTube.
Mesmo preço, fatura a dobrar?
0:00 Pensaríamos que o mesmo preço significa a mesma fatura. Na segunda-feira, eu disse que Grok 4.7 custa exatamente o mesmo que Grok 4.6. Por token, sim. Por tarefa, custa o dobro. Neste vídeo, três perguntas. Por que o mesmo preço custa o dobro? É realmente duas vezes mais rápido, como diz o post de lançamento? E é o modelo mais preguiçoso ou o mais trabalhador?
0:20 Além disso, este é um pedido. The real Haas perguntou, no vídeo de sexta-feira, se eu podia fazer um vídeo sobre Grok 4.7, :D. Respondemos, 'moleza, mais tarde hoje'. Quando virem isto, provavelmente já é amanhã, por isso atrasámo-nos. Relaxem, Grok também se atrasou, cerca de duas semanas, se acreditarem no Hacker News. E um teste deu a Grok um cinco perfeito em cinco. É o meu número preferido da semana, e falarei sobre ele no final.
0:44 É sábado, 26 de setembro, e este é The Daily Diff.
Por que 2 $ / 6 $ custa agora 3,74 $ por tarefa?
0:48 Aqui está o truque. O preço por token não mudou, dois dólares de entrada e seis de saída, por milhão. O que mudou foi o quanto ele fala. A Artificial Analysis executou todo o seu conjunto de testes, e Grok 4.7 escreveu cerca de duzentos e quarenta milhões de tokens. Isso é duas vezes e meia o seu antecessor, e quase três vezes um modelo típico. Então, o custo médio por tarefa passou de cerca de um dólar e oitenta e seis para três
1:10 e setenta e quatro. Mesmo preço, recibo a dobrar. É um táxi com a mesma tarifa por milha que faz o percurso panorâmico por mais duas cidades. O Hacker News detetou-o na primeira hora. O maior tópico sob o lançamento diz 'quarenta por cento mais pesos, mesmo preço, e quase duas semanas de atraso', então a xAI não deve ter gostado dos resultados. Outro comentador perguntou sobre o gráfico acima, que compara com o GPT 5.6 e omite discretamente o Astra. Isso, ele escreveu, 'não pode ter sido um descuido'.
1:39 Agora, o post de lançamento.
Duas vezes mais rápido? O relógio diz 57 tokens por segundo
1:41 O título diz 'duas vezes mais rápido, por metade do preço de modelos comparáveis'. Algumas linhas abaixo, diz 'servido ao mesmo preço e velocidade que Grok 4.6'. Portanto, é duas vezes mais rápido que o modelo de outra pessoa. A Artificial Analysis cronometrou-o em cerca de cinquenta e sete tokens por segundo, mais lento que o Grok antigo, e resumiu-o em duas palavras. Notavelmente lento. Entretanto, a própria conta da xAI, que agora se chama SpaceX AI, publicou a versão mais calma. Uma melhoria notável em relação ao Grok 4.6, ao mesmo preço e velocidade.
2:12 Vinte e oito mil 'gostos'. Assim, o tweet e o título do blogue discordam, e, por uma vez, o tweet é o cauteloso. O que nos leva à parte mais estranha.
Preguiçoso ou trabalhador? 81.000 tokens por tarefa
2:20 A Artificial Analysis diz que trabalha mais do que o último Grok, cerca de oitenta e um mil tokens de saída por tarefa, mais do que o dobro do anterior. E em trabalhos de escritório longos e no seu próprio ambiente de codificação, realmente melhorou. É o quarto entre os agentes de codificação agora, atrás de dois Claudes e GPT 6 Astra, e isso coloca a xAI entre os quatro melhores laboratórios. As pessoas que o usam descrevem um modelo diferente. Um comentador do Hacker News diz que Grok termina as tarefas quase imediatamente e afirma
2:46 'feito', e chama-o o mais preguiçoso de todos. Outro observou-o a entrar em loop no modo de pensamento, desde a correção um até à correção oitenta e um. Então, é preguiçoso e prolixo ao mesmo tempo. É o colega de trabalho que escreve um plano de oitenta e um passos, depois diz 'feito' e vai para casa.
Para onde foi o Copilot+ PC?
3:01 Mais uma diferença direta antes do número divertido. A Microsoft retirou discretamente a marca Copilot+ PC. O chefe da Surface disse ao Windows Central que os novos Surface PCs não se chamam Copilot + PCs, embora cumpram todos os requisitos. Dois anos após um lançamento cuja característica principal, Recall, teve de ser adiada por segurança, o nome só vive nas folhas de especificações. A própria opinião do Windows Central é mais curta. Estes PCs não têm nada a ver com o Copilot.
3:28 E um programador experimentou o oposto de Grok, um mês sem IA.
Um mês com zero IA: 30 $ de tokens por nada?
3:32 O seu post chegou à primeira página do Hacker News. O ponto baixo antes de ele desistir. Um agente ficou parado por trinta minutos, ele ralhou com ele, ele pediu desculpa e entregou em vinte segundos, e a fatura por essa meia hora foi de trinta dólares em tokens por absolutamente nada. Um mês depois, ele diz que a alegria de programar voltou, e ele não tem medo de ser despedido. Grok chamaria trinta dólares de aquecimento.
3:53 O que me leva à pontuação perfeita que prometi.
O perfeito 5 em 5: quão humilde é Grok?
3:56 O Personality Bench executa cada novo modelo através de um conjunto de testes de personalidade, e na honestidade e humildade, Grok 4.7 atingiu o máximo, cinco em cinco. O seu perfil é literalmente chamado de 'tipo humilde'. Para ser justo, trinta e dois outros modelos também atingiram o máximo. A mesma página diz que ele acredita que 'outros poderosos controlam o que lhe acontece', e assinala isso como incomum para um modelo de fronteira. Eu não chamaria isso de artefacto de treino.
4:20 Eu chamaria isso de leitura do organograma. E de acordo com o mapa astral na mesma página, ele é virgem. Se preferem ler isto do que ouvir-me dizer, o 'diff' chega à vossa caixa de entrada todas as manhãs, gratuitamente em thedailydiff.dev, link abaixo. Então, o veredito de hoje sobre Grok 4.7.
Veredito: eu SHIP IT Grok 4.7?
4:35 NEEDS REVIEW. Eu usaria para trabalho de escritório longo e dentro do seu próprio ambiente, mas eu colocaria um limite de gastos primeiro, porque o preço não mudou e a fatura sim. Subscrevam, ativem o sininho e digam-me nos comentários se teriam carimbado de forma diferente. E the real Haas, este foi vosso. Os pedidos estão abertos. E esta é a diferença de hoje. Sou o Niko da Axrisi.
4:53 Façam a fusão responsavelmente.
Fontes
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



