+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Grok 4.7 custa o mesmo, mas a conta dobra

Grok 4.7 custa exatamente o mesmo que Grok 4.6 por token, $2 de entrada e $6 de saída.

Grok 4.7 custa exatamente o mesmo que Grok 4.6 por token, $2 de entrada e $6 de saída. Então, por que a conta independente por tarefa dobrou, e é realmente "duas vezes mais rápido"? Um acompanhamento uma semana depois. Solicitado por @therealhaas. Veredito: NEEDS REVIEW.

Leia a edição escrita (Inglês) ↗

O que este vídeo aborda

  • Mesmo preço, conta em dobro?
  • Por que $2 / $6 agora custa $3,74 por tarefa?
  • Duas vezes mais rápido? O relógio marca 57 tokens por segundo
  • Preguiçoso ou trabalhador? 81.000 tokens por tarefa
  • Para onde foi o Copilot+ PC?

Transcrição traduzida

Traduzido da narração original em inglês. Áudio e legendas disponíveis são controlados pelo YouTube.

Mesmo preço, conta em dobro?

0:00 Você pensaria que o mesmo preço significa a mesma conta. Na segunda-feira eu disse que o Grok 4.7 custa exatamente o mesmo que o Grok 4.6. Por token, sim. Por tarefa, custa o dobro. Neste vídeo, três perguntas. Por que o mesmo preço custa o dobro? É realmente duas vezes mais rápido, como diz o post de lançamento? E é o modelo mais preguiçoso ou o mais trabalhador?

0:20 Além disso, este é um pedido. O @therealhaas perguntou no vídeo de sexta-feira, você pode fazer um vídeo sobre o Grok 4.7, :D. Nós respondemos, fácil, fácil, mais tarde hoje. Quando você assistir a isso, provavelmente será amanhã, então enviamos atrasado. Relaxe, o Grok também, cerca de duas semanas atrasado, se você acredita no Hacker News. E um teste deu ao Grok um perfeito cinco de cinco. É o meu número favorito da semana, e falarei sobre isso no final.

0:44 É sábado, 26 de setembro, e este é o The Daily Diff.

Por que $2 / $6 agora custa $3,74 por tarefa?

0:48 Aqui está o truque. O preço por token não mudou, dois dólares de entrada e seis de saída, por milhão. O que mudou é o quanto ele fala. A Artificial Analysis executou toda a sua suíte de testes, e o Grok 4.7 escreveu cerca de duzentos e quarenta milhões de tokens. Isso é duas vezes e meia o seu predecessor, e quase três vezes um modelo típico. Então, o custo médio por tarefa passou de cerca de um dólar e oitenta e seis para três

1:10 e setenta e quatro. Mesma etiqueta de preço, dobro do recibo. É um táxi com a mesma tarifa por milha que pega a rota panorâmica por outras duas cidades. O Hacker News percebeu isso na primeira hora. A maior thread sob o lançamento diz quarenta por cento mais pesos, mesmo preço, e quase duas semanas atrasado, então a xAI não deve ter amado os resultados. Outro comentarista perguntou sobre o gráfico acima, que compara com o GPT 5.6 e silenciosamente omite o Astra. Isso, ele escreveu, não pode ter sido um descuido.

1:39 Agora, o post de lançamento.

Duas vezes mais rápido? O relógio marca 57 tokens por segundo

1:41 O título diz duas vezes mais rápido, pela metade do preço de modelos comparáveis. Algumas linhas abaixo, diz servido com o mesmo preço e velocidade do Grok 4.6. Então é duas vezes mais rápido que o modelo de outra pessoa. A Artificial Analysis o cronometrou em cerca de cinquenta e sete tokens por segundo, mais lento que o Grok antigo, e resumiu em duas palavras. Notavelmente lento. Enquanto isso, a própria conta da xAI, que agora se chama SpaceX AI, postou a versão mais calma. Uma melhoria notável em relação ao Grok 4.6, com o mesmo preço e velocidade.

2:12 Vinte e oito mil curtidas. Então o tweet e o título do blog discordam, e pela primeira vez o tweet é o cauteloso. O que nos leva à parte mais estranha.

Preguiçoso ou trabalhador? 81.000 tokens por tarefa

2:20 A Artificial Analysis diz que ele trabalha mais duro que o último Grok, cerca de oitenta e um mil tokens de saída por tarefa, mais que o dobro do anterior. E em trabalhos de escritório longos e em seu próprio ambiente de codificação, ele realmente melhorou. Ele é o quarto entre os agentes de codificação agora, atrás de dois Claudes e do GPT 6 Astra, e isso coloca a xAI entre os quatro melhores laboratórios. As pessoas que o usam descrevem um modelo diferente. Um comentarista do Hacker News diz que o Grok encerra as tarefas quase imediatamente e afirma

2:46 concluído, e o chama de o mais preguiçoso de todos. Outro o observou em loop no modo de pensamento, da correção um até a correção oitenta e um. Então ele é preguiçoso e prolixo ao mesmo tempo. É o colega de trabalho que escreve um plano de oitenta e uma etapas, depois diz que está feito e vai para casa.

Para onde foi o Copilot+ PC?

3:01 Mais uma diferença direta antes do número divertido. A Microsoft aposentou discretamente a marca Copilot+ PC. O chefe da Surface disse ao Windows Central que os novos PCs Surface não são chamados Copilot + PCs, embora atendam a todos os requisitos. Dois anos após um lançamento cuja principal característica, o Recall, teve que ser atrasada por segurança, o nome vive apenas em folhas de especificações. A própria opinião do Windows Central é mais curta. Esses PCs não têm nada a ver com o Copilot.

3:28 E um desenvolvedor tentou o oposto do Grok, um mês sem IA.

Um mês com zero IA: $30 em tokens para nada?

3:32 Seu post chegou à primeira página do Hacker News. O ponto baixo antes de ele desistir. Um agente ficou parado por trinta minutos, ele o repreendeu, ele pediu desculpas e entregou em vinte segundos, e a conta por essa meia hora foi trinta dólares em tokens para absolutamente nada. Um mês depois ele diz que a alegria de programar voltou, e ele não tem medo de ser demitido. Grok chamaria trinta dólares de aquecimento.

3:53 O que me traz à pontuação perfeita que prometi.

O perfeito 5 de 5: quão humilde é o Grok?

3:56 O Personality Bench executa cada novo modelo através de uma pilha de testes de personalidade, e em honestidade e humildade, Grok 4.7 alcançou o máximo, cinco de cinco. Seu perfil é literalmente chamado de "tipo humilde". Para ser justo, trinta e dois outros modelos também alcançaram o máximo. A mesma página diz que ele acredita que outros poderosos controlam o que acontece com ele, e sinaliza isso como incomum para um modelo de fronteira. Eu não chamaria isso de artefato de treinamento.

4:20 Eu chamaria isso de leitura do organograma. E de acordo com o mapa astral na mesma página, ele é um virginiano. Se você preferir ler isso a me ouvir dizer, o diff chega à sua caixa de entrada todas as manhãs, gratuitamente em thedailydiff.dev, link abaixo. Então, o veredito de hoje sobre o Grok 4.7.

Veredito: eu SHIP IT o Grok 4.7?

4:35 NEEDS REVIEW. Eu o usaria para trabalhos de escritório longos e em seu próprio ambiente, mas eu colocaria um limite de gastos primeiro, porque o preço não mudou e a conta sim. Inscreva-se, ative o sino e me diga nos comentários se você o teria carimbado de forma diferente. E o @therealhaas, este foi seu. Pedidos estão abertos. E essa é a diferença de hoje. Eu sou Niko da Axrisi.

4:53 Faça o merge com responsabilidade.

Fontes

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

Vídeos relacionados