Grok 4.7 cuesta lo mismo, pero factura el doble
Grok 4.7 cuesta exactamente lo mismo por token que Grok 4.6, $2 de entrada y $6 de salida.
Grok 4.7 cuesta exactamente lo mismo por token que Grok 4.6, $2 de entrada y $6 de salida. Entonces, ¿por qué la factura independiente por tarea se duplicó, y es realmente "el doble de rápido"? Un seguimiento una semana después. Solicitado por @therealhaas. Veredicto: NEEDS REVIEW.
Leer la edición escrita (inglés) ↗
Lo que cubre este video
- ¿Mismo precio, doble factura?
- ¿Por qué $2 / $6 ahora cuesta $3.74 por tarea?
- ¿El doble de rápido? El reloj dice 57 tokens por segundo
- ¿Flojo o trabajador? 81,000 tokens por tarea
- ¿A dónde se fue la Copilot+ PC?
Transcripción traducida
Traducido de la narración original en inglés. El audio y los subtítulos disponibles son controlados por YouTube.
¿Mismo precio, doble factura?
0:00 Uno pensaría que el mismo precio significa la misma factura. El lunes les dije que Grok cuatro punto siete cuesta exactamente lo mismo que Grok cuatro punto seis. Por token, sí. Por tarea, cuesta el doble. En este video, tres preguntas. ¿Por qué el mismo precio cuesta el doble? ¿Es realmente el doble de rápido, como dice la publicación de lanzamiento? ¿Y es el modelo más flojo o el más trabajador?
0:20 Además, este es por petición. The real Haas preguntó en el video del viernes, ¿puedes hacer un video sobre Grok cuatro punto siete, dos puntos D. Respondimos, pan comido, más tarde hoy. Para cuando veas esto, probablemente sea mañana, así que lo enviamos tarde. Relájate, también Grok, con unas dos semanas de retraso, si le crees a Hacker News. Y una prueba le dio a Grok un perfecto cinco de cinco. Es mi número favorito de la semana, y lo mencionaré al final.
0:44 Es sábado, veintiséis de septiembre, y este es The Daily Diff.
¿Por qué $2 / $6 ahora cuesta $3.74 por tarea?
0:48 Aquí está el truco. El precio por token no se movió, dos dólares de entrada y seis de salida, por millón. Lo que se movió fue cuánto habla. Artificial Analysis ejecutó toda su suite de pruebas, y Grok cuatro punto siete escribió unos doscientos cuarenta millones de tokens. Eso es dos veces y media su predecesor, y casi tres veces un modelo típico. Así que el costo promedio por tarea pasó de aproximadamente un dólar ochenta y seis a tres
1:10 setenta y cuatro. Mismo precio, doble la factura. Es un taxi con la misma tarifa por milla que toma la ruta escénica a través de otras dos ciudades. Hacker News lo detectó en la primera hora. El hilo más grande bajo el lanzamiento dice cuarenta por ciento más de pesos, mismo precio, y casi dos semanas tarde, así que a xAI no le deben haber gustado los resultados. Otro comentarista preguntó sobre el gráfico de arriba, que compara con GPT cinco punto seis y discretamente omite a Astra. Eso, escribió, no pudo haber sido un descuido.
1:39 Ahora, la publicación de lanzamiento.
¿El doble de rápido? El reloj dice 57 tokens por segundo
1:41 El titular dice el doble de rápido, a la mitad del precio de modelos comparables. Unas líneas más abajo, dice que se ofrece al mismo precio y velocidad que Grok cuatro punto seis. Así que es el doble de rápido que el modelo de otra persona. Artificial Analysis lo cronometró en unos cincuenta y siete tokens por segundo, más lento que el viejo Grok, y lo resumió en dos palabras. Notablemente lento. Mientras tanto, la propia cuenta de xAI, que ahora se llama SpaceX AI, publicó la versión más tranquila. Una mejora notable sobre Grok cuatro punto seis, al mismo precio y velocidad.
2:12 Veintiocho mil me gusta. Así que el tweet y el titular del blog no concuerdan, y por una vez el tweet es el precavido. Lo que nos lleva a la parte más extraña.
¿Flojo o trabajador? 81,000 tokens por tarea
2:20 Artificial Analysis dice que trabaja más duro que el último Grok, unos ochenta y un mil tokens de salida por tarea, más del doble que el anterior. Y en trabajos de oficina largos y en su propio entorno de codificación, realmente mejoró. Ahora es el cuarto entre los agentes de codificación, detrás de dos Claudes y GPT seis Astra, y eso pone a xAI entre los cuatro mejores laboratorios. La gente que lo usa describe un modelo diferente. Un comentarista de Hacker News dice que Grok termina las tareas casi de inmediato y dice
2:46 listo, y lo llama el más flojo de todos. Otro lo vio en bucle en modo de pensamiento, desde la corrección uno hasta la corrección ochenta y uno. Así que es flojo y verboso al mismo tiempo. Es el compañero de trabajo que escribe un plan de ochenta y un pasos, luego dice listo y se va a casa.
¿A dónde se fue la Copilot+ PC?
3:01 Una diferencia más directa antes del número divertido. Microsoft ha retirado discretamente la marca Copilot plus PC. El jefe de Surface le dijo a Windows Central que las nuevas Surface PC no se llaman Copilot plus PC, aunque cumplen con todos los requisitos. Dos años después de un lanzamiento cuya característica principal, Recall, tuvo que ser retrasada por seguridad, el nombre solo vive en las hojas de especificaciones. La propia opinión de Windows Central es más corta. Estas PC no tienen nada que ver con Copilot.
3:28 Y un desarrollador probó lo contrario de Grok, un mes sin IA.
Un mes con cero IA: ¿$30 en tokens por nada?
3:32 Su publicación llegó a la página principal de Hacker News. El punto más bajo antes de que renunciara. Un agente se quedó atascado durante treinta minutos, lo regañó, se disculpó y lo entregó en veinte segundos, y la factura de esa media hora fue de treinta dólares en tokens por absolutamente nada. Un mes después dice que la alegría de programar ha vuelto, y no tiene miedo de ser despedido. Grok llamaría treinta dólares un calentamiento.
3:53 Lo que me lleva a la puntuación perfecta que prometí.
El perfecto 5 de 5: ¿qué tan humilde es Grok?
3:56 Personality Bench ejecuta cada nuevo modelo a través de una pila de pruebas de personalidad, y en honestidad y humildad, Grok cuatro punto siete obtuvo la máxima puntuación, cinco de cinco. Su perfil se llama literalmente el tipo humilde. Para ser justos, otros treinta y dos modelos también obtuvieron la máxima puntuación. La misma página dice que cree que otros poderosos controlan lo que le sucede, y lo señala como inusual para un modelo de frontera. Yo no lo llamaría un artefacto de entrenamiento.
4:20 Yo lo llamaría leer el organigrama. Y según la carta natal en la misma página, es Virgo. Si prefieres leer esto que oírme decirlo, el diff llega a tu bandeja de entrada todas las mañanas, gratis en the daily diff dot dev, enlace abajo. Entonces, el veredicto de hoy sobre Grok cuatro punto siete.
Veredicto: ¿lanzaría Grok 4.7?
4:35 NEEDS REVIEW. Lo usaría para trabajos de oficina largos y dentro de su propio entorno, pero primero le pondría un límite de gasto, porque el precio no cambió y la factura sí. Suscríbete, dale a la campana, y dime en los comentarios si lo habrías marcado de forma diferente. Y el real Haas, este fue tuyo. Las solicitudes están abiertas. Y esa es la diferencia de hoy. Soy Niko de Axrisi.
4:53 Fusiona responsablemente.
Fuentes
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



