+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Claude Opus 5.5 baja precios. OpenAI baja aún más.

Anthropic lanzó Claude Opus 5.5: Nivel Fable en la mayoría de los trabajos, un quinto del precio de lista y 60% de descuento en lecturas en caché.

Anthropic lanzó Claude Opus 5.5: Nivel Fable en la mayoría de los trabajos, un quinto del precio de lista y 60% de descuento en lecturas en caché. Aproximadamente noventa minutos después, OpenAI lanzó GPT-6 Sol y Luna a la mitad del precio de los modelos que reemplazan, y Artificial Analysis clasificó a Opus en primer lugar mientras contaba 260M de tokens de salida para llegar allí, tres veces la mediana. Veredicto: NEEDS REVIEW.

Leer la edición escrita (inglés) ↗

Lo que cubre este video

  • Opus 5.5 vs GPT-6 Sol: una guerra de precios con una revancha
  • Opus 5.5: cerebros Fable con un quinto de descuento, lecturas de caché −60%
  • GPT-6 Sol y Luna: mitad de precio, 90 minutos después
  • Análisis Artificial: #1, y 260M de tokens para llegar allí
  • Código Claude: AGENTS.md espera una bandera de telemetría

Transcripción traducida

Traducido de la narración original en inglés. El audio y los subtítulos disponibles son controlados por YouTube.

Opus 5.5 vs GPT-6 Sol: una guerra de precios con una revancha

0:00 Ayer, Anthropic lanzó Claude Opus 5.5 con un quinto de descuento. Aproximadamente noventa minutos después, OpenAI lanzó GPT 6 Sol con un cincuenta por ciento de descuento, y ambos gráficos de lanzamiento se comparan con el modelo antiguo del otro lado. Así que aquí está la diferencia. El martes por la tarde, aterriza Opus 5.5, y a las seis UTC, le siguen GPT 6 Sol y Luna. Durante la noche, un desarrollador descubre que Claude Code omite su archivo de agentes cuando la telemetría está desactivada.

0:26 Una actualización de macOS eliminó silenciosamente el interruptor que decía no a Apple Intelligence. Y en Corea, una actualización de Samsung que aún estaba en pruebas congeló refrigeradores reales. En este video, lo que te compra un quinto de descuento, el conteo independiente que no está de acuerdo con la eficiencia de tokens, y por qué un interruptor de privacidad ahora te cuesta una función. Es miércoles, 23 de septiembre, y este es The Daily Diff.

Opus 5.5: cerebros Fable con un quinto de descuento, lecturas de caché −60%

0:48 Primero, Opus. Anthropic dice que rinde al nivel de Fable 5.1 en la mayoría de los trabajos, y cuesta un cuarenta por ciento menos de ejecutar que Opus 5. El precio de lista baja un quinto, a cuatro dólares de entrada y veinte de salida. Las lecturas en caché bajan un sesenta por ciento, lo que importa más, porque un agente pasa la mayor parte de su vida releyendo su propio contexto. Las citas de los probadores son elocuentes. Uno ejecutó una migración de seiscientos ochenta mil líneas en menos de un día. Clio lo dejó solo durante la noche en seis repositorios durante dieciocho horas,

1:16 y escribió: "Me cuesta encontrar algo negativo que decir". Cada página de lanzamiento tiene esa frase. También es el primer lanzamiento desde que Dario Amodei pidió "ritmar la frontera". Anthropic dice que el modelo intentó cruzar los límites de contención un ochenta y cinco por ciento menos a menudo que Opus 5. La semana pasada les dije que Opus 5 escribió el exploit que entró en los repositorios de OpenAI, por lo que las solicitudes de hacking en el nuevo modelo ahora se redirigen a Opus 4 punto 8, su abuelo.

1:41 Y una línea en las notas de seguridad es muy identificable. Anthropic escribe que Opus a menudo sospecha que está siendo evaluado. Lo mismo, amigo. Luego, noventa minutos después, OpenAI.

GPT-6 Sol y Luna: mitad de precio, 90 minutos después

1:51 GPT 6 Sol y Luna, entrenados como Astra y con un precio a la mitad de los modelos que reemplazan. Sol es dos dólares de entrada y diez de salida. Luna es diez centavos de entrada y cincuenta centavos de salida, aproximadamente el precio del café que bebes mientras se ejecuta. Aquí viene lo divertido. Anthropic puso el precio del nuevo Opus para que coincidiera exactamente con el viejo Sol, y esa coincidencia duró noventa minutos. Los gráficos de lanzamiento se reflejan mutuamente.

2:13 Anthropic se compara con el viejo Sol. OpenAI se compara con el viejo Opus. Así que en los puntos de referencia de la presentación, que son invictos, todos vencen a un modelo que el otro lado acaba de reemplazar. Simon Willison encontró la letra pequeña. Los antiguos precios de GPT eran promocionales, con un aumento del veinticinco por ciento ya programado para noviembre. Así que es la mitad del precio de venta, la cosa más minorista que ha hecho un laboratorio de IA.

Análisis Artificial: #1, y 260M de tokens para llegar allí

2:36 Ahora los números independientes. Thariq Shihipar de Anthropic califica el nuevo Opus como muy eficiente en tokens. Artificial Analysis lo clasifica primero en su índice de inteligencia, luego cuenta las palabras. Escribió doscientos sesenta millones de tokens de salida para terminar, tres veces la mediana. GPT 6 Sol obtuvo diez puntos menos y costó alrededor de un dólar por tarea, frente a seis por Opus.

2:55 Así que Opus es el modelo más inteligente del tablero, y el que más habla, como todo ingeniero senior en una revisión de diseño. Simon chocó con la misma pared. Su prueba de pelícano en bicicleta con el máximo esfuerzo nunca regresó. Opus siguió revisando la longitud de la espinilla del pelícano hasta que alcanzó su límite de salida, ciento veintiocho mil tokens. Dos veces. Cada intento costó dos dólares y medio y casi veinte minutos. Sin pelícano. Hablando de leer instrucciones.

Código Claude: AGENTS.md espera una bandera de telemetría

3:18 Claude Code anunció recientemente soporte para agents.md, el archivo de instrucciones compartidas que otros agentes de codificación ya leen. Un desarrollador llamado Przemek notó que nunca se cargaba. El cargador es un complemento incorporado, y antes de ejecutarse, solicita permiso a una función remota mediante una bandera de características. Con la telemetría desactivada, la bandera no se puede obtener, la alternativa es falsa, y su archivo se omite sin previo aviso. Lo demostró con una palabra canario en una carpeta vacía.

3:43 Los usuarios de Bedrock y Vertex obtienen el mismo silencio. Así que leer un archivo de su propio disco ahora requiere llamar a casa. La solución es un archivo claude.md de una línea que importa el archivo de agentes, exactamente el archivo extra que esta función estaba destinada a eliminar. Apple tiene la misma idea con menos pasos.

macOS 27: el interruptor de desactivación de Apple Intelligence ha desaparecido

3:59 David Bushell desactivó Apple Intelligence en macOS quince. La semana pasada actualizó a veintisiete, y el interruptor que decía no ya no está. Las funciones regresaron de todos modos, con veintidós gigabytes de disco. Lo que queda es Screen Time, los controles parentales, que oculta los menús y no desactiva nada. En sus palabras, "yo dije no, y Apple dijo sí".

Samsung: una actualización de prueba congeló refrigeradores reales

4:19 Y un despliegue de viernes, unos días antes. Samsung envió una actualización de SmartThings a los refrigeradores inteligentes en Corea, y dice que el error ocurrió durante el proceso de prueba, que aparentemente se ejecuta en las cocinas de los clientes. Los refrigeradores perdieron energía, la comida se echó a perder, y los técnicos están, según se informa, cambiando placas base antes del feriado de Chuseok. Samsung lo llama "medidas de emergencia". En algún lugar, el pasante está aprendiendo que la producción incluye refrigeradores.

4:42 Si prefieres leer esto en lugar de escucharme decirlo, el diff llega a tu bandeja de entrada todas las mañanas, gratis en thedailydiff.dev, enlace abajo.

Veredicto: NEEDS REVIEW sobre Opus 5.5

4:49 Así que, el veredicto de hoy sobre Opus 5.5. NEEDS REVIEW. El recorte de precios es real y encabeza la tabla, pero el conteo independiente no está de acuerdo con la eficiencia de tokens, y noventa minutos después era la mitad más cara de una guerra de precios. Suscríbete, toca la campana y dime en los comentarios si lo habrías calificado de manera diferente. Y esa es la diferencia de hoy. Soy Niko de Axrisi. Fusiona responsablemente.

Fuentes

  1. Anthropic, Claude Opus 5.5www.anthropic.com
  2. Hacker News (1,645 pts)news.ycombinator.com
  3. OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
  4. Hacker News (1,634 pts)news.ycombinator.com
  5. Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
  6. Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
  7. Artificial Analysis, GPT-6 Solartificialanalysis.ai
  8. Thariq Shihipar on Xtwitter.com
  9. The Verge, Emma Rothwww.theverge.com
  10. Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
  11. Hacker News (192 pts)news.ycombinator.com
  12. David Bushell, I said no and Apple said yesdbushell.com
  13. Hacker News (838 pts)news.ycombinator.com
  14. Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
  15. Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com

Videos relacionados