Claude Opus 5.5 redueix els preus. OpenAI redueix encara més.
Anthropic va llançar Claude Opus 5.5: nivell de Fable en la majoria del treball, un cinquè del preu original i un 60% de descompte en lectures en memòria cau.
Anthropic va llançar Claude Opus 5.5: nivell de Fable en la majoria del treball, un cinquè del preu original i un 60% de descompte en lectures en memòria cau. Uns noranta minuts més tard, OpenAI va llançar GPT-6 Sol i Luna a la meitat del preu dels models que substitueixen, i Artificial Analysis va classificar Opus en primer lloc mentre comptava 260M de tokens de sortida per arribar-hi, el triple de la mediana. Veredicte: NEEDS REVIEW.
Llegeix l'edició escrita (anglès) ↗
Què cobreix aquest vídeo
- Opus 5.5 vs GPT-6 Sol: una guerra de preus amb una revenja
- Opus 5.5: cervells de Fable amb un cinquè de descompte, lectures de memòria cau −60%
- GPT-6 Sol i Luna: la meitat de preu, 90 minuts més tard
- Anàlisi Artificial: #1, i 260M de tokens per arribar-hi
- Codi de Claude: AGENTS.md espera un flag de telemetria
Transcripció traduïda
Traduït de la narració original en anglès. L'àudio i els subtítols disponibles estan controlats per YouTube.
Opus 5.5 vs GPT-6 Sol: una guerra de preus amb una revenja
0:00 Ahir, Anthropic va llançar Claude Opus cinc punt cinc amb un cinquè de descompte. Uns noranta minuts més tard, OpenAI va llançar GPT sis Sol amb la meitat de descompte, i ambdues gràfiques de llançament es comparen amb el model antic de l'altra banda. Així que aquí teniu la diferència. Dimarts a la tarda, Opus cinc punt cinc arriba, i a les sis UTC, GPT sis Sol i Luna el segueixen. Durant la nit, un desenvolupador troba que Claude Code salta el vostre fitxer d'agents quan la telemetria està desactivada.
0:26 Una actualització de macOS va eliminar silenciosament l'interruptor que deia 'no' a Apple Intelligence. I a Corea, una actualització de Samsung que encara estava en proves va congelar neveres reals. En aquest vídeo, què et compra un cinquè de descompte, el recompte independent que discrepa amb l'eficiència de tokens, i per què un interruptor de privacitat ara et costa una funció. És dimecres, 23 de setembre, i aquesta és The Daily Diff.
Opus 5.5: cervells de Fable amb un cinquè de descompte, lectures de memòria cau −60%
0:48 Primer, Opus. Anthropic diu que funciona al nivell de Fable cinc punt u en la majoria del treball, i costa un quaranta per cent menys de funcionar que Opus cinc. El preu de venda baixa un cinquè, a quatre dòlars d'entrada i vint de sortida. Les lectures en memòria cau baixen un seixanta per cent, cosa que importa més, perquè un agent passa la major part de la seva vida rellegint el seu propi context. Les cites dels provadors són brillants. Un va realitzar una migració de sis-centes vuitanta mil línies en menys d'un dia. Clio el va deixar sol durant la nit a sis repositoris durant divuit hores,
1:16 i va escriure: 'Em costa trobar res negatiu a dir.' Totes les pàgines de llançament tenen aquesta frase. També és el primer llançament des que Dario Amodei va demanar que es posés un ritme a la frontera. Anthropic diu que el model va intentar creuar els límits de contenció un vuitanta-cinc per cent menys sovint que Opus cinc. La setmana passada us vaig dir que Opus cinc va escriure l'exploit que va entrar als repositoris d'OpenAI, així que les sol·licituds de hacking del nou model ara es redirigeixen a Opus quatre punt vuit, el seu avi.
1:41 I una línia en les notes de seguretat és molt rellevant. Anthropic escriu que Opus sovint sospita que està sent avaluat. Igual, amic. Després, noranta minuts més tard, OpenAI.
GPT-6 Sol i Luna: la meitat de preu, 90 minuts més tard
1:51 GPT sis Sol i Luna, entrenats com Astra i amb un preu a la meitat dels models que substitueixen. Sol és dos dòlars d'entrada i deu de sortida. Luna és deu cèntims d'entrada i cinquanta cèntims de sortida, aproximadament el preu del cafè que beus mentre funciona. Aquí ve la part divertida. Anthropic va posar preu al nou Opus perquè coincidís exactament amb l'antic Sol, i aquesta coincidència va durar noranta minuts. Les gràfiques de llançament es reflecteixen mútuament.
2:13 Anthropic fa benchmarks contra l'antic Sol. OpenAI fa benchmarks contra l'antic Opus. Així, en els benchmarks de les presentacions, que són imbatibles, tothom supera un model que l'altra banda acaba de substituir. Simon Willison va trobar la lletra petita. Els antics preus de GPT eren promocionals, amb un augment del vint-i-cinc per cent ja programat per al novembre. Així que és la meitat del preu de venda, la cosa més 'retail' que ha fet un laboratori d'IA.
Anàlisi Artificial: #1, i 260M de tokens per arribar-hi
2:36 Ara els números independents. Thariq Shihipar d'Anthropic anomena el nou Opus 'molt eficient en tokens'. Artificial Analysis el classifica primer en el seu índex d'intel·ligència, després compta les paraules. Va escriure dos-cents seixanta milions de tokens de sortida per acabar, tres vegades la mediana. GPT sis Sol va obtenir deu punts menys i va costar aproximadament un dòlar per tasca, enfront de sis per a Opus.
2:55 Així que Opus és el model més intel·ligent de la junta, i el que parla més, com qualsevol enginyer sènior en una revisió de disseny. Simon va topar amb la mateixa paret. La seva prova del pelicà en bicicleta amb el màxim esforç mai va tornar. Opus va continuar comprovant la longitud de la tíbia del pelicà fins que va arribar al seu límit de sortida, cent vint-i-vuit mil tokens. Dues vegades. Cada intent va costar dos dòlars i mig i gairebé vint minuts. Sense pelicà. Parlant de llegir instruccions.
Codi de Claude: AGENTS.md espera un flag de telemetria
3:18 Claude Code va anunciar recentment el suport per a agents.md, el fitxer d'instruccions compartit que ja llegeixen altres agents de codificació. Un desenvolupador anomenat Przemek va notar que mai es carregava. El carregador és un connector integrat, i abans d'executar-se, demana permís a un flag de funció remot. Amb la telemetria desactivada, el flag no es pot obtenir, el valor per defecte és 'fals', i el vostre fitxer es salta sense avís. Ho va demostrar amb una paraula canari en una carpeta buida.
3:43 Els usuaris de Bedrock i Vertex obtenen el mateix silenci. Així que llegir un fitxer del vostre propi disc ara requereix 'telefonar a casa'. La solució alternativa és una línia claude.md que importa el fitxer d'agents, exactament el fitxer addicional que aquesta funció pretenia eliminar. Apple té la mateixa idea amb menys passos.
macOS 27: l'interruptor d'apagada d'Apple Intelligence ha desaparegut
3:59 David Bushell va desactivar Apple Intelligence a macOS quinze. La setmana passada va actualitzar a vint-i-set, i l'interruptor que deia 'no' ha desaparegut. Les funcions van tornar de totes maneres, amb vint-i-dos gigabytes de disc. El que queda és Screen Time, els controls parentals, que amaga els menús i no desactiva res. En les seves paraules, 'Vaig dir que no, i Apple va dir que sí.'
Samsung: una actualització de prova va congelar neveres reals
4:19 I un desplegament de divendres, uns dies abans. Samsung va enviar una actualització de SmartThings a les neveres intel·ligents a Corea, i diu que l'error va ocórrer durant el procés de prova, que aparentment s'executa a les cuines dels clients. Les neveres van perdre energia, el menjar es va fer malbé, i els tècnics, segons s'informa, estan canviant plaques base abans de la festa de Chuseok. Samsung ho anomena 'mesures d'emergència'. En algun lloc, l'intern està aprenent que la producció inclou neveres.
4:42 Si preferiu llegir això que sentir-ho, la diferència arriba a la vostra safata d'entrada cada matí, gratuïtament a the daily diff dot dev, enllaç a continuació.
Veredicte: NEEDS REVIEW a Opus 5.5
4:49 Així doncs, el veredicte d'avui sobre Opus cinc punt cinc. NEEDS REVIEW. La retallada de preus és real i encapçala el tauler, però el recompte independent discrepa amb l'eficiència de tokens, i noranta minuts més tard era la meitat més cara d'una guerra de preus. Subscriviu-vos, cliqueu la campana i digueu-me als comentaris si l'hauríeu marcat de manera diferent. I aquesta és la diferència d'avui. Sóc Niko d'Axrisi. Feu la fusió amb responsabilitat.
Fonts
- Anthropic, Claude Opus 5.5www.anthropic.com
- Hacker News (1,645 pts)news.ycombinator.com
- OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
- Hacker News (1,634 pts)news.ycombinator.com
- Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
- Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
- Artificial Analysis, GPT-6 Solartificialanalysis.ai
- Thariq Shihipar on Xtwitter.com
- The Verge, Emma Rothwww.theverge.com
- Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
- Hacker News (192 pts)news.ycombinator.com
- David Bushell, I said no and Apple said yesdbushell.com
- Hacker News (838 pts)news.ycombinator.com
- Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
- Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com



