Claude Opus 5.5 langetas hindu. OpenAI langetas sügavamale.
Anthropic andis välja Claude Opus 5.5: enamiku tööde puhul Fable-tasemel, viiendiku võrra soodsam piletihinnast ja 60% soodsam vahemällu salvestatud lugemistest.
Anthropic andis välja Claude Opus 5.5: enamiku tööde puhul Fable-tasemel, viiendiku võrra soodsam piletihinnast ja 60% soodsam vahemällu salvestatud lugemistest. Umbes üheksakümmend minutit hiljem andis OpenAI välja GPT-6 Sol ja Luna poole odavamalt, kui nende asendatavad mudelid, ning Artificial Analysis hindas Opust esimeseks, lugedes sinna jõudmiseks 260 miljonit väljundmärki, mis on kolm korda rohkem kui mediaan. Otsus: NEEDS REVIEW.
Loe kirjalikku väljaannet (inglise keeles) ↗
Mida see video hõlmab
- Opus 5.5 vs GPT-6 Sol: hinnasõda korduskohtumisega
- Opus 5.5: Fable ajud viiendiku võrra soodsamalt, vahemälu lugemised –60%
- GPT-6 Sol ja Luna: poole hinnaga, 90 minutit hiljem
- Artificial Analysis: #1 ja 260 miljonit märki sinna jõudmiseks
- Claude Code: AGENTS.md ootab telemeetria lippu
Tõlgitud transkriptsioon
Tõlgitud ingliskeelsest originaaljutustusest. Saadaolevat heli ja subtiitreid kontrollib YouTube.
Opus 5.5 vs GPT-6 Sol: hinnasõda korduskohtumisega
0:00 Eile käivitas Anthropic Claude Opus 5.5 viiendiku võrra soodsamalt. Umbes üheksakümmend minutit hiljem käivitas OpenAI GPT-6 Soli poole hinnaga, ja mõlemad käivitusgraafikud võrdlevad end teise poole vana mudeliga. Nii et siin on erinevus. Teisipäeva pärastlõunal saabub Opus 5.5 ja kell kuus UTC järgnevad GPT-6 Sol ja Luna. Üleöö avastab arendaja, et Claude Code jätab teie agendi faili vahele, kui telemeetria on välja lülitatud.
0:26 macOS-i uuendus eemaldas vaikselt lüliti, mis ütles Apple Intelligence'ile ei. Ja Koreas külmutas Samsungi uuendus, mis oli veel testimisel, päris külmikud. Selles videos, mida viiendiku võrra odavamalt saab, sõltumatu loendur, mis ei nõustu märgi efektiivsusega ja miks privaatsuslüliti nüüd maksab teile funktsiooni. On kolmapäev, 23. september, ja see on The Daily Diff.
Opus 5.5: Fable ajud viiendiku võrra soodsamalt, vahemälu lugemised –60%
0:48 Kõigepealt Opus. Anthropic ütleb, et see toimib enamiku tööde puhul Fable 5.1 tasemel ja selle käitamine maksab 40 protsenti vähem kui Opus 5. Piletihind langeb viiendiku võrra, neljale dollarile sisse ja kahekümnele välja. Vahemällu salvestatud lugemised langevad kuuskümmend protsenti, mis on olulisem, sest agent veedab suurema osa oma elust oma konteksti uuesti lugedes. Testija tsitaadid on kiitvad. Üks tegi 680 000-realise migratsiooni vähem kui päevaga. Clio jättis selle üleöö rahule kuues repos kaheksateist tundi,
1:16 ja kirjutas: „Mul on raske leida midagi negatiivset öelda.“ Igal käivituslehel on see lause. See on ka esimene väljalase pärast seda, kui Dario Amodei kutsus üles piiri tempot hoidma. Anthropic ütleb, et mudel üritas ületada piiramispiire 85 protsenti vähem sageli kui Opus 5. Eelmisel nädalal rääkisin teile, et Opus 5 kirjutas ekspluadi, mis sattus OpenAI repose, nii et uue mudeli häkkimistaotlused suunatakse nüüd Opus 4.8-le, selle vanaisale.
1:41 Ja üks rida ohutusmärkustes on väga samastatav. Anthropic kirjutab, et Opus kahtlustab sageli, et teda hinnatakse. Sama, sõber. Siis, üheksakümmend minutit hiljem, OpenAI.
GPT-6 Sol ja Luna: poole hinnaga, 90 minutit hiljem
1:51 GPT-6 Sol ja Luna, treenitud nagu Astra ja hinnaga poole odavamalt, kui nende asendatavad mudelid. Sol on kaks dollarit sisse ja kümme välja. Luna on kümme senti sisse ja viiskümmend senti välja, umbes kohvi hind, mida te joote selle käitamise ajal. Siin on naljakas osa. Anthropic hinnastas uue Opuse täpselt vana Soliga samaks, ja see vastavus kestis üheksakümmend minutit. Käivitusgraafikud peegeldavad üksteist.
2:13 Anthropic teeb võrdlusuuringuid vana Soli vastu. OpenAI teeb võrdlusuuringuid vana Opuse vastu. Nii et slaidiesitluse võrdlusuuringutes, mis on võitmatud, igaüks võidab mudelit, mille teine pool just asendas. Simon Willison leidis pisitrüki. Vanad GPT hinnad olid reklaami eesmärgil, 25-protsendiline hinnatõus oli juba planeeritud novembriks. Nii et see on poole hinnaga müügihinnast, kõige jaekaubanduslikum asi, mida AI labor on teinud.
Artificial Analysis: #1 ja 260 miljonit märki sinna jõudmiseks
2:36 Nüüd sõltumatud numbrid. Anthropicu Thariq Shihipar nimetab uut Opust väga märgi efektiivseks. Artificial Analysis asetab selle oma luureindeksis esikohale, siis loeb sõnu. See kirjutas lõpetamiseks kakssada kuuskümmend miljonit väljundmärki, kolm korda mediaanist rohkem. GPT-6 Sol kogus kümme punkti vähem ja maksis umbes dollari ülesande kohta, Opuse kuue vastu.
2:55 Nii et Opus on kõige targem mudel laual ja see, mis räägib kõige rohkem, nagu iga vaneminsener disainiülevaates. Simon sattus sama seina vastu. Tema pelikan jalgrattal testi maksimaalse pingutusega ei tulnud kunagi tagasi. Opus kontrollis pidevalt pelikani sääre pikkust, kuni see saavutas väljundpiiri, sada kakskümmend kaheksa tuhat märki. Kaks korda. Iga katse maksis kaks ja pool dollarit ja ligi kakskümmend minutit. Pelikanit polnud. Rääkides juhiste lugemisest.
Claude Code: AGENTS.md ootab telemeetria lippu
3:18 Claude Code teatas hiljuti toetusest agents.md-le, jagatud juhiste failile, mida teised kodeerimisagendid juba loevad. Arendaja nimega Przemek märkas, et see ei laadinud kunagi. Laadija on sisseehitatud plugin ja enne käivitumist küsib see kaugfunktsiooni lipult luba. Kui telemeetria on välja lülitatud, lippu ei saa tuua, varu on väär, ja teie fail jäetakse hoiatamata vahele. Ta tõestas seda kanarisõnaga tühjas kaustas.
3:43 Bedrocki ja Vertexi kasutajad saavad sama vaikuse. Nii et faili lugemine oma kettalt nõuab nüüd koju helistamist. Lahenduseks on üherealine claude.md, mis impordib agentsi faili, täpselt selle lisafaili, mille see funktsioon pidi eemaldama. Apple'il on sama idee vähemate sammudega.
macOS 27: Apple Intelligence väljalülitusnupp on kadunud
3:59 David Bushell lülitas Apple Intelligence'i macOS 15-l välja. Eelmisel nädalal uuendas ta versioonile 27 ja nupp, mis ütles ei, on kadunud. Funktsioonid tulid ikkagi tagasi, 22 gigabaidi kettaruumi kuluga. Alles on Screen Time, vanemlik kontroll, mis peidab menüüd ja ei lülita midagi välja. Tema sõnul: „Ma ütlesin ei, ja Apple ütles jah.“
Samsung: testuuendus külmutas päris külmikud
4:19 Ja reede väljalase, paar päeva varem. Samsung tõukas SmartThingsi uuenduse Korea nutikülmikutesse, ja ütleb, et viga tekkis testimisprotsessi käigus, mis ilmselt toimub klientide köökides. Külmikud kaotasid voolu, toit riknenes ja tehnikud vahetavad väidetavalt emaplaate enne Chuseoki pühi. Samsung nimetab seda hädaabinõudeks. Kuskil õpib praktikant, et tootmine hõlmab külmikuid.
4:42 Kui eelistate seda lugeda, mitte kuulda minu suust, siis diff saabub teie postkasti igapäevaselt, tasuta aadressil the daily diff dot dev, link allpool.
Otsus: NEEDS REVIEW Opus 5.5 kohta
4:49 Nii et tänane otsus Opus 5.5 kohta. NEEDS REVIEW. Hinnakärbe on reaalne ja see on edetabeli tipus, kuid sõltumatu loendur ei nõustu märgi efektiivsusega, ja üheksakümmend minutit hiljem oli see hinnasõja kallim pool. Telli, vajuta kella ja ütle kommentaarides, kas oleksid seda tembeldanud teisiti. Ja see on tänane erinevus. Mina olen Niko Axrisist. Ühenda vastutustundlikult.
Allikad
- Anthropic, Claude Opus 5.5www.anthropic.com
- Hacker News (1,645 pts)news.ycombinator.com
- OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
- Hacker News (1,634 pts)news.ycombinator.com
- Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
- Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
- Artificial Analysis, GPT-6 Solartificialanalysis.ai
- Thariq Shihipar on Xtwitter.com
- The Verge, Emma Rothwww.theverge.com
- Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
- Hacker News (192 pts)news.ycombinator.com
- David Bushell, I said no and Apple said yesdbushell.com
- Hacker News (838 pts)news.ycombinator.com
- Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
- Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com



