Claude Opus 5.5 uli çmimet. OpenAI uli edhe më thellë.
Anthropic lëshoi Claude Opus 5.5: Niveli i Fables në shumicën e punëve, një e pesta zbritje nga çmimi fillestar dhe 60% zbritje në leximet e memorizuara.
Anthropic lëshoi Claude Opus 5.5: Niveli i Fables në shumicën e punëve, një e pesta zbritje nga çmimi fillestar dhe 60% zbritje në leximet e memorizuara. Rreth nëntëdhjetë minuta më vonë OpenAI lëshoi GPT-6 Sol dhe Luna me gjysmën e çmimit të modeleve që zëvendësojnë, dhe Artificial Analysis e renditi Opus-in të parin duke numëruar 260M shenja dalëse për të arritur aty, tre herë mesatarja. Vendimi: NEEDS REVIEW.
Lexoni edicionin e shkruar (anglisht) ↗
Çfarë mbulon kjo video
- Opus 5.5 vs GPT-6 Sol: një luftë çmimesh me një rimeç
- Opus 5.5: Truri i Fables me një të pestën zbritje, leximet nga cache -60%
- GPT-6 Sol dhe Luna: gjysmë çmimi, 90 minuta më vonë
- Analiza Artificiale: #1, dhe 260M shenja për të arritur aty
- Kodi Claude: AGENTS.md pret një flamur telemetrie
Transkript i përkthyer
Përkthyer nga tregimi origjinal në anglisht. Audio dhe titrat e disponueshme kontrollohen nga YouTube.
Opus 5.5 vs GPT-6 Sol: një luftë çmimesh me një rimeç
0:00 Dje Anthropic lançoi Claude Opus pesë pikë pesë me një të pestën zbritje. Rreth nëntëdhjetë minuta më vonë OpenAI lançoi GPT gjashtë Sol me gjysmën e çmimit, dhe të dyja tabelat e lançimit e krahasojnë veten me modelin e vjetër të palës tjetër. Pra, ja ndryshimi. Të martën pasdite, Opus pesë pikë pesë vjen, dhe në gjashtë UTC, GPT gjashtë Sol dhe Luna e ndjekin. Gjatë natës, një zhvillues zbulon se Kodi Claude kalon dosjen tuaj të agjentëve kur telemetria është e fikur.
0:26 Një azhurnim i macOS-it hoqi qetësisht çelësin që thoshte jo Apple Intelligence. Dhe në Kore, një azhurnim i Samsung-ut që ishte ende në testim ngrirë frigoriferë të vërtetë. Në këtë video, çfarë ju blen një e pesta zbritje, numri i pavarur që nuk pajtohet me efikasitetin e shenjave, dhe pse një çelës privatësie tani ju kushton një veçori. Është e mërkurë, 23 shtator, dhe ky është The Daily Diff.
Opus 5.5: Truri i Fables me një të pestën zbritje, leximet nga cache -60%
0:48 Së pari, Opus. Anthropic thotë se performon në nivelin e Fable pesë pikë një në shumicën e punëve, dhe kushton dyzet për qind më pak për t'u përdorur se Opus pesë. Çmimi fillestar bie një të pestën, në katër dollarë brenda dhe njëzet jashtë. Leximet e memorizuara bien gjashtëdhjetë për qind, gjë që ka më shumë rëndësi, sepse një agjent kalon pjesën më të madhe të jetës së tij duke rilexuar kontekstin e vet. Citimet e testuesve janë të ndritshme. Njëri bëri një migrim prej gjashtëqind e tetëdhjetë mijë rreshta në më pak se një ditë. Clio e la vetëm gjatë natës nëpër gjashtë depozita për tetëmbëdhjetë orë,
1:16 dhe shkroi, po luftoj të gjej diçka negative për të thënë. Çdo faqe lançimi ka atë fjali. Është gjithashtu lëshimi i parë që kur Dario Amodei bëri thirrje për të ritmuar kufirin. Anthropic thotë se modeli u përpoq të kalojë kufijtë e përmbajtjes tetëdhjetë e pesë për qind më rrallë se Opus pesë. Javën e kaluar ju thashë se Opus pesë shkroi shfrytëzimin që hyri në depozitat e OpenAI-s, kështu që kërkesat e hakimit në modelin e ri tani ridrejtohen te Opus katër pikë tetë, gjyshi i tij.
1:41 Dhe një rresht në shënimet e sigurisë është shumë i ngjashëm. Anthropic shkruan se Opus shpesh dyshon se po vlerësohet. Njëlloj, shok. Pastaj, nëntëdhjetë minuta më vonë, OpenAI.
GPT-6 Sol dhe Luna: gjysmë çmimi, 90 minuta më vonë
1:51 GPT gjashtë Sol dhe Luna, të trajnuar si Astra dhe të çmueshme në gjysmën e modeleve që zëvendësojnë. Sol është dy dollarë brenda dhe dhjetë jashtë. Luna është dhjetë cent brenda dhe pesëdhjetë cent jashtë, afërsisht çmimi i kafesë që pini ndërsa funksionon. Ja pjesa argëtuese. Anthropic e çmuesi Opus-in e ri për të përputhur saktësisht Sol-in e vjetër, dhe ajo përputhje zgjati nëntëdhjetë minuta. Tabelat e lançimit pasqyrojnë njëra-tjetrën.
2:13 Anthropic bën krahasime kundër Sol-it të vjetër. OpenAI bën krahasime kundër Opus-it të vjetër. Pra, në krahasimet e slide-deck-ut, të cilat janë të pamposhtura, të gjithë mposhtin një model që pala tjetër sapo e zëvendësoi. Simon Willison gjeti detajet e vogla. Çmimet e vjetra të GPT ishin promovuese, me një rritje prej njëzet e pesë për qind të planifikuar tashmë për nëntor. Pra, është gjysmë çmimi i shitjes, gjëja më me pakicë që ka bërë një laborator AI.
Analiza Artificiale: #1, dhe 260M shenja për të arritur aty
2:36 Tani numrat e pavarur. Thariq Shihipar i Anthropic e quan Opus-in e ri shumë efikas në shenja. Artificial Analysis e rendit të parin në indeksin e inteligjencës së tij, pastaj numëron fjalët. Shkroi dyqind e gjashtëdhjetë milionë shenja dalëse për të përfunduar, tre herë mesatarja. GPT gjashtë Sol shënoi dhjetë pikë më pak dhe kushtoi rreth një dollar për detyrë, kundrejt gjashtë për Opus.
2:55 Pra, Opus është modeli më i zgjuar në bord, dhe ai që flet më shumë, si çdo inxhinier i lartë në një rishikim dizajni. Simon hasi në të njëjtin mur. Testi i tij i pelikanit në biçikletë me përpjekje maksimale nuk u kthye kurrë. Opus vazhdoi të kontrollonte gjatësinë e këmbës së pelikanit derisa arriti limitin e tij të daljes, njëqind e njëzet e tetë mijë shenja. Dy herë. Çdo përpjekje kushtoi dy e gjysmë dollarë dhe pothuajse njëzet minuta. Pa pelikan. Duke folur për leximin e udhëzimeve.
Kodi Claude: AGENTS.md pret një flamur telemetrie
3:18 Claude Code kohët e fundit njoftoi mbështetjen për agents.md, skedarin e përbashkët të udhëzimeve që agjentët e tjerë të kodimit lexojnë tashmë. Një zhvillues i quajtur Przemek vuri re se nuk u ngarkua kurrë. Ngarkuesi është një shtojcë e integruar, dhe para se të funksionojë, kërkon një veçori në distancë flamurin për leje. Me telemetrinë të fikur, flamuri nuk mund të tërhiqet, rikthimi është i rremë, dhe skedari juaj kalon pa paralajmërim. Ai e vërtetoi atë me një fjalë kanarinë në një dosje bosh.
3:43 Përdoruesit e Bedrock dhe Vertex marrin të njëjtën heshtje. Pra, leximi i një skedari nga disku juaj tani kërkon të thirret shtëpia. Zgjidhja është një rresht i claude.md që importon skedarin e agjentëve, pikërisht skedari shtesë që kjo veçori synohej të hiqte. Apple ka të njëjtën ide me më pak hapa.
macOS 27: çelësi çaktivizues i Apple Intelligence ka humbur
3:59 David Bushell e fik Apple Intelligence në macOS pesëmbëdhjetë. Javën e kaluar ai bëri azhurnim në njëzet e shtatë, dhe çelësi që thoshte jo ka humbur. Veçoritë u kthyen gjithsesi, me njëzet e dy gigabajt hapësirë disku. Ajo që ka mbetur është Screen Time, kontrollet prindërore, të cilat fshehin menutë dhe nuk fik asgjë. Me fjalët e tij, unë thashë jo, dhe Apple tha po.
Samsung: një azhurnim testimi ngrirë frigoriferë të vërtetë
4:19 Dhe një vendosje të premten, disa ditë më herët. Samsung shtyu një azhurnim SmartThings në frigoriferë inteligjentë në Kore, dhe thotë se gabimi ndodhi gjatë procesit të testimit, që me sa duket funksionon në kuzhinat e klientëve. Frigoriferët humbën energjinë, ushqimi u prish, dhe teknikët thuhet se po ndërrojnë pllakat amë para festës së Chuseok. Samsung e quan atë masa emergjence. Diku, praktikanti po mëson se prodhimi përfshin frigoriferë.
4:42 Nëse preferoni ta lexoni këtë në vend që të dëgjoni mua ta them, ndryshimi arrin në kutinë tuaj hyrëse çdo mëngjes, falas në the daily diff dot dev, lidhja më poshtë.
Vendimi: NEEDS REVIEW mbi Opus 5.5
4:49 Pra, vendimi i sotëm për Opus pesë pikë pesë. NEEDS REVIEW. Zbritja e çmimit është reale dhe kryeson tabelën, por numri i pavarur nuk pajtohet me efikasitetin e shenjave, dhe nëntëdhjetë minuta më vonë ishte gjysma më e shtrenjtë e një lufte çmimesh. Abonohuni, shtypni zilen, dhe më tregoni në komente nëse do ta kishit vulosur ndryshe. Dhe ky është ndryshimi për sot. Jam Niko nga Axrisi. Bashkohuni me përgjegjësi.
Burimet
- Anthropic, Claude Opus 5.5www.anthropic.com
- Hacker News (1,645 pts)news.ycombinator.com
- OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
- Hacker News (1,634 pts)news.ycombinator.com
- Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
- Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
- Artificial Analysis, GPT-6 Solartificialanalysis.ai
- Thariq Shihipar on Xtwitter.com
- The Verge, Emma Rothwww.theverge.com
- Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
- Hacker News (192 pts)news.ycombinator.com
- David Bushell, I said no and Apple said yesdbushell.com
- Hacker News (838 pts)news.ycombinator.com
- Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
- Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com



