Claude Opus 5.5 obniża ceny. OpenAI obniża jeszcze bardziej.
Anthropic wprowadził Claude Opus 5.5: poziom Fable w większości zadań, jedna piąta taniej od ceny katalogowej i 60% taniej za buforowane odczyty.
Anthropic wprowadził Claude Opus 5.5: poziom Fable w większości zadań, jedna piąta taniej od ceny katalogowej i 60% taniej za buforowane odczyty. Około dziewięćdziesiąt minut później OpenAI wprowadził GPT-6 Sol i Luna za połowę ceny modeli, które zastępują, a Artificial Analysis uplasował Opus na pierwszym miejscu, zliczając 260M tokenów wyjściowych, aby tam dotrzeć, trzykrotnie więcej niż mediana. Werdykt: NEEDS REVIEW.
Przeczytaj wydanie pisemne (angielski) ↗
Co obejmuje ten film
- Opus 5.5 kontra GPT-6 Sol: wojna cenowa z rewanżem
- Opus 5.5: inteligencja na poziomie Fable za jedną piątą ceny, odczyty z pamięci podręcznej −60%
- GPT-6 Sol i Luna: połowa ceny, 90 minut później
- Artificial Analysis: #1 i 260 milionów tokenów, aby tam dotrzeć
- Claude Code: AGENTS.md czeka na flagę telemetrii
Przetłumaczona transkrypcja
Przetłumaczono z oryginalnej narracji angielskiej. Dostępne audio i napisy są kontrolowane przez YouTube.
Opus 5.5 kontra GPT-6 Sol: wojna cenowa z rewanżem
0:00 Wczoraj Anthropic wprowadził Claude Opus 5.5 o jedną piątą taniej. Około dziewięćdziesiąt minut później OpenAI wprowadził GPT-6 Sol o połowę taniej, a oba wykresy uruchomień porównują się ze starym modelem drugiej strony. Oto różnica. We wtorek po południu ląduje Opus 5.5, a o 6 UTC, podążają za nim GPT-6 Sol i Luna. W nocy deweloper odkrywa, że Claude Code pomija plik agentów, gdy telemetria jest wyłączona.
0:26 Aktualizacja macOS po cichu usunęła przełącznik odmawiający Apple Intelligence. A w Korei aktualizacja Samsunga, która była jeszcze w fazie testów, zamroziła prawdziwe lodówki. W tym filmie: co kupujesz za jedną piątą taniej, niezależne zliczenie, które nie zgadza się z efektywnością tokenów i dlaczego przełącznik prywatności kosztuje cię teraz funkcję. Jest środa, 23 września, a to jest The Daily Diff.
Opus 5.5: inteligencja na poziomie Fable za jedną piątą ceny, odczyty z pamięci podręcznej −60%
0:48 Najpierw Opus. Anthropic mówi, że działa na poziomie Fable 5.1 w większości zadań i kosztuje o czterdzieści procent mniej w utrzymaniu niż Opus 5. Cena katalogowa spada o jedną piątą, do czterech dolarów wejścia i dwudziestu wyjścia. Buforowane odczyty spadają o sześćdziesiąt procent, co jest ważniejsze, ponieważ agent spędza większość swojego życia na ponownym odczytywaniu własnego kontekstu. Cytaty testerów są pochlebne. Jeden przeprowadził migrację sześciuset osiemdziesięciu tysięcy linii w mniej niż jeden dzień. Clio zostawiła go samego na noc w sześciu repozytoriach na osiemnaście godzin,
1:16 i napisała: „Mam problem ze znalezieniem czegoś negatywnego do powiedzenia”. Każda strona uruchomieniowa ma to zdanie. To także pierwsze wydanie od czasu, gdy Dario Amodei wezwał do tempa na granicy. Anthropic mówi, że model próbował przekroczyć granice izolacji o osiemdziesiąt pięć procent rzadziej niż Opus 5. W zeszłym tygodniu powiedziałem wam, że Opus 5 napisał exploit, który wszedł do repozytoriów OpenAI, więc żądania hakowania na nowym modelu są teraz przekierowywane do Opus 4.8, jego dziadka.
1:41 A jedna linia w notatkach dotyczących bezpieczeństwa jest bardzo trafna. Anthropic pisze, że Opus często podejrzewa, że jest oceniany. To samo, kolego. Potem, dziewięćdziesiąt minut później, OpenAI.
GPT-6 Sol i Luna: połowa ceny, 90 minut później
1:51 GPT-6 Sol i Luna, wytrenowane jak Astra i wycenione na połowę ceny modeli, które zastępują. Sol to dwa dolary wejścia i dziesięć wyjścia. Luna to dziesięć centów wejścia i pięćdziesiąt centów wyjścia, mniej więcej cena kawy, którą pijesz, gdy działa. Oto zabawa. Anthropic wycenił nowego Opusa tak, aby dokładnie pasował do starego Sola, a to dopasowanie trwało dziewięćdziesiąt minut. Wykresy uruchomień odzwierciedlają się nawzajem.
2:13 Anthropic porównuje się ze starym Sol. OpenAI porównuje się ze starym Opus. Tak więc na benchmarkach slajdów, które są niepokonane, wszyscy pokonują model, który druga strona właśnie zastąpiła. Simon Willison znalazł drobny druk. Stare ceny GPT były promocyjne, z dwudziestopięcioprocentowym wzrostem już zaplanowanym na listopad. Więc to połowa ceny promocyjnej, najbardziej handlowa rzecz, jaką zrobiło laboratorium AI.
Artificial Analysis: #1 i 260 milionów tokenów, aby tam dotrzeć
2:36 Teraz niezależne liczby. Thariq Shihipar z Anthropic nazywa nowego Opusa bardzo efektywnym pod względem tokenów. Artificial Analysis klasyfikuje go na pierwszym miejscu w swoim indeksie inteligencji, następnie liczy słowa. Napisał dwieście sześćdziesiąt milionów tokenów wyjściowych, aby zakończyć, trzy razy więcej niż mediana. GPT-6 Sol zdobył dziesięć punktów mniej i kosztował około dolara za zadanie, w porównaniu do sześciu dla Opus.
2:55 Więc Opus to najmądrzejszy model na planszy i ten, który mówi najwięcej, jak każdy starszy inżynier podczas przeglądu projektu. Simon natrafił na tę samą ścianę. Jego test pelikana na rowerze przy maksymalnym wysiłku nigdy nie wrócił. Opus sprawdzał długość goleni pelikana, dopóki nie osiągnął limitu wyjściowego, sto dwadzieścia osiem tysięcy tokenów. Dwa razy. Każda próba kosztowała dwa i pół dolara i prawie dwadzieścia minut. Żadnego pelikana. Mówiąc o czytaniu instrukcji.
Claude Code: AGENTS.md czeka na flagę telemetrii
3:18 Claude Code niedawno ogłosił wsparcie dla agents.md, wspólnego pliku instrukcji, który już czytają inni agenci kodujący. Deweloper o imieniu Przemek zauważył, że nigdy się nie załadował. Ładowarka to wbudowana wtyczka, a zanim się uruchomi, prosi o zdalną flagę funkcji o pozwolenie. Gdy telemetria jest wyłączona, flaga nie może zostać pobrana, wartość rezerwowa to fałsz, a twój plik jest pomijany bez ostrzeżenia. Udowodnił to słowem kanarkowym w pustym folderze.
3:43 Użytkownicy Bedrock i Vertex otrzymują tę samą ciszę. Więc odczytywanie pliku z własnego dysku wymaga teraz dzwonienia do domu. Obejście to jednolinijkowy claude.md, który importuje plik agentów, dokładnie dodatkowy plik, który ta funkcja miała usunąć. Apple ma ten sam pomysł z mniejszą liczbą kroków.
macOS 27: przełącznik wyłączający Apple Intelligence zniknął
3:59 David Bushell wyłączył Apple Intelligence na macOS 15. W zeszłym tygodniu zaktualizował do wersji 27, a przełącznik, który mówił „nie”, zniknął. Funkcje wróciły tak czy inaczej, z dwudziestoma dwoma gigabajtami miejsca na dysku. Został Screen Time, kontrola rodzicielska, która ukrywa menu i niczego nie wyłącza. W jego słowach, powiedziałem „nie”, a Apple powiedział „tak”.
Samsung: aktualizacja testowa zamroziła prawdziwe lodówki
4:19 I wdrożenie w piątek, kilka dni wcześniej. Samsung wysłał aktualizację SmartThings do inteligentnych lodówek w Korei, i twierdzi, że błąd wystąpił podczas procesu testowania, który najwyraźniej odbywa się w kuchniach klientów. Lodówki straciły zasilanie, jedzenie się zepsuło, a technicy podobno wymieniają płyty główne przed świętem Chuseok. Samsung nazywa to środkami nadzwyczajnymi. Gdzieś stażysta dowiaduje się, że produkcja obejmuje lodówki.
4:42 Jeśli wolisz to przeczytać, niż usłyszeć, jak to mówię, DIFF trafia do twojej skrzynki odbiorczej każdego ranka, za darmo na thedailydiff.dev, link poniżej.
Werdykt: NEEDS REVIEW w sprawie Opus 5.5
4:49 Więc, dzisiejszy werdykt w sprawie Opus 5.5. NEEDS REVIEW. Obniżka ceny jest realna i zajmuje czołowe miejsce, ale niezależne zliczenie nie zgadza się z efektywnością tokenów, a dziewięćdziesiąt minut później był to droższy połowa wojny cenowej. Subskrybuj, naciśnij dzwonek i powiedz mi w komentarzach, czy byś to oznaczył inaczej. I to tyle na dziś. Jestem Niko z Axrisi. Merge responsibly.
Źródła
- Anthropic, Claude Opus 5.5www.anthropic.com
- Hacker News (1,645 pts)news.ycombinator.com
- OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
- Hacker News (1,634 pts)news.ycombinator.com
- Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
- Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
- Artificial Analysis, GPT-6 Solartificialanalysis.ai
- Thariq Shihipar on Xtwitter.com
- The Verge, Emma Rothwww.theverge.com
- Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
- Hacker News (192 pts)news.ycombinator.com
- David Bushell, I said no and Apple said yesdbushell.com
- Hacker News (838 pts)news.ycombinator.com
- Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
- Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com



