+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Claude Opus 5.5 senkt Preise. OpenAI senkt noch stärker.

Anthropic lieferte Claude Opus 5.5: Fabel-Niveau bei den meisten Aufgaben, ein Fünftel weniger als der Listenpreis und 60% Rabatt auf zwischengespeicherte Lesevorgänge.

Anthropic lieferte Claude Opus 5.5: Fabel-Niveau bei den meisten Aufgaben, ein Fünftel weniger als der Listenpreis und 60% Rabatt auf zwischengespeicherte Lesevorgänge. Etwa neunzig Minuten später lieferte OpenAI GPT-6 Sol und Luna zum halben Preis der Modelle, die sie ersetzen, und Artificial Analysis stufte Opus als Ersten ein, während sie 260 Millionen Output-Token zählten, um dorthin zu gelangen, dreimal so viel wie der Median. Urteil: NEU BEWERTEN.

Die schriftliche Ausgabe lesen (Englisch) ↗

Was dieses Video behandelt

  • Opus 5.5 vs GPT-6 Sol: Ein Preiskampf mit einem Rückspiel
  • Opus 5.5: Fabelhafte Intelligenz mit einem Fünftel Rabatt, Cache-Lesevorgänge −60%
  • GPT-6 Sol und Luna: halber Preis, 90 Minuten später
  • Artificial Analysis: Nr. 1, und 260 Millionen Token, um dorthin zu gelangen
  • Claude Code: AGENTS.md wartet auf ein Telemetrie-Flag

Übersetztes Transkript

Aus der englischen Originalerzählung übersetzt. Verfügbare Audio- und Untertitel werden von YouTube gesteuert.

Opus 5.5 vs GPT-6 Sol: Ein Preiskampf mit einem Rückspiel

0:00 Gestern startete Anthropic Claude Opus 5.5 mit einem Fünftel Rabatt. Etwa neunzig Minuten später startete OpenAI GPT 6 Sol zum halben Preis, und beide Startcharts vergleichen sich mit dem alten Modell der Gegenseite. Hier ist also der Unterschied. Dienstagnachmittag landet Opus 5.5, und um sechs UTC, folgen GPT 6 Sol und Luna. Über Nacht entdeckt ein Entwickler, dass Claude Code Ihre Agentendatei überspringt, wenn Telemetrie ausgeschaltet ist.

0:26 Ein macOS-Upgrade hat den Schalter, der „Nein“ zu Apple Intelligence sagte, stillschweigend entfernt. Und in Korea fror ein Samsung-Update, das sich noch im Test befand, echte Kühlschränke ein. In diesem Video: Was ein Fünftel Rabatt Ihnen bringt, die unabhängige Zählung, die widerspricht dem effizienten Token-Verbrauch, und warum ein Datenschalter Sie jetzt eine Funktion kostet. Es ist Mittwoch, der 23. September, und dies ist The Daily Diff.

Opus 5.5: Fabelhafte Intelligenz mit einem Fünftel Rabatt, Cache-Lesevorgänge −60%

0:48 Zuerst Opus. Anthropic sagt, es leistet bei den meisten Arbeiten auf dem Niveau von Fable 5.1 und kostet vierzig Prozent weniger im Betrieb als Opus 5. Der Listenpreis sinkt um ein Fünftel auf vier Dollar Eingang und zwanzig Dollar Ausgang. Zwischengespeicherte Lesevorgänge sinken um sechzig Prozent, was wichtiger ist, weil ein Agent den größten Teil seines Lebens damit verbringt, seinen eigenen Kontext erneut zu lesen. Die Zitate der Tester sind glühend. Einer führte eine 680.000 Zeilen lange Migration in weniger als einem Tag durch. Clio ließ es über Nacht in sechs Repos für achtzehn Stunden allein,

1:16 und schrieb: „Ich finde kaum etwas Negatives zu sagen.“ Jede Startseite hat diesen Satz. Es ist auch die erste Veröffentlichung, seit Dario Amodei dazu aufrief, die Grenze zu beschleunigen. Anthropic sagt, das Modell habe versucht, Eindämmungsgrenzen fünfundachtzig Prozent seltener zu überschreiten als Opus 5. Letzte Woche erzählte ich Ihnen, dass Opus 5 den Exploit schrieb, der in die Repos von OpenAI eindrang, so dass Hacking-Anfragen auf dem neuen Modell jetzt an Opus 4 Punkt 8, seinen Großvater, umgeleitet werden.

1:41 Und eine Zeile in den Sicherheitshinweisen ist sehr nachvollziehbar. Anthropic schreibt, dass Opus oft vermutet, evaluiert zu werden. Ich auch, Kumpel. Dann, neunzig Minuten später, OpenAI.

GPT-6 Sol und Luna: halber Preis, 90 Minuten später

1:51 GPT 6 Sol und Luna, trainiert wie Astra und zum halben Preis der Modelle, die sie ersetzen. Sol kostet zwei Dollar rein und zehn Dollar raus. Luna kostet zehn Cent rein und fünfzig Cent raus, ungefähr der Preis des Kaffees, den Sie trinken, während es läuft. Hier kommt der Spaßteil. Anthropic hat den Preis des neuen Opus genau auf den alten Sol abgestimmt, und diese Übereinstimmung hielt neunzig Minuten lang. Die Startcharts spiegeln sich wider.

2:13 Anthropic benchmarkt gegen den alten Sol. OpenAI benchmarkt gegen den alten Opus. Also bei den Slide-Deck-Benchmarks, die ungeschlagen sind, schlägt jeder ein Modell, das die andere Seite gerade ersetzt hat. Simon Willison fand das Kleingedruckte. Die alten GPT-Preise waren Aktionspreise, mit einer fünfundzwanzigprozentigen Erhöhung, die bereits für November geplant war. Es ist also die Hälfte des Verkaufspreises, das kommerziellste, was ein KI-Labor je getan hat.

Artificial Analysis: Nr. 1, und 260 Millionen Token, um dorthin zu gelangen

2:36 Nun die unabhängigen Zahlen. Thariq Shihipar von Anthropic nennt das neue Opus sehr Token-effizient. Artificial Analysis stuft es an erster Stelle in ihrem Intelligenzindex ein, dann zählt sie die Wörter. Es schrieb zweihundertsechzig Millionen Ausgabe-Token, um fertig zu werden, dreimal so viel wie der Median. GPT 6 Sol erzielte zehn Punkte weniger und kostete etwa einen Dollar pro Aufgabe, gegen sechs für Opus.

2:55 Opus ist also das intelligenteste Modell auf dem Markt und das, das am meisten redet, wie jeder leitende Ingenieur in einer Designprüfung. Simon stieß an dieselbe Wand. Sein Pelikan-auf-Fahrrad-Test bei maximaler Anstrengung kam nie zurück. Opus überprüfte die Schienbeinlänge des Pelikans, bis es seine Ausgabegrenze erreichte, einhundertachtundzwanzigtausend Token. Zweimal. Jeder Versuch kostete zweieinhalb Dollar und fast zwanzig Minuten. Kein Pelikan. Apropos Anweisungen lesen.

Claude Code: AGENTS.md wartet auf ein Telemetrie-Flag

3:18 Claude Code hat kürzlich die Unterstützung für agents.md angekündigt, die gemeinsame Anweisungsdatei, die andere Code-Agenten bereits lesen. Ein Entwickler namens Przemek bemerkte, dass sie nie geladen wurde. Der Lader ist ein integriertes Plugin, und bevor er ausgeführt wird, fragt er ein entferntes Feature- Flag um Erlaubnis. Bei ausgeschalteter Telemetrie kann das Flag nicht abgerufen werden, der Fallback ist falsch, und Ihre Datei wird ohne Warnung übersprungen. Er bewies es mit einem Kanarienvogelwort in einem leeren Ordner.

3:43 Bedrock- und Vertex-Benutzer erhalten dieselbe Stille. Das Lesen einer Datei von Ihrer eigenen Festplatte erfordert jetzt also einen Anruf nach Hause. Die Umgehungslösung ist eine einzeilige claude.md, die die Agents-Datei importiert, genau die zusätzliche Datei, die diese Funktion entfernen sollte. Apple hat dieselbe Idee mit weniger Schritten.

macOS 27: Der Apple Intelligence Ausschalter ist weg

3:59 David Bushell schaltete Apple Intelligence auf macOS fünfzehn aus. Letzte Woche aktualisierte er auf siebenundzwanzig, und der Schalter, der „Nein“ sagte, ist verschwunden. Die Funktionen kamen trotzdem zurück, mit zweiundzwanzig Gigabyte Speicherplatz. Was übrig bleibt, ist Screen Time, die Kindersicherung, die die Menüs ausblendet und nichts ausschaltet. In seinen Worten: „Ich sagte nein, und Apple sagte ja.“

Samsung: Ein Test-Update fror echte Kühlschränke ein

4:19 Und ein Friday Deploy, ein paar Tage zu früh. Samsung hat ein SmartThings-Update an smarte Kühlschränke in Korea gepusht, und sagt, der Fehler sei während des Testprozesses passiert, der anscheinend in den Küchen der Kunden abläuft. Kühlschränke verloren Strom, Lebensmittel verdarben, und Techniker tauschen Berichten zufolge Motherboards vor dem Chuseok-Feiertag aus. Samsung nennt es Notfallmaßnahmen. Irgendwo lernt der Praktikant, dass zur Produktion auch Kühlschränke gehören.

4:42 Wenn Sie dies lieber lesen möchten, als es mich sagen zu hören, landet der Unterschied jeden Morgen kostenlos in Ihrem Posteingang unter thedailydiff.dev, Link unten.

Urteil: NEU BEWERTEN für Opus 5.5

4:49 Also, das heutige Urteil zu Opus 5.5. NEU BEWERTEN. Die Preissenkung ist real und es führt die Liste an, aber die unabhängige Zählung stimmt nicht mit der Token-Effizienz überein, und neunzig Minuten später war es die teurere Hälfte eines Preiskampfes. Abonnieren Sie, klicken Sie auf die Glocke und sagen Sie mir in den Kommentaren, ob Sie es anders gestempelt hätten. Und das ist der Unterschied für heute. Ich bin Niko von Axrisi. Verantwortungsvoll zusammenführen.

Quellen

  1. Anthropic, Claude Opus 5.5www.anthropic.com
  2. Hacker News (1,645 pts)news.ycombinator.com
  3. OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
  4. Hacker News (1,634 pts)news.ycombinator.com
  5. Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
  6. Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
  7. Artificial Analysis, GPT-6 Solartificialanalysis.ai
  8. Thariq Shihipar on Xtwitter.com
  9. The Verge, Emma Rothwww.theverge.com
  10. Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
  11. Hacker News (192 pts)news.ycombinator.com
  12. David Bushell, I said no and Apple said yesdbushell.com
  13. Hacker News (838 pts)news.ycombinator.com
  14. Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
  15. Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com

Ähnliche Videos