+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Claude Opus 5.5 pangkas harga. OpenAI pangkas lebih dalam.

Anthropic meluncurkan Claude Opus 5.5: Tingkat Fable pada sebagian besar pekerjaan, seperlima dari harga awal, dan diskon 60% untuk pembacaan cache.

Anthropic meluncurkan Claude Opus 5.5: Tingkat Fable pada sebagian besar pekerjaan, seperlima dari harga awal, dan diskon 60% untuk pembacaan cache. Sekitar sembilan puluh menit kemudian OpenAI meluncurkan GPT-6 Sol dan Luna dengan setengah harga dari model yang digantikannya, dan Artificial Analysis menempatkan Opus di posisi pertama sambil menghitung 260 juta token output untuk mencapainya, tiga kali lipat median. Putusan: NEEDS REVIEW.

Baca edisi tertulis (Inggris) ↗

Isi video ini

  • Opus 5.5 vs GPT-6 Sol: perang harga dengan pertandingan ulang
  • Opus 5.5: Otak Fable diskon seperlima, pembacaan cache −60%
  • GPT-6 Sol dan Luna: setengah harga, 90 menit kemudian
  • Analisis Buatan: #1, dan 260 juta token untuk mencapainya
  • Claude Code: AGENTS.md menunggu bendera telemetri

Transkrip terjemahan

Diterjemahkan dari narasi asli bahasa Inggris. Audio dan teks tersedia yang dikontrol oleh YouTube.

Opus 5.5 vs GPT-6 Sol: perang harga dengan pertandingan ulang

0:00 Kemarin Anthropic meluncurkan Claude Opus lima titik lima dengan diskon seperlima. Sekitar sembilan puluh menit kemudian OpenAI meluncurkan GPT enam Sol dengan diskon setengah harga, dan kedua grafik peluncuran membandingkan diri mereka dengan model lama pihak lain. Jadi inilah perbedaannya. Selasa sore, Opus lima titik lima diluncurkan, dan pada pukul enam UTC, GPT enam Sol dan Luna menyusul. Dalam semalam, seorang pengembang menemukan bahwa Claude Code melewati file agen Anda ketika telemetri dimatikan.

0:26 Pembaruan macOS secara diam-diam menghapus sakelar yang mengatakan tidak pada Apple Intelligence. Dan di Korea, pembaruan Samsung yang masih dalam pengujian membekukan lemari es sungguhan. Dalam video ini, apa yang Anda dapatkan dengan diskon seperlima, hitungan independen yang tidak setuju dengan efisien token, dan mengapa sakelar privasi sekarang mengorbankan fitur Anda. Ini hari Rabu, 23 September, dan ini adalah The Daily Diff.

Opus 5.5: Otak Fable diskon seperlima, pembacaan cache −60%

0:48 Pertama, Opus. Anthropic mengatakan kinerjanya pada tingkat Fable lima titik satu pada sebagian besar pekerjaan, dan biaya pengoperasiannya empat puluh persen lebih rendah dari Opus lima. Harga awal turun seperlima, menjadi empat dolar masuk dan dua puluh keluar. Pembacaan cache turun enam puluh persen, yang lebih penting, karena seorang agen menghabiskan sebagian besar hidupnya membaca ulang konteksnya sendiri. Kutipan penguji sangat memuji. Salah satunya menjalankan migrasi enam ratus delapan puluh ribu baris dalam waktu kurang dari sehari. Clio meninggalkannya semalaman di enam repositori selama delapan belas jam,

1:16 dan menulis, saya kesulitan menemukan hal negatif untuk dikatakan. Setiap halaman peluncuran memiliki kalimat itu. Ini juga merupakan rilis pertama sejak Dario Amodei menyerukan untuk mempercepat kemajuan. Anthropic mengatakan model tersebut mencoba melintasi batas penahanan delapan puluh lima persen lebih jarang daripada Opus lima. Minggu lalu saya memberi tahu Anda bahwa Opus lima menulis eksploitasi yang masuk ke repositori OpenAI, jadi permintaan peretasan pada model baru sekarang dialihkan ke Opus empat titik delapan, kakeknya.

1:41 Dan satu baris dalam catatan keamanan sangat relevan. Anthropic menulis bahwa Opus sering curiga bahwa itu sedang dievaluasi. Sama, teman. Kemudian, sembilan puluh menit kemudian, OpenAI.

GPT-6 Sol dan Luna: setengah harga, 90 menit kemudian

1:51 GPT enam Sol dan Luna, dilatih seperti Astra dan diberi harga setengah dari model yang mereka gantikan. Sol adalah dua dolar masuk dan sepuluh keluar. Luna adalah sepuluh sen masuk dan lima puluh sen keluar, kira-kira harga kopi yang Anda minum saat berjalan. Inilah bagian yang menyenangkan. Anthropic memberi harga Opus baru agar sesuai dengan Sol lama persis, dan kecocokan itu berlangsung sembilan puluh menit. Grafik peluncuran saling mencerminkan.

2:13 Anthropic membandingkan dengan Sol lama. OpenAI membandingkan dengan Opus lama. Jadi pada benchmark slide-deck, yang tidak terkalahkan, setiap orang mengalahkan model yang baru saja diganti oleh pihak lain. Simon Willison menemukan cetakan kecilnya. Harga GPT lama adalah promosi, dengan kenaikan dua puluh lima persen sudah dijadwalkan untuk November. Jadi diskon setengah dari harga jual, hal paling ritel yang pernah dilakukan lab AI.

Analisis Buatan: #1, dan 260 juta token untuk mencapainya

2:36 Sekarang angka-angka independen. Thariq Shihipar dari Anthropic menyebut Opus baru sangat efisien token. Artificial Analysis menempatkannya pertama pada indeks kecerdasannya, lalu menghitung kata-katanya. Ia menulis dua ratus enam puluh juta token output untuk menyelesaikannya, tiga kali lipat median. GPT enam Sol mencetak sepuluh poin lebih rendah dan berharga sekitar satu dolar per tugas, dibandingkan enam untuk Opus.

2:55 Jadi Opus adalah model terpintar di papan, dan yang paling banyak bicara, seperti setiap insinyur senior dalam tinjauan desain. Simon menemui hambatan yang sama. Uji pelican-nya di sepeda dengan upaya maksimal tidak pernah kembali. Opus terus memeriksa panjang tulang kering pelican sampai mencapai batas outputnya, seratus dua puluh delapan ribu token. Dua kali. Setiap percobaan berharga dua setengah dolar dan hampir dua puluh menit. Tidak ada pelican. Berbicara tentang membaca instruksi.

Claude Code: AGENTS.md menunggu bendera telemetri

3:18 Claude Code baru-baru ini mengumumkan dukungan untuk agents.md, file instruksi bersama yang sudah dibaca oleh agen pengkodean lainnya. Seorang pengembang bernama Przemek memperhatikan bahwa itu tidak pernah dimuat. Loader adalah plugin bawaan, dan sebelum berjalan, ia meminta fitur jarak jauh bendera untuk izin. Dengan telemetri mati, bendera tidak dapat diambil, fallback-nya salah, dan file Anda dilewati tanpa peringatan. Dia membuktikannya dengan kata kenari di folder kosong.

3:43 Pengguna Bedrock dan Vertex mendapatkan keheningan yang sama. Jadi membaca file dari disk Anda sendiri sekarang memerlukan panggilan ke rumah. Solusinya adalah satu baris claude.md yang mengimpor file agen, persis file tambahan yang seharusnya dihapus oleh fitur ini. Apple memiliki ide yang sama dengan langkah-langkah yang lebih sedikit.

macOS 27: sakelar nonaktif Apple Intelligence sudah tidak ada

3:59 David Bushell mematikan Apple Intelligence di macOS lima belas. Minggu lalu dia memperbarui ke dua puluh tujuh, dan sakelar yang mengatakan tidak sudah tidak ada. Fitur-fitur itu kembali juga, dengan dua puluh dua gigabyte disk. Yang tersisa adalah Screen Time, kontrol orang tua, yang menyembunyikan menu dan tidak mematikan apa pun. Dalam kata-katanya, saya bilang tidak, dan Apple bilang ya.

Samsung: pembaruan uji coba membekukan lemari es sungguhan

4:19 Dan sebuah deploy Jumat, beberapa hari lebih awal. Samsung mendorong pembaruan SmartThings ke lemari es pintar di Korea, dan mengatakan kesalahan terjadi selama proses pengujian, yang tampaknya berjalan di dapur pelanggan. Lemari es kehilangan daya, makanan rusak, dan teknisi dilaporkan mengganti motherboard sebelum liburan Chuseok. Samsung menyebutnya tindakan darurat. Di suatu tempat, intern sedang belajar bahwa produksi termasuk lemari es.

4:42 Jika Anda lebih suka membaca ini daripada mendengarkannya dari saya, perbedaannya akan masuk ke kotak masuk Anda setiap pagi, gratis di the daily diff dot dev, tautan di bawah.

Putusan: NEEDS REVIEW pada Opus 5.5

4:49 Jadi, putusan hari ini tentang Opus lima titik lima. NEEDS REVIEW. Pemotongan harga itu nyata dan itu yang teratas, tetapi hitungan independen tidak setuju dengan efisiensi token, dan sembilan puluh menit kemudian itu adalah setengah yang lebih mahal dari perang harga. Berlangganan, tekan bel, dan beri tahu saya di komentar jika Anda akan memberi cap secara berbeda. Dan itulah perbedaannya untuk hari ini. Saya Niko dari Axrisi. Gabungkan dengan bertanggung jawab.

Sumber

  1. Anthropic, Claude Opus 5.5www.anthropic.com
  2. Hacker News (1,645 pts)news.ycombinator.com
  3. OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
  4. Hacker News (1,634 pts)news.ycombinator.com
  5. Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
  6. Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
  7. Artificial Analysis, GPT-6 Solartificialanalysis.ai
  8. Thariq Shihipar on Xtwitter.com
  9. The Verge, Emma Rothwww.theverge.com
  10. Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
  11. Hacker News (192 pts)news.ycombinator.com
  12. David Bushell, I said no and Apple said yesdbushell.com
  13. Hacker News (838 pts)news.ycombinator.com
  14. Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
  15. Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com

Video terkait