OpenAI dan Anthropic merilis model baru pada 22 September, tetapi jajaran produk mereka berkembang dengan kecepatan berbeda. GPT-6 Sol dan Luna bergabung dengan Astra, sementara Terra masih menggunakan GPT-5.6. Claude Opus naik ke 5.5, bersama Fable 5.1, Sonnet 5, dan Haiku 4.5 yang hampir berusia setahun.

Perbandingan yang paling relevan adalah Astra melawan Fable, Sol melawan Opus, Terra melawan Sonnet, dan Luna melawan Haiku. Melihat keempat pasangan sekaligus memperlihatkan persaingan yang lebih menarik daripada peluncuran masing-masing: Opus menantang tingkatan unggulan, Luna menekan penawaran Anthropic yang murah, sedangkan bagian tengah kedua jajaran model belum diperbarui.

Perubahan besar

  • Yang berubah: Pembeli kini dapat memperoleh model yang lebih baru dengan harga yang sangat berbeda dalam jajaran penyedia yang sama. OpenAI memperbarui tingkatan murahnya, sementara rilis Anthropic kali ini berfokus pada Opus sehingga Haiku tertinggal hampir setahun dalam kalender rilis.
  • Mengapa ini penting: Tim produk memiliki lebih banyak peluang untuk mengurangi biaya penggunaan AI rutin sambil membayar lebih untuk hasil yang lebih kuat ketika kesalahan berbiaya mahal. Tantangannya adalah memilih berdasarkan kinerja yang terbukti: posisi suatu model dalam jajaran produk tidak menunjukkan urutan hasil tolok ukurnya secara andal.
  • Yang perlu dipantau: Anthropic mengatakan Sonnet 5.5 dan Haiku 5.5 akan hadir dalam beberapa minggu mendatang. Harga dan hasil keduanya akan menentukan seberapa lama peluang OpenAI saat ini bertahan, terutama pada produk yang melakukan banyak panggilan berbiaya rendah.

Harga menurut tingkatan

Semua angka di bawah adalah harga API langsung standar dalam dolar AS per sejuta token, diperiksa pada 22 September. Masukan cache berarti cache hit. Tarif OpenAI yang dicantumkan berlaku hingga 272.000 token masukan; di atas itu, tarif masukan untuk seluruh permintaan berlipat dua dan tarif keluaran naik 50%. Penulisan cache, pemrosesan batch, dan alat memiliki ketentuan penagihan terpisah. Sumber: OpenAI dan Anthropic.

Model

Masukan

Masukan cache

Keluaran

GPT-6 Astra

$10

$1

$50

Claude Fable 5.1

$10

$0.25

$50

GPT-6 Sol

$2

$0.20

$10

Claude Opus 5.5

$4

$0.20

$20

GPT-5.6 Terra

$2

$0.20

$12

Claude Sonnet 5

$2

$0.20

$10

GPT-6 Luna

$0.10

$0.01

$0.50

Claude Haiku 4.5

$1

$0.10

$5

Kecerdasan dan belanja terukur pada pengujian

Artificial Analysis Intelligence Index v4.3.2, diperiksa pada 22 September. Biaya adalah belanja rata-rata operator untuk setiap tugas indeks, dengan bobot.

Model

Pengaturan yang diuji

Indeks kecerdasan

Biaya per tugas indeks

GPT-6 Astra

Max

52.7

$3.26

Claude Fable 5.1

Max dengan fallback

53.4

$7.63

GPT-6 Sol

Max

47.5

Tidak dicantumkan

Claude Opus 5.5

Max dengan fallback

57.6

$5.98

GPT-5.6 Terra

Max

42.1

$1.40

Claude Sonnet 5

Max

38.2

$5.09

GPT-6 Luna

Max

37.3

Tidak dicantumkan

Claude Haiku 4.5

Penalaran aktif

16.9

$0.21

Sumber: Artificial Analysis; hasil masing-masing model ditautkan dalam perbandingan di bawah.

Astra vs Fable: pasangan model unggulan

Harga masukan dan keluaran standar keduanya sama. Tingkat cache hit Fable hanya seperempat dari Astra, perbedaan yang penting saat aplikasi berulang kali menggunakan kembali konten prompt yang memenuhi syarat.

Pada Intelligence Index terkini dari Artificial Analysis, Astra pada tingkat Max memperoleh skor 52.7 dan Fable 5.1 pada Max dengan fallback mendapat skor 53.4. Hasilnya berdekatan. Artificial Analysis melaporkan belanja tertimbang sebesar $3.26 per tugas indeks untuk Astra, dibandingkan dengan $7.63 untuk Fable. Astra meraih skor berdekatan dengan belanja terukur sekitar 57% lebih rendah, meskipun harga masukan dan keluarannya sama. Hasil Astra, hasil Fable.

Sol vs Opus: harga lebih rendah bertemu skor lebih tinggi

Tarif masukan biasa dan keluaran Sol adalah setengah tarif Opus; tingkat cache hit keduanya sama. OpenAI juga memangkas separuh harga masukan dan keluaran Sol dibandingkan tarif peluncuran GPT-5.6 Sol. Anthropic memangkas tarif terkait Opus sebesar 20% dibandingkan Opus 5. Peluncuran OpenAI, peluncuran Opus.

Artificial Analysis memberi Sol pada tingkat Max skor 47.5, dibandingkan dengan 57.6 untuk Opus 5.5 pada Max dengan fallback. Opus unggul 10,1 poin atas Sol, dengan biaya masukan biasa dan keluaran dua kali lipat. Skornya juga melampaui Astra dan Fable, meski tarif masukan dan keluarannya 60% lebih rendah. Belanja aktual saat pengujian mengubah gambaran tersebut: rata-rata biaya Opus adalah $5.98 per tugas indeks, sekitar 84% lebih tinggi daripada Astra. Grafik biaya yang diterbitkan Artificial Analysis belum mencantumkan angka Sol saat diperiksa. Hasil Sol, hasil Opus.

Terra vs Sonnet: model GPT-6 yang belum ada

Tidak ada GPT-6 Terra dalam katalog model atau daftar peluncuran OpenAI saat ini. Perbandingan yang tersedia adalah GPT-5.6 Terra, yang dokumentasi API-nya saat ini mengonfirmasi tarif di atas. Panduan Work dan Codex OpenAI juga menyebutkan bahwa model GPT-5.6 yang lebih lama tetap tersedia selama peluncuran berlangsung.

Pada tingkat upaya Max, Terra mendapat skor 42.1 pada indeks Artificial Analysis, sementara Sonnet 5 mendapat skor 38.2. Rata-rata biaya Terra juga sebesar $1.40 per tugas indeks, dibandingkan dengan $5.09 untuk Sonnet: skor lebih tinggi dengan belanja terukur sekitar 73% lebih rendah. Tarif token keluaran Terra 20% lebih tinggi, menunjukkan bahwa konsumsi token dan caching dapat lebih berpengaruh daripada harga yang tertera. Hasil Terra, hasil Sonnet.

Sonnet 5 hadir pada 30 Juni. Anthropic kini telah mengumumkan Sonnet 5.5 untuk beberapa minggu mendatang. Adanya penerus yang dijanjikan membuat perbandingan dengan Sonnet 5 saat ini tetap berlaku sampai versi baru tersedia untuk diuji dan dihitung harganya.

Luna vs Haiku: kesenjangan usia rilis paling lebar

Luna berharga sepersepuluh dari Haiku pada setiap kategori token yang dicantumkan. Haiku 4.5 diluncurkan pada 15 Oktober 2025: 342 hari sebelum Luna. Haiku 4.5 tetap menjadi versi Haiku terbaru Anthropic yang telah dirilis, sementara versi 5.5 dijanjikan hadir dalam beberapa minggu mendatang.

Kesenjangan kinerja juga tampak dalam pengujian independen. Artificial Analysis memberi Luna pada tingkat Max skor 37.3, dibandingkan dengan 16.9 untuk Haiku 4.5 dengan penalaran aktif. Ini adalah poin indeks pada rangkaian pengujian terkini yang sama, bersamaan dengan harga token Luna yang 90% lebih rendah. Rata-rata biaya penalaran Haiku adalah $0.21 per tugas indeks; biaya Luna yang sepadan belum dicantumkan dalam grafik terbitan operator. Hasil Luna, hasil penalaran Haiku.

Bagi Anthropic, bagian ini menunjukkan celah dalam jajaran produknya: model termurah saat ini menghadapi pesaing yang baru dirilis dengan tarif token lebih rendah sekaligus hasil yang jauh lebih kuat pada penilaian tersebut. Karena itu, pembaruan Haiku yang diumumkan menjadi salah satu rilis berikutnya yang paling berdampak bagi pengembang dengan volume pembelian tinggi.

Angka Artificial Analysis di atas menggunakan Intelligence Index v4.3.2, gabungan sepuluh evaluasi yang diperiksa pada 22 September. Pengaturan dicantumkan bersama skornya; entri Fable dan Opus menyertakan konfigurasi fallback operator. Indeks dan metodologi.

Apa yang terjadi saat agen harus menyelesaikan pekerjaan?

Tolok ukur AutomationBench v1.0.6 dari Zapier menguji pekerjaan dari awal hingga akhir di aplikasi bisnis simulasi. Kelulusan mensyaratkan semua hasil yang dinilai benar. Papan peringkat 22 September mencantumkan:

Model

Pengaturan yang diuji

Tingkat keberhasilan

Biaya per tugas

GPT-6 Astra

Max

41.4%

$1.73

Claude Fable 5.1

Max, mandiri

22.37%

$2.45

GPT-6 Sol

Xhigh

33.2%

$0.27

GPT-6 Sol

Max

32.0%

$0.34

Claude Opus 5.5

Max

40.0%

$1.28

GPT-5.6 Terra

Max

23.59%

$0.51

Claude Sonnet 5

Max

10.65%

$0.88

GPT-6 Luna

Max

20.7%

$0.04

Claude Haiku 4.5

Tidak ditentukan

0.46%

$0.07

Konfigurasi Fable ditambah Opus 5 yang terpisah meraih skor 31,4%. Opus menangani sekitar 40% tugasnya; biaya $2.45 yang ditampilkan tidak mencakup token fallback tersebut.

Pada pengaturan xhigh, Sol membelanjakan sekitar 79% lebih sedikit per percobaan daripada Opus pada Max, dengan tingkat keberhasilan 6,8 poin persentase lebih rendah. Luna mengungguli Haiku dengan biaya tugas 43% lebih rendah. Astra memimpin kelompok ini; tingkat keberhasilan setiap model tetap di bawah separuh. Hasil dan metode penilaian Zapier.

Kalender rilis padat dan tidak merata

Catatan rilis API kedua perusahaan memberikan dua rangkaian terpilih. Daftar OpenAI mengikuti versi GPT bernomor hingga GPT-6 Astra. Daftar ini tidak mencakup cabang khusus Instant dan Codex, serta perluasan tingkatan berikutnya seperti GPT-5.4 mini dan nano pada 17 Maret serta GPT-6 Sol dan Luna pada 22 September. Daftar Anthropic mengikuti versi Opus API publik. “Jeda” berarti jumlah hari kalender sejak entri sebelumnya dalam rangkaian terpilih perusahaan tersebut.

  • Keluarga GPT-5 — 7 Agustus 2025: peluncuran keluarga; jeda tidak berlaku untuk entri pertama.
  • GPT-5.1 — 13 November 2025: pembaruan versi; jeda 98 hari.
  • GPT-5.2 — 11 Desember 2025: pembaruan versi; jeda 28 hari.
  • GPT-5.4 — 5 Maret 2026: pembaruan versi; jeda 84 hari.
  • GPT-5.5 — 24 April 2026: pembaruan versi; jeda 50 hari.
  • GPT-5.6 — 9 Juli 2026: pembaruan keluarga dengan tingkatan; jeda 76 hari.
  • GPT-6 Astra — 3 September 2026: peluncuran keluarga baru; jeda 56 hari.

Sumber: catatan perubahan API OpenAI. Secara terpisah, GPT-6 Sol dan Luna hadir pada 22 September, 19 hari setelah Astra. Jarak ini mengukur perluasan tingkatan dalam keluarga yang sama dan berada di luar rangkaian versi bernomor di atas.

  • Opus 4 — 22 Mei 2025: versi mayor; jeda tidak berlaku untuk entri pertama.
  • Opus 4.1 — 5 Agustus 2025: pembaruan poin; jeda 75 hari.
  • Opus 4.5 — 24 November 2025: pembaruan versi; jeda 111 hari.
  • Opus 4.6 — 5 Februari 2026: pembaruan versi; jeda 73 hari.
  • Opus 4.7 — 16 April 2026: pembaruan versi; jeda 70 hari.
  • Opus 4.8 — 28 Mei 2026: pembaruan versi; jeda 42 hari.
  • Opus 5 — 24 Juli 2026: versi mayor; jeda 57 hari.
  • Opus 5.5 — 22 September 2026: pembaruan versi dan penurunan harga; jeda 60 hari.

Sumber: catatan rilis API Anthropic. Rilis Fable dan Mythos terbatas merupakan cabang terpisah sehingga tidak dimasukkan ke dalam rangkaian Opus.

Jeda antarversi bernomor OpenAI berkisar 28 hingga 98 hari; jeda Opus Anthropic berkisar 42 hingga 111 hari. Jika “rilis mayor” berarti perubahan nomor keluarga, jarak GPT-5 ke GPT-6 adalah 392 hari, sedangkan Opus 4 ke Opus 5 adalah 428 hari. Jeda yang lebih pendek adalah pembaruan poin dan perluasan tingkatan. Kedua rangkaian berfluktuasi: jeda pendek diikuti jeda yang lebih panjang.

Tekanan praktisnya adalah meningkatkan model secara selektif

Kalender peluncuran terus memberi alasan untuk meninjau kembali pilihan model. Keempat pasangan hari ini menunjukkan mengapa penilaian menyeluruh terhadap satu penyedia dapat melewatkan perbedaan yang berguna: Anthropic memiliki Opus baru yang kuat, OpenAI memiliki tingkatan murah yang kini kompetitif, dan kedua perusahaan masih menawarkan model lama di sebagian jajaran mereka.

Pergantian versi juga memerlukan pekerjaan rekayasa. Panduan migrasi Opus 5.5 dari Anthropic menyebutkan bahwa thinking selalu aktif, pemilihan alat secara paksa menghasilkan galat, dan jenis alat computer-use yang lama ditolak pada Claude API serta Google Cloud. Integrasi yang memakai opsi tersebut perlu diubah.

Perkembangan berikutnya yang telah diumumkan adalah pembaruan Sonnet dan Haiku dari Anthropic. Ini memberi pembeli alasan konkret untuk segera meninjau tingkatan yang lebih rendah. Untuk saat ini, daftar harga dan hasil independen sudah menunjukkan pergeseran persaingan serta bagian yang masih patut dipertimbangkan model lamanya.