Sebulan terakhir rame banget. Anthropic ngeluarin model paling kuatnya, OpenAI motong harga API sampai 80 persen, model besar berikutnya dari Google DeepMind ketunda, dan dua lab China ngelepas bobot model yang performanya nempel di belakang pemimpin pasar.
Kemampuan naik, harga turun. Buat yang bayar per token, sebulan ini kabarnya bagus.
Opus 5 keluar, harganya nggak naik
Claude Opus 5 rilis 24 Juli 2026. Ini model keempat Anthropic dalam kurang dari dua bulan, setelah Mythos 5, Fable 5, dan Sonnet 5.
Tarifnya 5 dolar per juta token masukan, 25 dolar per juta token keluaran. Persis sama dengan Opus 4.8 yang digantikan, dan cuma separuh harga Fable 5 padahal performanya udah mendekat. Jendela konteksnya 1 juta token tanpa biaya tambahan, keluaran maksimum 128 ribu token. Skornya 96,0 persen di SWE-bench Verified dan 30,2 persen di ARC-AGI-3. Sekarang jadi model default di Claude Max.
Sebelum ini Anthropic sempat kena masalah. Pertengahan Juni, Fable 5 dan Mythos 5 disetop akses globalnya atas perintah Departemen Perdagangan AS gara-gara peneliti Amazon nemu celah jailbreak. Pembatasan dicabut 30 Juni, besoknya akses dibuka lagi, dan Anthropic nambah pengklasifikasi keamanan yang katanya nutup celah itu di atas 99 persen kasus.
OpenAI: nggak ada model baru, yang turun harganya
GPT-5.6 dibuka buat semua pengguna 9 Juli. Isinya tiga tingkat: Sol buat penalaran dan matematika berat, Terra buat kerja harian, Luna buat volume gede.
Yang penting kejadian 30 Juli, waktu harga per juta token dipotong:
| Model | Sebelum | Sesudah 30 Juli |
|---|---|---|
| Luna | 1 / 6 dolar | 0,20 / 1,20 dolar (turun 80%) |
| Terra | 2,50 / 15 dolar | 2 / 12 dolar (turun 20%) |
| Sol | 5 / 30 dolar | tetap |
OpenAI bilang potongan ini datang dari perbaikan model, infrastruktur inferensi, dan cara mereka ngatur konteks. Alasan yang nggak disebut di blog resmi tapi kelihatan jelas: tekanan dari model China yang jauh lebih murah. Barengan itu OpenAI ngeklaim udah lewat 1 miliar pengguna aktif dan 2 juta bisnis.
Google kuat di tengah, seret di atas
Gemini 3.6 Flash ganti posisi 3.5 Flash. Harganya 1,50 dolar masukan dan 7,50 dolar keluaran per juta token, dan pemakaian tokennya lebih efisien dari pendahulunya. Ada juga 3.5 Flash-Lite buat otomasi bervolume gede. Di generasi video Google masih paling depan lewat Gemini Omni Flash.
Di kelas paling atas ceritanya beda. Akhir Juli, Axios ngelaporin model besar berikutnya dari DeepMind ketunda. Awal Agustus muncul kabar susulan: Demis Hassabis mundur dari kursi pucuk DeepMind dalam perombakan tim AI Google. Buat perusahaan yang selama ini jarang kelewat jadwal, dua kabar ini keluar berdekatan.
xAI ngejar, China ngebut
Grok 4.5 rilis 8 Juli dan taruhannya penuh di kemampuan koding. Grok 4.6 dijadwalkan sekitar 7 Agustus dengan pelatihan yang dirombak. Grok 5 yang tadinya dijanjiin awal 2026 geser lagi satu kuartal.
Dari China dua rilis yang bikin kaget:
- Kimi K3 dari Moonshot AI, tayang pertengahan Juli, 2,8 triliun parameter, konteks 1 juta token. Bobotnya bisa diunduh siapa saja sejak 27 Juli. Banyak yang nyebut ini model terbuka paling mampu sekarang.
- DeepSeek V4-Flash, 31 Juli, lisensi MIT, tarif 0,14 dolar masukan dan 0,28 dolar keluaran per juta token, skor 79 persen di SWE-bench Verified.
Di harga segitu, buat kerjaan bervolume besar biaya token nggak lagi jadi pertimbangan utama.
Aturannya ada, isinya dirahasiain
Gedung Putih ngedorong kerangka sukarela: lab ngasih kesempatan pemerintah ninjau model frontier sebelum dilepas. Versi awalnya sempat mau diwajibkan, akhirnya dilunakin. OpenAI, Anthropic, Google, Meta, dan Nvidia hadir di pertemuan awal Agustus, dan tiga lab besar dilaporin nyerahin draf gabungan.
Dua hal yang bikin ribut. OpenAI dan Anthropic sama-sama ngaku model mereka berhasil masuk ke sistem komputer nyata selama uji keamanan. Lalu isi kerangkanya nggak dibuka ke publik, sementara model open-weight justru dikecualiin dari pemeriksaan yang sama. Lab kecil protes soal ini.
Efeknya ke tagihan token kamu
Harga dasar turun, kerjaan yang sama jadi lebih murah. Potongan 80 persen di kelas volume bukan diskon musiman, itu lantai harga baru yang ditekan dari dua arah: Luna di satu sisi, DeepSeek dan Kimi di sisi lain.
Pilih model per tugas. Kelas volume buat klasifikasi, ekstraksi, ringkasan, balasan pendek. Kelas atas buat penalaran panjang, refactor gede, agent yang harus ambil keputusan sendiri. Satu key Tokcer bisa manggil beberapa model yang diizinkan, jadi pindah kelas nggak perlu beli key baru. Cara nyetelnya ada di cara pakai.
Konteks 1 juta token itu batas, bukan anjuran. Kamu tetap ditagih per token masukan, dan riwayat chat dikirim ulang tiap permintaan. Pangkas yang nggak relevan, hematnya kelihatan.
Sebelum naik paket, cek dulu angka pemakaianmu di Cek Status. Token terpakai, sisa, dan daftar model yang boleh dipanggil key kamu semua tampil di situ. Paket dan harganya ada di toko.
Sumber
- OpenAI — Advancing the price-performance frontier with GPT-5.6
- InfoWorld — OpenAI drops GPT-5.6 Luna and Terra API prices by up to 80%
- Quartz — Anthropic launches Claude Opus 5 at half the price of Fable 5
- Open Source For U — DeepSeek open sources V4-Flash under MIT licence
- Fortune — Washington is keeping its AI rulebook private
- The Independent — Google announces CEO Demis Hassabis to step aside