Changelog
Perubahan penting pada API dan katalog model Nexotao. Perubahan yang memutus kompatibilitas (breaking) dan yang memengaruhi penagihan ditandai secara eksplisit.
Dijadwalkan 2026-08-05 00.00 WIB — penyesuaian tarif model
Tarif seluruh model teks dijadwalkan berubah pada Rabu, 5 Agustus 2026 pukul 00.00 WIB (UTC+7). Lihat tabel tarif baru dan hitung mundurnya.
Tarif baru ditetapkan 25% di bawah harga resmi provider. Daftar Rupiah
terkini tetap tersedia di halaman harga dan GET /models.
- Tarif lama tetap berlaku sampai 4 Agustus pukul 23.59 WIB.
- Tarif baru hanya berlaku untuk request setelah waktu efektif. Pemakaian yang sudah selesai tidak dihitung ulang.
- Nominal saldo Rupiah tidak berubah. Setelah cutover, saldo dipotong memakai
tarif baru yang dipublikasikan oleh
GET /modelspada saat request berjalan. - Token cache Claude dan GPT tetap mengikuti kebijakan katalog: cache-read 10% dan cache-write 125% dari tarif input yang sedang berlaku.
Saat cutover, sebagian model mungkin sementara gagal atau merespons lebih lambat dari biasanya. Pantau banner dashboard dan coba ulang dengan backoff; layanan lain tetap beroperasi normal.
2026-07-26 — Claude Opus 5 live, konteks 1 juta token
claude-opus-5 masuk katalog lewat endpoint Anthropic yang sama. Cukup ganti nilai
model; API key, base URL, dan saldo Rupiah tetap sama.
-
Harga perkenalan di bawah tier Opus yang berlaku, sampai Selasa, 28 Juli 2026 pukul 23.59 WIB.
Update (2026-07-30): periode perkenalan sudah berakhir. Kenaikan harga yang diumumkan di entri ini tidak jadi diberlakukan — tarif Opus 5 saat ini tetap sama dengan tarif perkenalannya. Tarif yang berlaku selalu ada di
GET /modelsdan Model & Harga. -
Context window 1.000.000 token — jauh di atas 350k milik Opus 4.x. Baca
context_windowdari/v1/models, jangan menyamakan window antar model. Lihat Context Window & Kompaksi. -
Vision didukung (blok gambar di
/v1/messages). -
Parameter sampling ditolak. Seperti Opus 4.8 dan 4.7, model ini membalas 400 untuk
temperature,top_p, dantop_k. Gateway membuang ketiganya sebelum meneruskan request, jadi klien lama tidak perlu diubah — tapi nilai yang kamu kirim memang tidak berpengaruh. -
Kapasitas. Opus 5 dilayani tujuh deployment upstream, jadi ada failover kalau salah satu sedang penuh. Meski begitu, request paralel per model masih dibatasi supaya tiap deployment tidak jenuh, jadi lonjakan trafik yang tajam bisa membalas
429 server at capacity, retry shortly— tangani seperti biasa dengan retry + backoff. Batas ini akan dinaikkan seiring pola trafik nyata terlihat.
2026-07-15 — GPT-5.6 Sol, Terra, dan Luna live
Tiga deployment GPT-5.6 baru tersedia lewat endpoint kompatibel OpenAI yang sama.
Cukup ganti nilai model; API key, base URL, dan saldo Rupiah tetap sama.
gpt-5.6-luna— Rp 2.349 input / Rp 4.698 output per 1 juta token.gpt-5.6-terra— Rp 4.500 input / Rp 9.000 output per 1 juta token.gpt-5.6-sol— Rp 7.000 input / Rp 7.000 output per 1 juta token.
Token cache GPT mengikuti tarif cache terverifikasi: cache-read 10% dari input
dan cache-write 125% dari input. Daftar dan tarif authoritative selalu tersedia
di GET /models serta Model & Harga.
2026-07-13 — Positioning model diperjelas: DeepSeek untuk volume/hemat, Claude untuk agentic
Dokumentasi kini menegaskan pemilihan model. DeepSeek-V4-Flash untuk kerjaan
volume tinggi & hemat (klasifikasi, ekstraksi, chat pendek); Claude
(Opus/Sonnet) untuk coding/agentic & konteks besar. DeepSeek berkapasitas kecil
(~20k token/menit), jadi satu request agentic/large-context bisa membalas
429 server at capacity, retry shortly. Lihat FAQ. Tidak ada perubahan
API atau harga — hanya penyelarasan panduan.
2026-06-26 — Pembaruan tarif Opus 4.8 (+30%)
Claude Opus 4.8 (claude-opus-4-8) mendapat tarif publikasi baru pada tanggal
ini, naik +30% dari tarif sebelumnya.
Update (2026-07-30): angka pada entri ini adalah catatan sejarah per 2026-06-26 dan bukan tarif yang berlaku sekarang — Opus 4.8 sudah beberapa kali dihargai ulang sejak saat itu. Tarif yang berlaku selalu ada di
GET /modelsdan Model & Harga.
Apa yang berubah saat itu
- Tarif Opus 4.8 naik +30% dari tarif sebelumnya.
DeepSeek-V4-Protidak berubah.- Saldo kamu tetap penuh — tidak ada kredit yang hilang atau dinilai ulang, dan pemakaian lampau tidak ditagih ulang; tarif baru berlaku untuk pemakaian ke depan.
Kenapa ini penting
Kamu ditagih dalam Rupiah pada tarif yang dipublikasikan saat request berjalan.
Perubahan tarif berlaku untuk pemakaian ke depan — pemakaian yang sudah selesai
pada tarif lama tidak ditagih ulang. Kalau beban kerja hemat-dulu kamu jalan di
DeepSeek-V4-Pro, tidak ada yang berubah untuknya.
2026-06-25 — Context window dipublikasikan: baca angka aslinya, tanpa truncation diam-diam
Setiap model live kini mempublikasikan context_window yang terverifikasi, jadi
klienmu kalibrasi ke window yang sebenarnya alih-alih menebak 200k — dan kami
tidak pernah membuang token diam-diam di belakangmu.
Apa yang baru
context_windowkini dipublikasikan per model diGET /models(tanpa key) maupunGET /v1/models. Ini jumlah token, dan inilah sumber kebenarannya — selalu sinkron dengan yang benar-benar dilayani gateway.- Window yang dipublikasikan saat ini:
claude-opus-4-8→ 350.000 token — lebih besar dari 200k lama yang masih diasumsikan banyak klien secara default.DeepSeek-V4-Pro→ 131.072 token.
Catatan (2026-07-30):
context_windowhanya dipublikasikan untuk model yang batas kerasnya sudah terverifikasi; untuk model lain field-nyanull. Daftar terkini ada di Context Window & Kompaksi.
Kenapa ini penting
Sebagian endpoint memotong (truncate) context-mu diam-diam saat percakapan melebihi window: agent tetap jalan tapi diam-diam kehilangan pesan-pesan paling awal, dan kamu baru sadar saat jawabannya memburuk. Kami tidak begitu. Saat prompt memang melebihi window, kamu mendapat error eksplisit — bukan pembuangan diam-diam. Dan karena kami mempublikasikan angka aslinya, klien yang terkalibrasi (misalnya Claude Code) melakukan kompaksi pada waktu yang tepat alih-alih tersandung lebih awal di tebakan 200k.
# Baca window aslinya — tanpa key
curl https://api.nexotao.com/models # tiap model membawa context_windowYang perlu kamu lakukan
- Baca
context_windowdari API alih-alih menanam 200k (atau mengasumsikan 1M — window Opus yang dipublikasikan adalah 350k, tidak lebih). - Biarkan klienmu melakukan kompaksi. Lihat panduan Context Window & Kompaksi untuk mengkalibrasi Claude Code dan menjaga sesi panjang tetap jalan.
2026-06-24 — Penyederhanaan katalog: dua model, id lama dalam masa tenggang 30 hari
Kami menyederhanakan katalog model live menjadi dua model. Jika kode Anda memakai id model lain, baca catatan penagihan di bawah — ada kemungkinan tarif yang Anda bayar berubah selama masa tenggang.
Apa yang berubah
Update (2026-07-18): penciutan katalog ini kemudian dibatalkan. Model
claude-sonnet-4-6,gpt-5-mini, danDeepSeek-V4-Flashkini aktif kembali sebagai model live dengan tarif sendiri, dan tidak jadi dihapus. Entri di bawah disimpan sebagai catatan sejarah. Katalog live terkini ada di Model & Harga.
-
Katalog live kini hanya dua model chat:
claude-opus-4-8(Claude Opus 4.8)DeepSeek-V4-Pro(DeepSeek V4 Pro)
-
Generate gambar dan transcribe audio tidak lagi tersedia.
POST /v1/images/generationsdanPOST /v1/audio/transcriptionssudah tidak dilayani — tidak ada model gambar atau transcribe yang aktif di katalog.Koreksi (2026-07-30): entri ini semula menulis kedua endpoint membalas
400. Yang benar, route-nya memang tidak terdaftar, jadi keduanya membalas404dengancoderoute.not_found. -
Id lama masih berfungsi selama masa tenggang, lalu berhenti. Permintaan dengan id lama dialihkan secara transparan ke model live selama masa tenggang. Id lama direncanakan untuk dihapus sekitar 2026-07-24, setelah itu mengembalikan
400 unknown model. Kami akan mengumumkan waktu cutover pastinya.
Catatan penagihan — mohon dibaca
Selama masa tenggang, id lama ditagih dengan tarif model live, bukan tarif id lamanya. Beberapa id lama tarifnya lebih murah daripada model tujuannya sekarang, jadi permintaan yang dulu ditagih lebih murah kini ditagih dengan tarif kanonik (lebih tinggi).
Ini dibatasi saldo — Anda tidak pernah ditagih melebihi saldo yang tersedia, dan permintaan yang tidak tertutup saldo akan ditolak, bukan membuat saldo minus — tetapi ini memang perubahan tarif nyata untuk id-id tersebut. Agar tidak ada kejutan, perbarui kode Anda agar memanggil id live secara langsung sekarang, jangan menunggu sampai batas waktu.
Id lama → model live
| Id lama | Dialihkan ke (dan ditagih sebagai) | Catatan |
|---|---|---|
claude-sonnet-4-6 | claude-opus-4-8 | tarif premium vs. id lama |
claude-haiku-4-5 | claude-opus-4-8 | tarif premium; slot background Claude Code |
gpt-5-mini | DeepSeek-V4-Pro | tarif premium vs. id lama |
gpt-4.1-mini | DeepSeek-V4-Pro | tarif premium vs. id lama |
DeepSeek-V4-Flash | DeepSeek-V4-Pro | tarif premium vs. id lama |
Model media yang dipensiunkan (tanpa pengganti): FLUX.2-pro, gpt-4o-transcribe,
gpt-4o-mini-transcribe, whisper.
Yang perlu Anda lakukan
- Perbarui id model menjadi
claude-opus-4-8atauDeepSeek-V4-Pro. - Periksa asumsi penagihan Anda jika sebelumnya memakai id lama yang lebih murah — kini Anda ditagih dengan tarif model live.
- Migrasi secepatnya. Id lama direncanakan untuk dihapus sekitar
2026-07-24, setelah itu mengembalikan
400.
Tarif live selalu tersedia dari GET /models dan di halaman
Model & Harga. Ada pertanyaan? Lihat FAQ.