Model & Harga
Sama modelnya dengan Anthropic dan OpenAI langsung. Bedanya: bayar per token pakai QRIS. Tanpa kartu USD, tanpa langganan bulanan, tanpa FX card fee.
Nama tampilan vs Model ID
Nama seperti GPT-5.6 Sol adalah nama tampilan untuk dibaca manusia.
Saat memanggil API, gunakan Model ID persis seperti gpt-5.6-sol.
Model ID bersifat case-sensitive: jangan mengubah huruf besar/kecil dan
jangan memakai nama tampilan sebagai nilai model.
Lihat semua Model ID langsung dari katalog live:
curl -s https://api.nexotao.com/models | jq -r '.models[].model'Seluruh 12 model live beserta Model ID-nya:
| Nama tampilan | Model ID untuk API |
|---|---|
| DeepSeek V4 Flash | DeepSeek-V4-Flash |
| DeepSeek V4 Pro | DeepSeek-V4-Pro |
| GPT-5 Mini | gpt-5-mini |
| GPT-5.6 Luna | gpt-5.6-luna |
| GPT-5.6 Sol | gpt-5.6-sol |
| GPT-5.6 Terra | gpt-5.6-terra |
| Grok 4.3 | grok-4.3 |
| Claude Opus 4.6 | claude-opus-4-6 |
| Claude Opus 4.7 | claude-opus-4-7 |
| Claude Opus 4.8 | claude-opus-4-8 |
| Claude Opus 5 | claude-opus-5 |
| Claude Sonnet 4.6 | claude-sonnet-4-6 |
Katalog live tetap yang menentukan — kalau tabel ini dan GET /models berbeda,
percaya GET /models.
Memilih model
Positioning tiap model. Untuk tarifnya, lihat tabel live di bawah.
| Model | Cocok untuk |
|---|---|
DeepSeek-V4-Flash | Volume tinggi & hemat: klasifikasi, ekstraksi, chat pendek. |
DeepSeek-V4-Pro | DeepSeek dengan kualitas lebih tinggi; konteks 131.072 token. |
gpt-5-mini | Tier OpenAI paling hemat — classifier, extract, batch. Mendukung vision. |
gpt-5.6-luna | Efisien untuk kerja harian dan volume tinggi. |
gpt-5.6-terra | Seimbang untuk coding, analisis, dan workflow agent. |
gpt-5.6-sol | Tier GPT-5.6 tertinggi; tarif input dan output sama rata. |
grok-4.3 | Alternatif di luar keluarga GPT dan Claude. |
claude-opus-4-6 | Opus yang masih menerima temperature / top_p / top_k. |
claude-opus-4-7 | Opus generasi sebelumnya; parameter sampling tidak lagi diterima. |
claude-opus-4-8 | Model reasoning terkuat untuk coding dan agentic. |
claude-opus-5 | Opus generasi terbaru; konteks 1.000.000 token. |
claude-sonnet-4-6 | Cepat + pintar untuk chat produk volume tinggi; sampling tetap berfungsi. |
Model Claude dan gpt-5-mini mendukung vision (input gambar); model lain
teks saja. Cek supports_vision di GET /models untuk memastikan.
Pilih model sesuai kerjaannya.
DeepSeekcocok untuk beban volume tinggi & hemat — klasifikasi, ekstraksi, chat pendek — bukan untuk agentic/coding atau konteks besar. Kapasitasnya kecil (~20k token/menit), jadi satu request agentic/large-context bisa kena429 server at capacity. Untuk coding/agentic & konteks besar, pakai Claude (Opus/Sonnet) atau GPT-5.6.
Tarif live per juta token
Tiap model punya tarif per juta token untuk input, output, dan (untuk
Claude/GPT) cache-read + cache-write. Nilai di sini diambil langsung dari
GET /models — selalu sinkron dengan katalog live, tanpa harga yang di-hardcode
di halaman.
Memuat harga live…
Cara membaca tarif
- Teks — tarif per 1 juta token, terpisah untuk input dan output.
- Cache (Claude/GPT) — cache-read jauh lebih murah dari input biasa; cache-write sedikit lebih mahal dari input biasa. Detail di Penagihan & Harga.
- Yang ditagih — selalu
jumlah_token × tarif_model_saat_itu, dibulatkan ke atas. Tidak ada biaya per request atau biaya minimum.
Butuh perkiraan biaya sebelum memanggil API? Ambil tarifnya dari
GET /models lalu kalikan dengan perkiraan jumlah token-mu — atau lihat
nexotao.com/harga untuk kalkulator dan
perbandingan harga.
Detail penagihan, cache, dan billing per request ada di Penagihan & Harga.