Model & Harga

Model & Harga

Sama modelnya dengan Anthropic dan OpenAI langsung. Bedanya: bayar per token pakai QRIS. Tanpa kartu USD, tanpa langganan bulanan, tanpa FX card fee.

Nama tampilan vs Model ID

Nama seperti GPT-5.6 Sol adalah nama tampilan untuk dibaca manusia. Saat memanggil API, gunakan Model ID persis seperti gpt-5.6-sol. Model ID bersifat case-sensitive: jangan mengubah huruf besar/kecil dan jangan memakai nama tampilan sebagai nilai model.

Lihat semua Model ID langsung dari katalog live:

curl -s https://api.nexotao.com/models | jq -r '.models[].model'

Seluruh 12 model live beserta Model ID-nya:

Nama tampilanModel ID untuk API
DeepSeek V4 FlashDeepSeek-V4-Flash
DeepSeek V4 ProDeepSeek-V4-Pro
GPT-5 Minigpt-5-mini
GPT-5.6 Lunagpt-5.6-luna
GPT-5.6 Solgpt-5.6-sol
GPT-5.6 Terragpt-5.6-terra
Grok 4.3grok-4.3
Claude Opus 4.6claude-opus-4-6
Claude Opus 4.7claude-opus-4-7
Claude Opus 4.8claude-opus-4-8
Claude Opus 5claude-opus-5
Claude Sonnet 4.6claude-sonnet-4-6

Katalog live tetap yang menentukan — kalau tabel ini dan GET /models berbeda, percaya GET /models.

Memilih model

Positioning tiap model. Untuk tarifnya, lihat tabel live di bawah.

ModelCocok untuk
DeepSeek-V4-FlashVolume tinggi & hemat: klasifikasi, ekstraksi, chat pendek.
DeepSeek-V4-ProDeepSeek dengan kualitas lebih tinggi; konteks 131.072 token.
gpt-5-miniTier OpenAI paling hemat — classifier, extract, batch. Mendukung vision.
gpt-5.6-lunaEfisien untuk kerja harian dan volume tinggi.
gpt-5.6-terraSeimbang untuk coding, analisis, dan workflow agent.
gpt-5.6-solTier GPT-5.6 tertinggi; tarif input dan output sama rata.
grok-4.3Alternatif di luar keluarga GPT dan Claude.
claude-opus-4-6Opus yang masih menerima temperature / top_p / top_k.
claude-opus-4-7Opus generasi sebelumnya; parameter sampling tidak lagi diterima.
claude-opus-4-8Model reasoning terkuat untuk coding dan agentic.
claude-opus-5Opus generasi terbaru; konteks 1.000.000 token.
claude-sonnet-4-6Cepat + pintar untuk chat produk volume tinggi; sampling tetap berfungsi.

Model Claude dan gpt-5-mini mendukung vision (input gambar); model lain teks saja. Cek supports_vision di GET /models untuk memastikan.

Pilih model sesuai kerjaannya. DeepSeek cocok untuk beban volume tinggi & hemat — klasifikasi, ekstraksi, chat pendek — bukan untuk agentic/coding atau konteks besar. Kapasitasnya kecil (~20k token/menit), jadi satu request agentic/large-context bisa kena 429 server at capacity. Untuk coding/agentic & konteks besar, pakai Claude (Opus/Sonnet) atau GPT-5.6.

Tarif live per juta token

Tiap model punya tarif per juta token untuk input, output, dan (untuk Claude/GPT) cache-read + cache-write. Nilai di sini diambil langsung dari GET /models — selalu sinkron dengan katalog live, tanpa harga yang di-hardcode di halaman.

Memuat harga live…

Cara membaca tarif

  • Teks — tarif per 1 juta token, terpisah untuk input dan output.
  • Cache (Claude/GPT) — cache-read jauh lebih murah dari input biasa; cache-write sedikit lebih mahal dari input biasa. Detail di Penagihan & Harga.
  • Yang ditagih — selalu jumlah_token × tarif_model_saat_itu, dibulatkan ke atas. Tidak ada biaya per request atau biaya minimum.

Butuh perkiraan biaya sebelum memanggil API? Ambil tarifnya dari GET /models lalu kalikan dengan perkiraan jumlah token-mu — atau lihat nexotao.com/harga untuk kalkulator dan perbandingan harga.

Detail penagihan, cache, dan billing per request ada di Penagihan & Harga.