Model yang tersedia
18 model, satu API. Harga token sama untuk semua — model flagship memotong lebih banyak per request, ditandai ×N.
| Model | Penyedia | Kategori | Context | Paralel | Token per request | Status |
|---|---|---|---|---|---|---|
|
GLM-5.2
×7
Model paling pintar di katalog ini.
|
Z.ai | Flagship | 128K | 23 | 7× | lambat |
|
Kimi-K3
×15
Context 256K, kemampuan tertinggi.
|
Moonshot | Flagship | 256K | 23 | 15× | normal |
|
DeepSeek-V4-Pro
×5
Reasoning kelas atas.
|
DeepSeek | Flagship | 128K | 23 | 5× | normal |
|
MiniMax-M3
×4
Kuat untuk agent dan tool use.
|
MiniMax | Flagship | 128K | 23 | 4× | normal |
|
Qwen3-235B
×3
Model terbesar keluarga Qwen 3.
|
Qwen | Flagship | 33K | 23 | 3× | normal |
|
Qwen3.6-35B
Qwen terbaru. Paling kuat untuk tugas umum sehari-hari.
|
Qwen | Serbaguna | 33K | 47 | 1× | normal |
|
Gemma-4-31B
Gemma 4 dari Google. Seimbang, context 128K.
|
Serbaguna | 128K | 47 | 1× | normal | |
|
Mistral-Small-3.1
Mistral Small 3.1. Ringkas dan cepat.
|
Mistral | Serbaguna | 33K | 47 | 1× | normal |
|
GPT-OSS-120B
Model terbuka OpenAI, 120B parameter.
|
OpenAI | Serbaguna | 128K | 23 | 1× | normal |
|
Qwen3-Coder-30B
Khusus kode. Menulis, refactor, dan debug.
|
Qwen | Coding | 33K | 47 | 1× | normal |
|
Qwen2.5-Coder-14B
Coder hemat. 95 request paralel.
|
Qwen | Coding | 33K | 95 | 1× | terganggu |
|
GLM-4.7-Flash
Berpikir bertahap, hemat token.
|
Z.ai | Reasoning | 128K | 47 | 1× | normal |
|
GLM-4.7
×4
Reasoning lebih dalam.
|
Z.ai | Reasoning | 128K | 23 | 4× | normal |
|
Qwen3-VL-32B
Baca gambar, screenshot, diagram, dokumen.
|
Qwen | Vision | 33K | 47 | 1× | normal |
|
Qwen3.5-9B
Balasan cepat, 95 paralel, paling hemat token.
|
Qwen | Cepat & Hemat | 33K | 95 | 1× | normal |
|
Phi-4
Kecil tapi tajam, dari Microsoft.
|
Microsoft | Cepat & Hemat | 16K | 95 | 1× | terganggu |
|
DeepSeek-V4-Flash
128K context, murah.
|
DeepSeek | Context Besar | 128K | 23 | 1× | normal |
|
Kimi-Linear-48B
Context panjang, hemat unit.
|
Moonshot | Context Besar | 128K | 47 | 1× | normal |
Cara membacanya
| Context | Panjang maksimum percakapan yang muat sekali kirim |
| Paralel | Berapa request model ini bisa jalan bersamaan |
| Token per request | Pengali saldo. ×7 berarti request 1.000 token memotong 7.000 |
| Status | Diukur dari request nyata 24 jam terakhir |