Satu API untuk semua model AI
Arahkan SDK OpenAI yang sudah kamu pakai ke endpoint kami — selesai, tidak ada lagi yang berubah. Top up lewat QRIS, bayar per token dalam Rupiah, dan token kamu tidak pernah hangus.
curl https://api.yolahproxy.com/v1/chat/completions \
-H "Authorization: Bearer rbl_live_••••••••" \
-H "Content-Type: application/json" \
-d '{
"model": "Qwen3.6-35B",
"messages": [{ "role": "user", "content": "Halo!" }]
}'
from openai import OpenAI
client = OpenAI(
api_key="rbl_live_••••••••",
base_url="https://api.yolahproxy.com/v1",
)
response = client.chat.completions.create(
model="Qwen3.6-35B",
messages=[{"role": "user", "content": "Halo!"}],
)
import OpenAI from "openai";
const client = new OpenAI({
apiKey: "rbl_live_••••••••",
baseURL: "https://api.yolahproxy.com/v1",
});
const response = await client.chat.completions.create({
model: "Qwen3.6-35B",
messages: [{ role: "user", content: "Halo!" }],
});
Beli token
Cara mulai
Kompatibel OpenAI v1. SDK Python, Node, dan tool apa pun langsung jalan.
Cek sisa token kapan saja lewat /usage atau GET /api/me.
SSE diteruskan apa adanya — cocok untuk agent dan chat panjang.
Token tidak hangus. Berhenti hanya kalau saldo token habis.
Cara kerjanya
| Yang dihitung | Token masuk + token keluar |
| Masa berlaku | Tidak ada — token tidak hangus |
| Request gagal | Tidak dipotong |
| Model flagship | Dikali sesuai tanda ×N |
| Minimum beli | Rp 1.000 |
Model yang tersedia
Harga token sama untuk semua. Model flagship memotong token lebih banyak per request — ditandai ×N.
| GLM-5.2×7
Model paling pintar di katalog ini. |
128K context 23 paralel |
| Kimi-K3×15
Context 256K, kemampuan tertinggi. |
256K context 23 paralel |
| DeepSeek-V4-Pro×5
Reasoning kelas atas. |
128K context 23 paralel |
| MiniMax-M3×4
Kuat untuk agent dan tool use. |
128K context 23 paralel |
| Qwen3-235B×3
Model terbesar keluarga Qwen 3. |
33K context 23 paralel |
| Qwen3.6-35B
Qwen terbaru. Paling kuat untuk tugas umum sehari-hari. |
33K context 47 paralel |
| Gemma-4-31B
Gemma 4 dari Google. Seimbang, context 128K. |
128K context 47 paralel |
| Mistral-Small-3.1
Mistral Small 3.1. Ringkas dan cepat. |
33K context 47 paralel |
| GPT-OSS-120B
Model terbuka OpenAI, 120B parameter. |
128K context 23 paralel |
| Qwen3-Coder-30B
Khusus kode. Menulis, refactor, dan debug. |
33K context 47 paralel |
| Qwen2.5-Coder-14B
Coder hemat. 95 request paralel. |
33K context 95 paralel |
| GLM-4.7-Flash
Berpikir bertahap, hemat token. |
128K context 47 paralel |
| GLM-4.7×4
Reasoning lebih dalam. |
128K context 23 paralel |
| Qwen3-VL-32B
Baca gambar, screenshot, diagram, dokumen. |
33K context 47 paralel |
| Qwen3.5-9B
Balasan cepat, 95 paralel, paling hemat token. |
33K context 95 paralel |
| Phi-4
Kecil tapi tajam, dari Microsoft. |
16K context 95 paralel |
| DeepSeek-V4-Flash
128K context, murah. |
128K context 23 paralel |
| Kimi-Linear-48B
Context panjang, hemat unit. |
128K context 47 paralel |
Model flagship jauh lebih mahal untuk dijalankan. Daripada menaikkan harga untuk semua orang, model itu memotong token lebih banyak per request. Contoh: GLM-5.2 bertanda ×7, jadi request 1.000 token memotong 7.000 token dari saldo kamu.
Cara pakai
from openai import OpenAI
client = OpenAI(
api_key="rbl_live_...",
base_url="https://api.yolahproxy.com/v1",
)
response = client.chat.completions.create(
model="Qwen3.6-35B",
messages=[{"role": "user", "content": "Hello"}],
)
Semua klien yang kompatibel OpenAI bisa dipakai — cukup ganti base URL.