YolahProxy API aktif
Kompatibel SDK OpenAI

Satu API untuk semua model AI

Arahkan SDK OpenAI yang sudah kamu pakai ke endpoint kami — selesai, tidak ada lagi yang berubah. Top up lewat QRIS, bayar per token dalam Rupiah, dan token kamu tidak pernah hangus.

curl https://api.yolahproxy.com/v1/chat/completions \
  -H "Authorization: Bearer rbl_live_••••••••" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Qwen3.6-35B",
    "messages": [{ "role": "user", "content": "Halo!" }]
  }'
200 "content": "Halo! Ada yang bisa kubantu hari ini?"
Protokol
OpenAI v1
Model
18 model
Mulai dari
Rp 1.000
Base URL
api.yolahproxy.com/v1

Beli token

Pilih nominal top up Token tidak ada masa berlaku
Sudah punya key? Top up saja

Token ditambahkan ke key itu, jadi aplikasi kamu tidak perlu diubah.

Cara mulai

Beli token Pilih nominal, scan QRIS, key langsung muncul.
Ganti base URL https://api.yolahproxy.com/v1
Kirim request Pakai SDK OpenAI yang sudah kamu punya — tidak ada yang perlu diubah lagi.
Format yang sudah dikenal

Kompatibel OpenAI v1. SDK Python, Node, dan tool apa pun langsung jalan.

Kuota terlihat

Cek sisa token kapan saja lewat /usage atau GET /api/me.

Streaming stabil

SSE diteruskan apa adanya — cocok untuk agent dan chat panjang.

Tanpa masa berlaku

Token tidak hangus. Berhenti hanya kalau saldo token habis.

Cara kerjanya

Yang dihitungToken masuk + token keluar
Masa berlakuTidak ada — token tidak hangus
Request gagalTidak dipotong
Model flagshipDikali sesuai tanda ×N
Minimum beliRp 1.000

Model yang tersedia

Harga token sama untuk semua. Model flagship memotong token lebih banyak per request — ditandai ×N.

Flagship Model tercanggih — memotong token lebih banyak per request
GLM-5.2×7
Model paling pintar di katalog ini.
128K context
23 paralel
Kimi-K3×15
Context 256K, kemampuan tertinggi.
256K context
23 paralel
DeepSeek-V4-Pro×5
Reasoning kelas atas.
128K context
23 paralel
MiniMax-M3×4
Kuat untuk agent dan tool use.
128K context
23 paralel
Qwen3-235B×3
Model terbesar keluarga Qwen 3.
33K context
23 paralel
Serbaguna Chat, tulis, analisa — pilihan aman untuk hampir semua tugas
Qwen3.6-35B
Qwen terbaru. Paling kuat untuk tugas umum sehari-hari.
33K context
47 paralel
Gemma-4-31B
Gemma 4 dari Google. Seimbang, context 128K.
128K context
47 paralel
Mistral-Small-3.1
Mistral Small 3.1. Ringkas dan cepat.
33K context
47 paralel
GPT-OSS-120B
Model terbuka OpenAI, 120B parameter.
128K context
23 paralel
Coding Menulis, menjelaskan, dan memperbaiki kode
Qwen3-Coder-30B
Khusus kode. Menulis, refactor, dan debug.
33K context
47 paralel
Qwen2.5-Coder-14B
Coder hemat. 95 request paralel.
33K context
95 paralel
Reasoning Soal bertahap: matematika, logika, perencanaan
GLM-4.7-Flash
Berpikir bertahap, hemat token.
128K context
47 paralel
GLM-4.7×4
Reasoning lebih dalam.
128K context
23 paralel
Vision Membaca gambar, screenshot, diagram, dan dokumen
Qwen3-VL-32B
Baca gambar, screenshot, diagram, dokumen.
33K context
47 paralel
Cepat & Hemat Balasan singkat, latensi rendah, paralel paling banyak
Qwen3.5-9B
Balasan cepat, 95 paralel, paling hemat token.
33K context
95 paralel
Phi-4
Kecil tapi tajam, dari Microsoft.
16K context
95 paralel
Context Besar Dokumen panjang dan percakapan yang tidak putus
DeepSeek-V4-Flash
128K context, murah.
128K context
23 paralel
Kimi-Linear-48B
Context panjang, hemat unit.
128K context
47 paralel
Apa arti ×N?

Model flagship jauh lebih mahal untuk dijalankan. Daripada menaikkan harga untuk semua orang, model itu memotong token lebih banyak per request. Contoh: GLM-5.2 bertanda ×7, jadi request 1.000 token memotong 7.000 token dari saldo kamu.

Cara pakai

from openai import OpenAI

client = OpenAI(
    api_key="rbl_live_...",
    base_url="https://api.yolahproxy.com/v1",
)

response = client.chat.completions.create(
    model="Qwen3.6-35B",
    messages=[{"role": "user", "content": "Hello"}],
)

Semua klien yang kompatibel OpenAI bisa dipakai — cukup ganti base URL.