Status layanan
Diukur dari request nyata lewat gateway ini, 24 jam terakhir.
Semua normal —
API menerima request seperti biasa.
Kapasitas
4/95
0 mengantri
Model normal
15/18
3 lambat/terganggu
Sukses 1 jam
100.0%
141 request
Latensi rata-rata
21.4s
Status per model
Flagship
| GLM-5.2 ×7 |
100% sukses 20.7s |
lambat |
| Kimi-K3 ×15 |
100% sukses 5.0s |
normal |
| DeepSeek-V4-Pro ×5 |
100% sukses 2.7s |
normal |
| MiniMax-M3 ×4 |
100% sukses 0.8s |
normal |
| Qwen3-235B ×3 |
100% sukses 1.9s |
normal |
Serbaguna
| Qwen3.6-35B |
100% sukses 12.1s |
normal |
| Gemma-4-31B |
100% sukses 2.1s |
normal |
| Mistral-Small-3.1 |
100% sukses 11.7s |
normal |
| GPT-OSS-120B |
100% sukses 0.6s |
normal |
Coding
| Qwen3-Coder-30B |
100% sukses 0.7s |
normal |
| Qwen2.5-Coder-14B
Model sedang penuh di penyedia |
87% sukses 11.4s |
terganggu |
Reasoning
| GLM-4.7-Flash |
100% sukses 4.0s |
normal |
| GLM-4.7 ×4 |
100% sukses 0.8s |
normal |
Vision
| Qwen3-VL-32B |
100% sukses 0.8s |
normal |
Cepat & Hemat
| Qwen3.5-9B |
90% sukses 2.2s |
normal |
| Phi-4 |
65% sukses 6.5s |
terganggu |
Context Besar
| DeepSeek-V4-Flash |
100% sukses 0.5s |
normal |
| Kimi-Linear-48B |
100% sukses 3.1s |
normal |
Komponen
| API inferensi | normal |
| Pembelian token | normal |
| Cek pemakaian | normal |
Untuk pemantauan otomatis
curl https://api.yolahproxy.com/health
Mengembalikan JSON dengan kapasitas dan status tiap model. Cocok untuk uptime monitor.
Angka di atas diukur dari request yang benar-benar lewat gateway ini, jadi mencerminkan yang kamu alami — bukan rata-rata global penyedia model.