

Panduan OpenRouter API: Satu API untuk Model AI Top
Panduan mulai menggunakan OpenRouter API: kunci API, request pertama, slug dan varian model, streaming, rate limit dan fallback, plus opsi gateway multimodal.
Satu API key, satu endpoint, ratusan model bahasa. Itulah tawaran API OpenRouter — dan karena ia memakai skema OpenAI, sebagian besar aplikasi bisa mengadopsinya hanya dengan mengganti base URL. Panduan ini membawa Anda dari nol sampai panggilan yang siap produksi.
Yang akan Anda pelajari:
-
Membuat key dan mengirim request pertama dengan curl, Python, dan TypeScript
-
Membaca slug model (
vendor/model) dan memakai varian seperti:free,:nitro, dan:floor -
Menangani streaming, rate limit, dan fallback multi-model
-
Mengetahui biaya platform ini — dan kapan gateway multimodal lebih cocok

Cara kerja OpenRouter
Katalog model
OpenRouter memuat ratusan model dari OpenAI, Anthropic, Google, Meta, Mistral, DeepSeek, Qwen, dan lainnya, masing-masing dengan harga per token dan spesifikasi konteks di halaman modelnya [1].
Alur sebuah request
Request Anda masuk ke endpoint terpadu, router memilih penyedia upstream untuk model tersebut (banyak model punya beberapa), mengeksekusinya, lalu menormalkan respons ke format OpenAI. Secara default, pemilihan penyedia menyeimbangkan harga dan ketersediaan [2].
Berapa biayanya
Inferensi ditagih sesuai harga resmi penyedia tanpa markup; platform mengenakan 5.5% (min. $0.80) saat Anda membeli kredit, dan model gratis dibatasi 50 request/hari (1,000/hari setelah Anda membeli kredit $10+) [3].
Mulai cepat
1. Buat akun dan key
Daftar, beli paket kredit kecil (sekaligus membuka limit free-tier yang lebih tinggi), lalu buat key dari dashboard. Key adalah bearer token — simpan di sisi server.
2. Request pertama dengan curl
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.2",
"messages": [{"role": "user", "content": "Hello from the unified API"}]
}'
3. Python dan TypeScript
SDK resmi OpenAI langsung bisa dipakai:
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="sk-or-...",
)
resp = client.chat.completions.create(
model="google/gemini-2.5-pro",
messages=[{"role": "user", "content": "Three taglines for a coffee app"}],
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://openrouter.ai/api/v1",
apiKey: process.env.OPENROUTER_API_KEY,
});
Slug model dan varian
Membaca slug
ID model mengikuti pola vendor/model-name, misalnya anthropic/claude-sonnet-4.5 atau deepseek/deepseek-chat. String persis di halaman model adalah string persis yang diharapkan API.
Varian sufiks
| Varian | Efek |
|---|---|
:free | Kapasitas gratis, batas harian ketat, tanpa SLA |
:nitro | Urutkan penyedia berdasarkan throughput — bayar untuk kecepatan |
:floor | Urutkan penyedia berdasarkan harga — yang termurah dulu |
Varian hanyalah petunjuk routing, bukan bobot yang berbeda — model yang sama, pemilihan penyedia yang berbeda [2].
Memilih model
Saring katalog berdasarkan harga, context window, dan modalitas, lalu lakukan benchmark pada tugas Anda sendiri. Tangga pragmatisnya: buat prototipe di varian :free, rilis dengan model kelas menengah, dan simpan model frontier untuk 10% request yang paling sulit.
Perhatian untuk produksi
Streaming
Setel "stream": true dan konsumsi server-sent events — identik dengan kontrak streaming OpenAI, jadi kode UI streaming yang sudah ada tetap berfungsi tanpa perubahan.
Rate limit dan retry
Limit naik mengikuti saldo kredit Anda, bukan tingkatan tetap; respons 429 sebaiknya memicu exponential backoff. Untuk model gratis, rencanakan sekitar batas 50/1,000 per hari [3].
Fallback
Kirim array models yang diurutkan berdasarkan prioritas, dan router akan mencoba model berikutnya di sisi server saat terjadi error atau rate limit [4]:
{
"model": "openai/gpt-5.2",
"models": ["anthropic/claude-sonnet-4.5", "deepseek/deepseek-chat"],
"messages": [{ "role": "user", "content": "..." }]
}
Saat Anda butuh lebih dari model bahasa
OpenRouter menyatukan teks. Begitu roadmap Anda berbunyi "buat gambar produk" atau "tambahkan klip video", Anda kembali ke integrasi per vendor — kecuali gateway Anda mendukung modalitas itu secara native.
API terpadu yang mencakup model media
APIMart menerapkan pola satu key yang sama ke 500+ model: chat, gambar (GPT-Image-2), video (Sora 2, Kling, Veo), dan audio (Suno).
Harga di bawah tarif resmi, bukan sama dengan tarif resmi
Model ditawarkan sekitar 20% di bawah harga resmi, dengan tarif asli vs diskon per model dipublikasikan di halaman harga — tanpa perlu hitung-hitungan biaya terpisah.
Langsung cocok dengan kode yang sama
Endpoint-nya kompatibel dengan OpenAI, jadi mulai cepat di atas berfungsi dengan base URL dan key yang berbeda. Registri model dan logika fallback Anda terbawa tanpa perubahan.
Akses 500+ Model AI dengan Satu API Key
Model chat, gambar, video, dan audio di balik satu API yang kompatibel dengan OpenAI — harga pay-as-you-go transparan, sekitar 20% di bawah tarif resmi.
Mulai MembangunRangkuman
Arahkan SDK OpenAI ke endpoint terpadu, rujuk model lewat slug vendor/model, pakai :floor atau :nitro saat biaya atau kecepatan penting, tambahkan array fallback models sebelum produksi, dan ingat biaya sebenarnya adalah harga resmi plus biaya top-up 5.5% [3]. Jika aplikasi Anda juga butuh gambar, video, atau audio, mulailah dengan gateway yang sudah mencakup semuanya.
Pilih model yang Anda inginkan di marketplace model
Coba model chat, gambar, dan video di marketplace model APIMart, lalu rasakan kemampuan model dengan cepat melalui satu API terpadu.
