

Guía OpenRouter API: una API para modelos de IA top
Primeros pasos con la OpenRouter API: claves, primera petición, slugs y variantes de modelos, streaming, límites y fallbacks, más las opciones multimodales.
Una clave de API, un endpoint, cientos de modelos de lenguaje. Esa es la propuesta de la API de OpenRouter — y como habla el esquema de OpenAI, la mayoría de las apps pueden adoptarla con solo cambiar la base URL. Esta guía te lleva de cero a llamadas listas para producción.
Lo que aprenderás:
-
Crear una clave y hacer tu primera petición con curl, Python y TypeScript
-
Leer slugs de modelos (
vendor/model) y usar variantes como:free,:nitroy:floor -
Manejar streaming, límites de tasa y fallbacks entre varios modelos
-
Saber cuánto cuesta la plataforma — y cuándo un gateway multimodal encaja mejor

Cómo funciona OpenRouter
El catálogo de modelos
OpenRouter lista cientos de modelos de OpenAI, Anthropic, Google, Meta, Mistral, DeepSeek, Qwen y más, cada uno con precios por token y especificaciones de contexto en su página de modelo [1].
Cómo fluye una petición
Tu petición llega al endpoint unificado, el router elige un proveedor upstream para ese modelo (muchos modelos tienen varios), la ejecuta y normaliza la respuesta al formato de OpenAI. Por defecto, la selección de proveedor equilibra precio y disponibilidad [2].
Cuánto cuesta
La inferencia se factura al precio de lista del proveedor sin recargo; la plataforma cobra un 5.5% (mín. $0.80) al comprar créditos, y los modelos gratuitos tienen un tope de 50 peticiones/día (1,000/día una vez que has comprado $10+ en créditos) [3].
Inicio rápido
1. Crea una cuenta y una clave
Regístrate, compra un paquete pequeño de créditos (también desbloquea el límite gratuito más alto) y genera una clave desde el dashboard. Las claves son tokens bearer: mantenlas en el servidor.
2. Primera petición con curl
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.2",
"messages": [{"role": "user", "content": "Hello from the unified API"}]
}'
3. Python y TypeScript
Los SDK oficiales de OpenAI funcionan tal cual:
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="sk-or-...",
)
resp = client.chat.completions.create(
model="google/gemini-2.5-pro",
messages=[{"role": "user", "content": "Three taglines for a coffee app"}],
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://openrouter.ai/api/v1",
apiKey: process.env.OPENROUTER_API_KEY,
});
Slugs de modelos y variantes
Leer un slug
Los ID de modelo siguen el patrón vendor/model-name, p. ej. anthropic/claude-sonnet-4.5 o deepseek/deepseek-chat. La cadena exacta de la página del modelo es la cadena exacta que espera la API.
Las variantes con sufijo
| Variante | Efecto |
|---|---|
:free | Capacidad gratuita, topes diarios estrictos, sin SLA |
:nitro | Ordena los proveedores por rendimiento — pagas por velocidad |
:floor | Ordena los proveedores por precio — el más barato primero |
Las variantes son pistas de enrutamiento, no pesos distintos: mismo modelo, distinta selección de proveedor [2].
Elegir un modelo
Filtra el catálogo por precio, ventana de contexto y modalidad, y luego haz benchmarks con tu propia tarea. La escalera pragmática: prototipa con una variante :free, lanza con un modelo de gama media y reserva un modelo frontier para el 10% más difícil de las peticiones.
Aspectos de producción
Streaming
Activa "stream": true y consume server-sent events — idéntico al contrato de streaming de OpenAI, así que tu código de UI de streaming existente funciona sin cambios.
Límites de tasa y reintentos
Los límites escalan con tu saldo de créditos en lugar de niveles fijos; los 429 deberían activar un backoff exponencial. Para los modelos gratuitos, presupuesta en torno a los topes de 50/1,000 al día [3].
Fallbacks
Pasa un array models ordenado por prioridad y el router reintenta con el siguiente modelo, del lado del servidor, ante errores o límites de tasa [4]:
{
"model": "openai/gpt-5.2",
"models": ["anthropic/claude-sonnet-4.5", "deepseek/deepseek-chat"],
"messages": [{ "role": "user", "content": "..." }]
}
Cuando necesitas más que modelos de lenguaje
OpenRouter unifica el texto. En cuanto tu roadmap dice «generar una imagen de producto» o «añadir un clip de vídeo», vuelves a las integraciones por proveedor — a menos que tu gateway cubra esas modalidades de forma nativa.
Una API unificada que incluye modelos de medios
APIMart aplica el mismo patrón de una sola clave a 500+ modelos de chat, imagen (GPT-Image-2), vídeo (Sora 2, Kling, Veo) y audio (Suno).
Precios por debajo de la lista, no a precio de lista
Los modelos se ofrecen aproximadamente un 20% por debajo de los precios oficiales, con las tarifas originales y con descuento de cada modelo publicadas en la página de precios — sin cálculos de comisiones aparte.
Compatible con el mismo código
Los endpoints son compatibles con OpenAI, así que el inicio rápido de arriba funciona con otra base URL y otra clave. Tu registro de modelos y tu lógica de fallback se trasladan sin tocar nada.
Accede a 500+ modelos de IA con una sola clave de API
Modelos de chat, imagen, vídeo y audio tras una única API compatible con OpenAI — precios transparentes de pago por uso, alrededor de un 20% por debajo de las tarifas oficiales.
Empieza a construirResumen
Apunta un SDK de OpenAI al endpoint unificado, referencia los modelos por su slug vendor/model, usa :floor o :nitro cuando importen el coste o la velocidad, añade un array de fallback models antes de producción y recuerda que el coste real es el precio de lista más la comisión de recarga del 5.5% [3]. Si tu app también necesita imágenes, vídeo o audio, empieza con un gateway que ya los cubra.
Elige el modelo que quieres en el marketplace
Prueba modelos de chat, imagen y video en el marketplace de APIMart y experimenta rápidamente sus capacidades con una API unificada.
