API de LLM para todos los modelos líderes
Usa modelos GPT, Claude, Gemini, DeepSeek, Qwen, Grok, Kimi, GLM y MiniMax a través de una sola API compatible con OpenAI. Cambia de modelo modificando un solo parámetro, y todos los modelos tienen un 20 % de descuento sobre el precio de lista.
Familias de modelos de la API de LLM
Cada página de familia muestra todas las versiones disponibles con su ventana de contexto, precio por token y un playground para probar prompts antes de integrar.
GPT API
La línea completa de modelos de OpenAI — GPT-6.1, GPT-5.6 y todos los anteriores hasta GPT-3.5, además de los modelos de razonamiento de la serie o, accesibles a través de una sola API.
Generación de TextoRazonamientoCódigoVer modelos y precios →Claude API
La familia de modelos Claude de Anthropic — desde el liviano Haiku hasta la API de Claude Opus 5.5 para las tareas más complejas, conocidos por su seguridad, ventanas de contexto extensas y razonamiento detallado.
RazonamientoContexto LargoIA SeguraVer modelos y precios →Gemini API
La familia de modelos Gemini de Google — desde el ultrarrápido Flash, como la API de Gemini 3.8 Flash, hasta el poderoso Pro, con enormes ventanas de contexto y comprensión multimodal nativa.
MultimodalContexto LargoThinkingVer modelos y precios →DeepSeek API
Acceso a la API de DeepSeek V4 y a la familia de modelos de código abierto de DeepSeek — los modelos de chat V4 Pro, V4 Flash y V4.1 Flash y el modelo de razonamiento R1, con rendimiento de vanguardia a una fracción del costo.
RazonamientoCódigo AbiertoRentableVer modelos y precios →Qwen API
La familia Qwen abarca tareas generales y multimodales. Esta página destaca qwen3.8-max, con hasta 983.616 tokens de entrada, 131.072 tokens de salida, razonamiento obligatorio, caché y herramientas integradas mediante Responses API.
Contexto largoRazonamiento obligatorioHerramientas integradasVer modelos y precios →Grok API
La API de Grok ofrece la familia Grok de xAI — Grok 4.7, 4.6, 4.5 y 4.3, además de variantes de razonamiento, programación y agentes — mediante una API unificada.
RazonamientoCódigoAgentesVer modelos y precios →Doubao API
La familia de modelos Doubao de ByteDance — que ofrece sólidas capacidades en chino-inglés, comprensión visual y modos avanzados de thinking para tareas complejas.
NLP ChinoVisiónThinkingVer modelos y precios →GLM API
La familia de modelos GLM de Zhipu AI — modelos bilingües chino-inglés con rápida iteración desde GLM-4.6 hasta GLM-5.3, ofreciendo sólida calidad de razonamiento y generación.
BilingüeRazonamientoChatVer modelos y precios →Kimi API
Acceso a la API de Kimi K3 y a la familia de modelos Kimi de Moonshot AI — con K3 y K2.7 Code que ofrecen sólido razonamiento, capacidades de programación y modos extendidos de thinking.
RazonamientoProgramaciónThinkingVer modelos y precios →MiniMax API
La familia de modelos de lenguaje de MiniMax — desde M2.1 hasta M3, ofreciendo rendimiento competitivo para chat general, creación de contenido y tareas bilingües.
ChatCreación de ContenidoBilingüeVer modelos y precios →Codex API
Codex API para los modelos de programación de OpenAI: GPT-5.3 Codex, GPT-5.2 Codex, GPT-5.1 Codex Max, GPT-5.1 Codex Mini y más, con una API compatible con OpenAI.
Generación de CódigoRazonamientoRevisión de CódigoVer modelos y precios →
Cómo elegir una API de LLM
Razonamiento complejo y programación
Claude Opus 5.5, GPT-6.1 y Qwen 3.8 Max manejan razonamiento de varios pasos, agentes y bases de código grandes.
Chat rápido y económico
Gemini 3.8 Flash, DeepSeek V4.1 Flash y GLM-5.3 Flash mantienen baja la latencia y el costo por token para chat y extracción de alto volumen.
Contexto largo
Varios modelos admiten ventanas de contexto muy largas para análisis de documentos y recuperación; consulta el límite de cada modelo en su página de familia.
Compatible con OpenAI, sin cambios
Usa el SDK de OpenAI que ya tienes: apunta la base URL a APIMart y cambia el nombre del modelo para pasar de un proveedor a otro.
Preguntas frecuentes sobre la API de LLM
¿La API de LLM de APIMart es compatible con OpenAI?
Sí. Los modelos de chat usan el formato Chat Completions compatible con OpenAI, así que tu código actual con el SDK de OpenAI funciona tras cambiar la base URL, la clave de API y el nombre del modelo. Los modelos Claude también están disponibles con el formato Messages.
¿Cómo se calcula el precio de una API de LLM?
Los modelos LLM se cobran por millón de tokens de entrada y de salida, y algunos también tienen precio para la entrada en caché. Cada página de familia muestra el precio por token de cada modelo, todos los modelos tienen un 20 % de descuento sobre el precio de lista y los niveles de membresía permiten ahorrar hasta un 28 %.
¿Qué APIs de LLM están disponibles?
APIMart ofrece 140+ modelos de chat de OpenAI, Anthropic, Google, DeepSeek, Alibaba Qwen, xAI, Moonshot Kimi, Zhipu GLM y MiniMax, y añade las nuevas versiones en cuanto se lanzan.
¿Puedo usar una sola clave de API para varios proveedores de LLM?
Sí. Una sola clave de APIMart funciona con todos los modelos de chat, imagen y video, con un único saldo y una única factura.
¿Admiten streaming y function calling?
Sí. Las respuestas en streaming, la llamada a funciones o herramientas y la entrada de imágenes están disponibles en los modelos cuyos proveedores ofrecen esas funciones.