Búsqueda web de Google
~$14
Solo se cobra cuando la búsqueda web está activada; el precobro se ajusta al uso real.
Consultas precobradas: 1
La familia de modelos Gemini de Google — desde el ultrarrápido Flash, como la API de Gemini 3.8 Flash, hasta el poderoso Pro, con enormes ventanas de contexto y comprensión multimodal nativa.
¿Qué tienes en mente?
Pregúntale a APIMart
gemini-3.8-flash
Precios transparentes sin costos ocultos. Paga solo por lo que usas.
Por 1 millón de tokens
| Concepto | Precio OroPrecio actual | Precio Platino | Precio Diamante | Precio oficial | Tu ahorro |
|---|---|---|---|---|---|
| Entrada | 6~$0.6 | 5.7~$0.57 | 5.4~$0.54 | 7.5~$0.75 | 20% |
| Entrada en caché | 0.6~$0.06 | 0.57~$0.057 | 0.54~$0.054 | 0.75~$0.075 | 20% |
| Salida | 30~$3 | 28.5~$2.85 | 27~$2.7 | 37.5~$3.75 | 20% |
~$14
Solo se cobra cuando la búsqueda web está activada; el precobro se ajusta al uso real.
Consultas precobradas: 1
~$0.0833
~$1
Se cobra una sola vez según el número de tokens y el TTL seleccionado al crear una caché explícita.
Accede a la línea completa de Gemini, desde el más reciente Gemini 3.8 Flash y Flash Lite hasta Gemini 3.1 Pro. Ventanas de contexto líderes en la industria de más de 1M, capacidades multimodales nativas y modos avanzados de thinking.
50K+
Usuarios Activos
99.9%
Tiempo Activo
2x
Más Rápido
70%
Ahorro de Costos
Lo que hace de Gemini una opción líder para IA multimodal
Cómo los equipos aprovechan los modelos Gemini en producción
Comienza a usar los modelos de Google en minutos
Crea tu cuenta gratuita de APIMart y recarga tu saldo.
Genera una clave de API para acceder a los modelos Gemini de forma programática.
Usa el playground de arriba o integra mediante la API compatible con OpenAI.
Lo que los desarrolladores dicen sobre nuestra API de Gemini
“La ventana de contexto de 1M es un cambio total. Procesamos bases de código completas en una sola llamada para nuestra herramienta de revisión de código.”
Alex Chen
Líder de Ingeniería
“Gemini Flash es increíblemente rápido y económico. Perfecto para nuestro servicio de traducción en tiempo real.”
Sarah Li
Gerente de Producto
“Las capacidades multimodales nos permiten construir un único pipeline para texto, imágenes y documentos.”
Mike Wang
Ingeniero de ML
“Gemini 2.5 Pro Thinking es nuestra elección para tareas de análisis complejo. La calidad del razonamiento es excelente.”
Emily Zhou
Científico de Datos
“Gemini Thinking es excelente para nuestro producto de investigación. Analiza información compleja paso a paso.”
David Liu
Desarrollador Senior
“Usamos Flash Lite para resumen de alto volumen. Los ahorros en costos sobre GPT-4 son significativos.”
Lisa Zhang
Ingeniero de Plataforma
Preguntas comunes sobre el uso de la API de Gemini
Ofrecemos los más recientes Gemini 3.8 Flash, 3.7 Flash, 3.6 Flash, 3.5 Flash y 3.5 Flash Lite, además de Gemini 3.1 Pro Preview, Gemini 3 Pro Preview y variantes de thinking. Los modelos anteriores Gemini 2.5 Pro/Flash y 2.0 Flash siguen disponibles.
Las variantes de thinking utilizan razonamiento chain-of-thought extendido. Puedes controlar el presupuesto de thinking (128 a 3000 tokens).
Precio basado en tokens (entrada + salida). Flash Lite es el más económico, Flash es de rango medio y Pro es premium.
Sí. Los modelos Gemini utilizan el formato estándar de chat completions y funcionan con el SDK de OpenAI.
Sí. Los datos de tu API no se almacenan ni se usan para entrenamiento. Todas las solicitudes están cifradas.
Gemini 3.5 Flash Lite para tareas de alto volumen y bajo costo. Gemini 3.8 Flash para rendimiento equilibrado. Gemini 3.1 Pro para máxima calidad. Añade el modo thinking para razonamiento complejo.
Sí. La API de Google Gemini se factura por millón de tokens, con precios distintos para los tokens de entrada y de salida. La tabla de precios de esta página incluye todos los modelos y especificaciones, y los precios mostrados son los de miembro Gold (20 % de descuento). Los miembros Platinum y Diamond ahorran aún más, hasta un 28 %, y solo pagas por las solicitudes exitosas.
Las llamadas a la API de Gemini 3, como Gemini 3 Pro Preview o Gemini 3.8 Flash, se cobran por millón de tokens de entrada y salida, y cada modelo tiene su propia tarifa: Flash Lite es el nivel más económico y Pro el premium. Consulta los precios actuales de la API de Gemini en la tabla en vivo de esta página.
Regístrate en APIMart, abre la página API Keys y crea una clave. La misma clave sirve para la API de Gemini y para todos los demás modelos de APIMart, con pago por uso y sin suscripción.
Los modelos Gemini en APIMart usan el formato Chat Completions compatible con OpenAI. Con tu clave de APIMart, elige un modelo Gemini como Gemini 3 Pro o Gemini 3.8 Flash y envía tus mensajes con el SDK de OpenAI o cualquier cliente HTTP. Los IDs de modelo, parámetros y ejemplos de código están en la documentación de APIMart (docs.apimart.ai).
No. APIMart no ofrece cuota gratuita para la API de Gemini. Los modelos Gemini se pagan por uso según los tokens, solo se cobran las solicitudes exitosas y los miembros ahorran entre un 20 % y un 28 % en todos los precios.
Puedes contactarnos a través del chat en vivo en la esquina inferior derecha de la página, enviarnos un correo a [email protected] o unirte a nuestra comunidad de Discord. Nuestro equipo te responderá lo antes posible.
Explora más modelos de la misma categoría.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.