Pesquisa na Web do Google
~$14
Cobrado apenas quando a pesquisa na Web está ativada; a pré-cobrança é ajustada ao uso real.
Consultas pré-cobradas: 1
A família de modelos Gemini do Google — do ultrarrápido Flash, como a API do Gemini 3.8 Flash, ao poderoso Pro, com janelas de contexto massivas e compreensão multimodal nativa.
No que você está pensando?
Pergunte ao APIMart
gemini-3.8-flash
Preços transparentes, sem taxas ocultas. Pague apenas pelo que usar.
Por 1 milhão de tokens
| Item de preço | Preço OuroPreço atual | Preço Platina | Preço Diamante | Preço oficial | Sua economia |
|---|---|---|---|---|---|
| Entrada | 6~$0.6 | 5.7~$0.57 | 5.4~$0.54 | 7.5~$0.75 | 20% |
| Entrada em cache | 0.6~$0.06 | 0.57~$0.057 | 0.54~$0.054 | 0.75~$0.075 | 20% |
| Saída | 30~$3 | 28.5~$2.85 | 27~$2.7 | 37.5~$3.75 | 20% |
~$14
Cobrado apenas quando a pesquisa na Web está ativada; a pré-cobrança é ajustada ao uso real.
Consultas pré-cobradas: 1
~$0.0833
~$1
Cobrado uma única vez com base na quantidade de tokens e no TTL selecionado ao criar um cache explícito.
Acesse toda a linha Gemini, do mais recente Gemini 3.8 Flash e do Flash Lite ao Gemini 3.1 Pro. Janelas de contexto líderes do setor de 1M+, capacidades multimodais nativas e modos thinking avançados.
50K+
Usuários Ativos
99.9%
Tempo Ativo
2x
Mais Rápido
70%
Economia de Custos
O que torna o Gemini uma escolha líder para IA multimodal
Como as equipes aproveitam os modelos Gemini em produção
Comece a usar os modelos do Google em minutos
Crie sua conta gratuita na APIMart e recarregue seu saldo.
Gere uma chave de API para acessar os modelos Gemini programaticamente.
Use o playground acima ou integre via API compatível com OpenAI.
O que os desenvolvedores dizem sobre nossa API Gemini
“A janela de contexto de 1M é revolucionária. Processamos bases de código inteiras em uma única chamada para nossa ferramenta de revisão de código.”
Alex Chen
Líder de Engenharia
“O Gemini Flash é incrivelmente rápido e barato. Perfeito para nosso serviço de tradução em tempo real.”
Sarah Li
Gerente de Produto
“As capacidades multimodais nos permitem construir um único pipeline para texto, imagens e documentos.”
Mike Wang
Engenheiro de ML
“Gemini 2.5 Pro Thinking é nosso preferido para tarefas de análise complexas. A qualidade do raciocínio é excelente.”
Emily Zhou
Cientista de Dados
“O Gemini Thinking é excelente para nosso produto de pesquisa. Ele analisa informações complexas passo a passo.”
David Liu
Desenvolvedor Sênior
“Usamos o Flash Lite para sumarização de alto volume. A economia de custos em relação ao GPT-4 é significativa.”
Lisa Zhang
Engenheiro de Plataforma
Perguntas comuns sobre o uso da API Gemini
Oferecemos os mais recentes Gemini 3.8 Flash, 3.7 Flash, 3.6 Flash, 3.5 Flash e 3.5 Flash Lite, além de Gemini 3.1 Pro Preview, Gemini 3 Pro Preview e variantes thinking. Os modelos anteriores Gemini 2.5 Pro/Flash e 2.0 Flash continuam disponíveis.
As variantes thinking usam raciocínio estendido em chain-of-thought. Você pode controlar o thinking budget (128 a 3000 tokens).
Preço baseado em tokens (entrada + saída). Flash Lite é o mais acessível, Flash é intermediário e Pro é premium.
Sim. Os modelos Gemini usam o formato padrão de chat completions e funcionam com o SDK da OpenAI.
Sim. Seus dados de API não são armazenados nem usados para treinamento. Todas as requisições são criptografadas.
Gemini 3.5 Flash Lite para tarefas de alto volume e baixo custo. Gemini 3.8 Flash para desempenho equilibrado. Gemini 3.1 Pro para máxima qualidade. Adicione o modo thinking para raciocínio complexo.
Sim. A API Google Gemini é cobrada por milhão de tokens, com preços separados para tokens de entrada e de saída. A tabela de preços desta página lista todos os modelos e especificações, e os preços exibidos são os de membro Gold (20% de desconto). Membros Platinum e Diamond economizam ainda mais, até 28%, e você só paga pelas solicitações bem-sucedidas.
As chamadas à API Gemini 3, como Gemini 3 Pro Preview ou Gemini 3.8 Flash, são cobradas por milhão de tokens de entrada e saída, e cada modelo tem sua própria tarifa: Flash Lite é o nível mais econômico e Pro é o premium. Veja os preços atuais da API Gemini na tabela em tempo real desta página.
Crie uma conta na APIMart, abra a página API Keys e gere uma chave. A mesma chave funciona para a API Gemini e todos os outros modelos da APIMart, com pagamento conforme o uso e sem assinatura.
Os modelos Gemini na APIMart usam o formato Chat Completions compatível com a OpenAI. Com sua chave da APIMart, escolha um modelo Gemini como Gemini 3 Pro ou Gemini 3.8 Flash e envie suas mensagens pelo SDK da OpenAI ou por qualquer cliente HTTP. IDs de modelo, parâmetros e exemplos de código estão na documentação da APIMart (docs.apimart.ai).
Não. A APIMart não oferece cota gratuita para a API Gemini. Os modelos Gemini são cobrados conforme o uso de tokens, você só paga pelas solicitações bem-sucedidas, e membros economizam de 20% a 28% em todos os preços.
Você pode nos contatar pelo chat ao vivo no canto inferior direito da página, enviar um e-mail para [email protected] ou entrar na nossa comunidade do Discord. Nossa equipe responderá o mais rápido possível.
Explore mais modelos da mesma categoria.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.