API de LLM para todos os principais modelos
Use modelos GPT, Claude, Gemini, DeepSeek, Qwen, Grok, Kimi, GLM e MiniMax por meio de uma única API compatível com OpenAI. Troque de modelo mudando um só parâmetro, e todos os modelos têm 20% de desconto sobre o preço de tabela.
Famílias de modelos da API de LLM
Cada página de família lista todas as versões disponíveis com janela de contexto, preço por token e um playground para testar prompts antes da integração.
GPT API
A linha completa de modelos da OpenAI — GPT-6.1, GPT-5.6 e todos os anteriores até o GPT-3.5, além dos modelos de raciocínio da série o, acessíveis por meio de uma única API.
Geração de TextoRaciocínioCódigoVer modelos e preços →Claude API
A família de modelos Claude da Anthropic — do leve Haiku à API do Claude Opus 5.5 para as tarefas mais complexas, conhecida pela segurança, janelas de contexto longas e raciocínio sutil.
RaciocínioContexto LongoIA SeguraVer modelos e preços →Gemini API
A família de modelos Gemini do Google — do ultrarrápido Flash, como a API do Gemini 3.8 Flash, ao poderoso Pro, com janelas de contexto massivas e compreensão multimodal nativa.
MultimodalContexto LongoThinkingVer modelos e preços →DeepSeek API
Acesso à API do DeepSeek V4 e à família de modelos open-source da DeepSeek — os modelos de chat V4 Pro, V4 Flash e V4.1 Flash e o modelo de raciocínio R1, entregando desempenho de fronteira a uma fração do custo.
RaciocínioOpen SourceCusto-BenefícioVer modelos e preços →Qwen API
A família Qwen atende cargas gerais e multimodais. Esta página destaca o qwen3.8-max, com até 983.616 tokens de entrada, 131.072 tokens de saída, raciocínio obrigatório, cache e ferramentas integradas pela Responses API.
Contexto longoRaciocínio obrigatórioFerramentas integradasVer modelos e preços →Grok API
A API do Grok oferece a família Grok da xAI — Grok 4.7, 4.6, 4.5 e 4.3, além de variantes de raciocínio, programação e agentes — por uma API unificada.
RaciocínioCódigoAgentesVer modelos e preços →Doubao API
A família de modelos Doubao da ByteDance — oferecendo fortes capacidades em chinês-inglês, compreensão visual e modos thinking avançados para tarefas complexas.
NLP em ChinêsVisãoThinkingVer modelos e preços →GLM API
A família de modelos GLM da Zhipu AI — modelos bilíngues chinês-inglês com iteração rápida do GLM-4.6 ao GLM-5.3, entregando forte qualidade de raciocínio e geração.
BilíngueRaciocínioChatVer modelos e preços →Kimi API
Acesso à API do Kimi K3 e à família de modelos Kimi da Moonshot AI — com K3 e K2.7 Code, oferecendo fortes capacidades de raciocínio, codificação e modos thinking estendidos.
RaciocínioCodificaçãoThinkingVer modelos e preços →MiniMax API
A família de modelos de linguagem da MiniMax — do M2.1 ao M3, oferecendo desempenho competitivo para chat geral, criação de conteúdo e tarefas bilíngues.
ChatCriação de ConteúdoBilíngueVer modelos e preços →Codex API
Codex API para os modelos de programação da OpenAI — GPT-5.3 Codex, GPT-5.2 Codex, GPT-5.1 Codex Max, GPT-5.1 Codex Mini e mais, em uma API compatível com OpenAI.
Geração de CódigoRaciocínioRevisão de CódigoVer modelos e preços →
Como escolher uma API de LLM
Raciocínio complexo e programação
Claude Opus 5.5, GPT-6.1 e Qwen 3.8 Max lidam com raciocínio em várias etapas, agentes e grandes bases de código.
Chat rápido e barato
Gemini 3.8 Flash, DeepSeek V4.1 Flash e GLM-5.3 Flash mantêm baixos a latência e o custo por token para chat e extração em alto volume.
Contexto longo
Vários modelos suportam janelas de contexto muito longas para análise de documentos e busca; confira o limite de cada modelo na página da família.
Compatível com OpenAI, sem adaptações
Use o SDK da OpenAI que você já tem: aponte a base URL para a APIMart e mude o nome do modelo para trocar de provedor.
Perguntas frequentes sobre a API de LLM
A API de LLM da APIMart é compatível com OpenAI?
Sim. Os modelos de chat usam o formato Chat Completions compatível com OpenAI, então o código existente com o SDK da OpenAI funciona após trocar a base URL, a chave de API e o nome do modelo. Os modelos Claude também estão disponíveis pelo formato Messages.
Como é calculado o preço da API de LLM?
Os modelos de LLM são cobrados por milhão de tokens de entrada e de saída, e alguns também têm preço para entrada em cache. Cada página de família mostra o preço por token de cada modelo, todos os modelos têm 20% de desconto sobre o preço de tabela e os níveis de membro economizam até 28%.
Quais APIs de LLM estão disponíveis?
A APIMart oferece 140+ modelos de chat da OpenAI, Anthropic, Google, DeepSeek, Alibaba Qwen, xAI, Moonshot Kimi, Zhipu GLM e MiniMax, com novas versões adicionadas assim que são lançadas.
Posso usar uma única chave de API para vários provedores de LLM?
Sim. Uma única chave APIMart funciona para todos os modelos de chat, imagem e vídeo, com um só saldo e uma só fatura.
Vocês suportam streaming e function calling?
Sim. Respostas em streaming, chamada de funções ou ferramentas e entrada de imagens são suportadas nos modelos cujos provedores oferecem esses recursos.