Une API LLM pour tous les grands modèles
Appelez les modèles GPT, Claude, Gemini, DeepSeek, Qwen, Grok, Kimi, GLM et MiniMax via une seule API compatible OpenAI. Changez de modèle en modifiant un seul paramètre, avec tous les modèles à -20 % sur le prix catalogue.
Familles de modèles de l'API LLM
Chaque page de famille liste toutes les versions disponibles avec leur fenêtre de contexte, leur prix par token et un playground pour tester vos prompts avant l'intégration.
GPT API
La gamme complète des modèles OpenAI — GPT-6.1, GPT-5.6 et tous les modèles jusqu'à GPT-3.5, plus les modèles de raisonnement o-series, accessibles via une seule API.
Génération de texteRaisonnementCodeVoir les modèles et tarifs →Claude API
La famille de modèles Claude d'Anthropic — du léger Haiku à l'API Claude Opus 5.5 pour les tâches les plus complexes, reconnus pour leur sécurité, leurs longues fenêtres de contexte et leur raisonnement nuancé.
RaisonnementContexte longIA sûreVoir les modèles et tarifs →Gemini API
La famille de modèles Gemini de Google — de l'ultrarapide Flash, comme l'API Gemini 3.8 Flash, au puissant Pro, avec d'énormes fenêtres de contexte et une compréhension multimodale native.
MultimodalContexte longThinkingVoir les modèles et tarifs →DeepSeek API
Accès à l'API DeepSeek V4 et à la famille de modèles open source de DeepSeek — les modèles de chat V4 Pro, V4 Flash et V4.1 Flash et le modèle de raisonnement R1, avec des performances de pointe à une fraction du coût.
RaisonnementOpen SourceRentableVoir les modèles et tarifs →Qwen API
La famille Qwen couvre les usages généraux et multimodaux. Cette page met en avant qwen3.8-max, avec jusqu’à 983 616 tokens d’entrée, 131 072 tokens de sortie, un raisonnement obligatoire, le cache et les outils intégrés de la Responses API.
Contexte longRaisonnement obligatoireOutils intégrésVoir les modèles et tarifs →Grok API
L'API Grok donne accès à la famille Grok de xAI — Grok 4.7, 4.6, 4.5 et 4.3, ainsi que des variantes de raisonnement, de programmation et d'agents — via une API unifiée.
RaisonnementCodeAgentsVoir les modèles et tarifs →Doubao API
La famille de modèles Doubao de ByteDance — offrant de fortes capacités chinois-anglais, une compréhension visuelle et des modes thinking avancés pour les tâches complexes.
NLP chinoisVisionThinkingVoir les modèles et tarifs →GLM API
La famille de modèles GLM de Zhipu AI — des modèles bilingues chinois-anglais avec une itération rapide de GLM-4.6 à GLM-5.3, offrant une forte qualité de raisonnement et de génération.
BilingueRaisonnementChatVoir les modèles et tarifs →Kimi API
Accès à l'API Kimi K3 et à la famille de modèles Kimi de Moonshot AI — avec K3 et K2.7 Code offrant un raisonnement solide, des capacités de codage et des modes thinking étendus.
RaisonnementCodageThinkingVoir les modèles et tarifs →MiniMax API
La famille de modèles de langage de MiniMax — de M2.1 à M3, offrant des performances compétitives pour le chat général, la création de contenu et les tâches bilingues.
ChatCréation de contenuBilingueVoir les modèles et tarifs →Codex API
Codex API pour les modèles de code d'OpenAI — GPT-5.3 Codex, GPT-5.2 Codex, GPT-5.1 Codex Max, GPT-5.1 Codex Mini et plus, via une API compatible OpenAI.
Génération de codeRaisonnementRevue de codeVoir les modèles et tarifs →
Comment choisir une API LLM
Raisonnement complexe et code
Claude Opus 5.5, GPT-6.1 et Qwen 3.8 Max gèrent le raisonnement multi-étapes, les agents et les grandes bases de code.
Chat rapide et économique
Gemini 3.8 Flash, DeepSeek V4.1 Flash et GLM-5.3 Flash limitent la latence et le coût par token pour le chat et l'extraction à grand volume.
Contexte long
Plusieurs modèles offrent de très longues fenêtres de contexte pour l'analyse de documents et la recherche ; consultez la limite de chaque modèle sur sa page de famille.
Compatible OpenAI, sans réécriture
Gardez votre SDK OpenAI : pointez la base URL vers APIMart et changez le nom du modèle pour passer d'un fournisseur à l'autre.
FAQ sur l'API LLM
L'API LLM d'APIMart est-elle compatible OpenAI ?
Oui. Les modèles de chat utilisent le format Chat Completions compatible OpenAI : votre code OpenAI SDK existant fonctionne après avoir changé la base URL, la clé API et le nom du modèle. Les modèles Claude sont aussi disponibles au format Messages.
Comment est calculé le prix d'une API LLM ?
Les LLM sont facturés par million de tokens en entrée et en sortie, et certains modèles tarifent aussi l'entrée en cache. Chaque page de famille affiche le prix par token de chaque modèle, tous les modèles sont à -20 % sur le prix catalogue, et les niveaux d'adhésion permettent d'économiser jusqu'à 28 %.
Quelles API LLM sont disponibles ?
APIMart propose plus de 140 modèles de chat d'OpenAI, Anthropic, Google, DeepSeek, Alibaba Qwen, xAI, Moonshot Kimi, Zhipu GLM et MiniMax, et ajoute les nouvelles versions dès leur sortie.
Peut-on utiliser une seule clé API pour plusieurs fournisseurs de LLM ?
Oui. Une seule clé APIMart fonctionne pour tous les modèles de chat, d'image et de vidéo, avec un seul solde et une seule facture.
Le streaming et le function calling sont-ils pris en charge ?
Oui. Les réponses en streaming, l'appel de fonctions ou d'outils et l'entrée d'images sont pris en charge sur les modèles dont les fournisseurs proposent ces fonctionnalités.