Recherche Web Google
~$14
Facturé uniquement lorsque la recherche Web est activée ; la préfacturation est régularisée selon l’utilisation réelle.
Requêtes préfacturées: 1
La famille de modèles Gemini de Google — de l'ultrarapide Flash, comme l'API Gemini 3.8 Flash, au puissant Pro, avec d'énormes fenêtres de contexte et une compréhension multimodale native.
À quoi pensez-vous ?
Demandez à APIMart
gemini-3.8-flash
Tarification transparente, sans frais cachés. Payez uniquement ce que vous utilisez.
Par million de tokens
| Type de tarif | Prix OrPrix actuel | Prix Platine | Prix Diamant | Prix officiel | Votre économie |
|---|---|---|---|---|---|
| Entrée | 6~$0.6 | 5.7~$0.57 | 5.4~$0.54 | 7.5~$0.75 | 20% |
| Entrée en cache | 0.6~$0.06 | 0.57~$0.057 | 0.54~$0.054 | 0.75~$0.075 | 20% |
| Sortie | 30~$3 | 28.5~$2.85 | 27~$2.7 | 37.5~$3.75 | 20% |
~$14
Facturé uniquement lorsque la recherche Web est activée ; la préfacturation est régularisée selon l’utilisation réelle.
Requêtes préfacturées: 1
~$0.0833
~$1
Facturé une seule fois selon le nombre de tokens et le TTL choisi lors de la création d’un cache explicite.
Accédez à toute la gamme Gemini, du dernier Gemini 3.8 Flash et de Flash Lite à Gemini 3.1 Pro. Fenêtres de contexte de plus d'1M leaders du secteur, capacités multimodales natives et modes thinking avancés.
50K+
Utilisateurs actifs
99.9%
Disponibilité
2x
Plus rapide
70%
Économies
Ce qui fait de Gemini un choix de premier plan pour l'IA multimodale
Comment les équipes exploitent les modèles Gemini en production
Commencez à utiliser les modèles de Google en quelques minutes
Créez votre compte APIMart gratuit et rechargez votre solde.
Générez une clé API pour accéder aux modèles Gemini par programmation.
Utilisez le playground ci-dessus ou intégrez via l'API compatible OpenAI.
Ce que disent les développeurs de notre API Gemini
“La fenêtre de contexte d'1M change la donne. Nous traitons des bases de code entières en un seul appel pour notre outil de revue de code.”
Alex Chen
Responsable d'ingénierie
“Gemini Flash est incroyablement rapide et bon marché. Parfait pour notre service de traduction en temps réel.”
Sarah Li
Chef de produit
“Les capacités multimodales nous permettent de construire un pipeline unique pour le texte, les images et les documents.”
Mike Wang
Ingénieur ML
“Gemini 2.5 Pro Thinking est notre référence pour les tâches d'analyse complexes. La qualité du raisonnement est excellente.”
Emily Zhou
Data scientist
“Gemini Thinking est excellent pour notre produit de recherche. Il analyse les informations complexes étape par étape.”
David Liu
Développeur senior
“Nous utilisons Flash Lite pour la synthèse à haut volume. Les économies par rapport à GPT-4 sont significatives.”
Lisa Zhang
Ingénieur plateforme
Questions courantes sur l'utilisation de l'API Gemini
Nous proposons les derniers Gemini 3.8 Flash, 3.7 Flash, 3.6 Flash, 3.5 Flash et 3.5 Flash Lite, ainsi que Gemini 3.1 Pro Preview, Gemini 3 Pro Preview et leurs variantes thinking. Les modèles plus anciens Gemini 2.5 Pro/Flash et 2.0 Flash restent disponibles.
Les variantes thinking utilisent un raisonnement étendu par chaîne de pensée. Vous pouvez contrôler le budget thinking (128 à 3000 tokens).
Tarification basée sur les tokens (entrée + sortie). Flash Lite est le plus abordable, Flash est en milieu de gamme et Pro est premium.
Oui. Les modèles Gemini utilisent le format standard des chat completions et fonctionnent avec le SDK OpenAI.
Oui. Vos données d'API ne sont ni stockées ni utilisées pour l'entraînement. Toutes les requêtes sont chiffrées.
Gemini 3.5 Flash Lite pour les tâches à haut volume et à faible coût. Gemini 3.8 Flash pour des performances équilibrées. Gemini 3.1 Pro pour une qualité maximale. Ajoutez le mode thinking pour le raisonnement complexe.
Oui. L'API Google Gemini est facturée par million de tokens, avec des tarifs distincts pour les tokens d'entrée et de sortie. Le tableau des tarifs de cette page couvre tous les modèles et toutes les configurations, et les prix affichés sont ceux des membres Gold (20 % de réduction). Les membres Platinum et Diamond économisent encore plus, jusqu'à 28 %, et vous ne payez que les requêtes réussies.
Les appels à l'API Gemini 3, par exemple avec Gemini 3 Pro Preview ou Gemini 3.8 Flash, sont facturés par million de tokens d'entrée et de sortie, chaque modèle ayant son propre tarif : Flash Lite est le niveau le plus abordable et Pro le niveau premium. Consultez le tableau des prix en temps réel de cette page pour les tarifs actuels de l'API Gemini.
Créez un compte APIMart, ouvrez la page API Keys et générez une clé. La même clé fonctionne pour l'API Gemini et tous les autres modèles d'APIMart, avec une facturation à l'usage et sans abonnement.
Les modèles Gemini sur APIMart utilisent le format Chat Completions compatible OpenAI. Avec votre clé APIMart, choisissez un modèle Gemini comme Gemini 3 Pro ou Gemini 3.8 Flash et envoyez vos messages via le SDK OpenAI ou n'importe quel client HTTP. Les identifiants de modèles, paramètres et exemples de code sont dans la documentation APIMart (docs.apimart.ai).
Non. APIMart ne propose pas de quota gratuit pour l'API Gemini. Les modèles Gemini sont facturés à l'usage selon les tokens, vous ne payez que les requêtes réussies et les membres économisent de 20 % à 28 % sur tous les prix.
Vous pouvez nous joindre via le chat en direct en bas à droite de la page, nous envoyer un e-mail à [email protected], ou rejoindre notre communauté Discord. Notre équipe vous répondra dans les plus brefs délais.
Découvrez d'autres modèles de la même catégorie.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.