Google-Websuche
~$14
Wird nur bei aktivierter Websuche berechnet; die Vorabbelastung wird mit der tatsächlichen Nutzung verrechnet.
Vorab berechnete Abfragen: 1
Googles Gemini-Modellfamilie – vom ultraschnellen Flash, etwa der Gemini 3.8 Flash API, bis zum leistungsstarken Pro, ausgestattet mit riesigen Kontextfenstern und nativem multimodalem Verständnis.
Was beschäftigt Sie?
APIMart fragen
gemini-3.8-flash
Transparente Preise ohne versteckte Gebühren. Sie zahlen nur für das, was Sie nutzen.
Pro 1 Mio. Token
| Tarifart | GoldpreisAktueller Preis | Platinpreis | Diamantpreis | Offizieller Preis | Ihre Ersparnis |
|---|---|---|---|---|---|
| Eingabe | 6~$0.6 | 5.7~$0.57 | 5.4~$0.54 | 7.5~$0.75 | 20% |
| Gecachte Eingabe | 0.6~$0.06 | 0.57~$0.057 | 0.54~$0.054 | 0.75~$0.075 | 20% |
| Ausgabe | 30~$3 | 28.5~$2.85 | 27~$2.7 | 37.5~$3.75 | 20% |
~$14
Wird nur bei aktivierter Websuche berechnet; die Vorabbelastung wird mit der tatsächlichen Nutzung verrechnet.
Vorab berechnete Abfragen: 1
~$0.0833
~$1
Beim Erstellen eines expliziten Caches einmalig nach Token-Anzahl und gewählter TTL berechnet.
Zugriff auf das gesamte Gemini-Portfolio, vom neuesten Gemini 3.8 Flash und Flash Lite bis Gemini 3.1 Pro. Branchenführende Kontextfenster mit über 1 Mio. Token, native multimodale Fähigkeiten und fortschrittliche Thinking-Modi.
50K+
Aktive Nutzer
99.9%
Verfügbarkeit
2x
Schneller
70%
Kosteneinsparung
Warum Gemini eine führende Wahl für multimodale KI ist
Wie Teams Gemini-Modelle in der Produktion nutzen
Starten Sie in Minuten mit der Nutzung der Google-Modelle
Erstellen Sie Ihr kostenloses APIMart-Konto und laden Sie Ihr Guthaben auf.
Generieren Sie einen API-Schlüssel, um programmatisch auf Gemini-Modelle zuzugreifen.
Nutzen Sie den Playground oben oder integrieren Sie über die OpenAI-kompatible API.
Was Entwickler über unsere Gemini-API sagen
“Das Kontextfenster von 1 Mio. Token ist ein Game-Changer. Wir verarbeiten ganze Codebases in einem einzigen Aufruf für unser Code-Review-Tool.”
Alex Chen
Engineering-Leiter
“Gemini Flash ist unglaublich schnell und günstig. Perfekt für unseren Echtzeit-Übersetzungsdienst.”
Sarah Li
Produktmanager
“Die multimodalen Fähigkeiten ermöglichen uns, eine einzige Pipeline für Text, Bilder und Dokumente zu bauen.”
Mike Wang
ML-Ingenieur
“Gemini 2.5 Pro Thinking ist unser Go-to für komplexe Analyseaufgaben. Die Reasoning-Qualität ist exzellent.”
Emily Zhou
Datenwissenschaftler
“Gemini Thinking ist für unser Recherche-Produkt hervorragend. Es analysiert komplexe Informationen Schritt für Schritt.”
David Liu
Senior-Entwickler
“Wir nutzen Flash Lite für Zusammenfassungen mit hohem Volumen. Die Kosteneinsparungen gegenüber GPT-4 sind erheblich.”
Lisa Zhang
Plattform-Ingenieur
Häufige Fragen zur Nutzung der Gemini-API
Wir bieten die neuesten Modelle Gemini 3.8 Flash, 3.7 Flash, 3.6 Flash, 3.5 Flash und 3.5 Flash Lite, dazu Gemini 3.1 Pro Preview, Gemini 3 Pro Preview und Thinking-Varianten. Ältere Modelle wie Gemini 2.5 Pro/Flash und 2.0 Flash bleiben weiterhin verfügbar.
Thinking-Varianten verwenden erweitertes Chain-of-Thought-Reasoning. Sie können das Thinking-Budget steuern (128 bis 3000 Token).
Tokenbasierte Preisgestaltung (Eingabe + Ausgabe). Flash Lite ist am günstigsten, Flash liegt im mittleren Bereich und Pro ist Premium.
Ja. Gemini-Modelle verwenden das Standard-Chat-Completions-Format und funktionieren mit dem OpenAI-SDK.
Ja. Ihre API-Daten werden weder gespeichert noch für das Training verwendet. Alle Anfragen sind verschlüsselt.
Gemini 3.5 Flash Lite für Aufgaben mit hohem Volumen und niedrigen Kosten. Gemini 3.8 Flash für ausgewogene Leistung. Gemini 3.1 Pro für maximale Qualität. Fügen Sie den Thinking-Modus für komplexes Reasoning hinzu.
Ja. Die Google Gemini API wird pro Million Tokens abgerechnet, wobei Input- und Output-Tokens getrennt bepreist werden. Die Preistabelle auf dieser Seite listet alle Modelle und Konfigurationen auf; angezeigt werden die Preise für Gold-Mitglieder (20 % Rabatt). Platinum- und Diamond-Mitglieder sparen noch mehr, bis zu 28 %, und Sie zahlen nur für erfolgreiche Anfragen.
Aufrufe der Gemini 3 API, etwa mit Gemini 3 Pro Preview oder Gemini 3.8 Flash, werden pro Million Input- und Output-Tokens abgerechnet, und jedes Modell hat einen eigenen Preis: Flash Lite ist die günstigste Stufe, Pro die Premium-Stufe. Aktuelle Preise der Gemini API finden Sie in der Live-Preistabelle dieser Seite.
Registrieren Sie sich bei APIMart, öffnen Sie die Seite API Keys und erstellen Sie einen Key. Derselbe Key funktioniert für die Gemini API und alle anderen Modelle auf APIMart – nutzungsbasiert abgerechnet, ohne Abonnement.
Gemini-Modelle auf APIMart nutzen das OpenAI-kompatible Chat-Completions-Format. Wählen Sie mit Ihrem APIMart Key ein Gemini-Modell wie Gemini 3 Pro oder Gemini 3.8 Flash und senden Sie Ihre Nachrichten über das OpenAI SDK oder einen beliebigen HTTP-Client. Modell-IDs, Parameter und Codebeispiele finden Sie in der APIMart-Dokumentation (docs.apimart.ai).
Nein. APIMart bietet für die Gemini API kein kostenloses Kontingent. Gemini-Modelle werden nutzungsbasiert nach Tokens abgerechnet, Sie zahlen nur für erfolgreiche Anfragen, und Mitglieder sparen auf alle Preise 20–28 %.
Sie erreichen uns über den Live-Chat unten rechts auf der Seite, per E-Mail an [email protected] oder über unsere Discord-Community. Unser Team wird sich so schnell wie möglich bei Ihnen melden.
Entdecken Sie weitere Modelle derselben Kategorie.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.