Eine LLM-API für alle führenden Modelle
Rufen Sie GPT-, Claude-, Gemini-, DeepSeek-, Qwen-, Grok-, Kimi-, GLM- und MiniMax-Modelle über eine OpenAI-kompatible API auf. Wechseln Sie das Modell mit einem einzigen Parameter – und auf jedes Modell gibt es 20 % Rabatt auf den Listenpreis.
LLM-API-Modellfamilien
Jede Familienseite listet alle verfügbaren Versionen mit Kontextfenster und Token-Preisen sowie einen Playground, in dem Sie Prompts vor der Integration testen können.
GPT API
Das komplette OpenAI-Modellportfolio – GPT-6.1, GPT-5.6 und alle Modelle zurück bis GPT-3.5 sowie die Reasoning-Modelle der o-Serie, alle über eine einzige API zugänglich.
TextgenerierungReasoningCodeModelle & Preise ansehen →Claude API
Anthropics Claude-Modellfamilie – vom leichtgewichtigen Haiku bis zur Claude Opus 5.5 API für die anspruchsvollsten Aufgaben, bekannt für Sicherheit, lange Kontextfenster und nuanciertes Reasoning.
ReasoningLanger KontextSichere KIModelle & Preise ansehen →Gemini API
Googles Gemini-Modellfamilie – vom ultraschnellen Flash, etwa der Gemini 3.8 Flash API, bis zum leistungsstarken Pro, ausgestattet mit riesigen Kontextfenstern und nativem multimodalem Verständnis.
MultimodalLanger KontextThinkingModelle & Preise ansehen →DeepSeek API
DeepSeek V4 API für DeepSeeks Open-Source-Modellfamilie – die Chat-Modelle V4 Pro, V4 Flash und V4.1 Flash sowie das R1-Reasoning-Modell liefern Leistung auf Spitzenniveau zu einem Bruchteil der Kosten.
ReasoningOpen SourceKosteneffizientModelle & Preise ansehen →Qwen API
Die Qwen-Familie deckt allgemeine und multimodale Aufgaben ab. Im Mittelpunkt steht qwen3.8-max mit bis zu 983.616 Eingabe-Token, 131.072 Ausgabe-Token, verpflichtendem Reasoning, Caching und integrierten Tools über die Responses API.
Langer KontextPflicht-ReasoningIntegrierte ToolsModelle & Preise ansehen →Grok API
Die Grok API bietet die Grok-Modellfamilie von xAI – Grok 4.7, 4.6, 4.5 und 4.3 sowie Reasoning-, Coding- und Agentenvarianten – über eine einheitliche API.
ReasoningCodingAgentenModelle & Preise ansehen →Doubao API
ByteDances Doubao-Modellfamilie – mit starken Chinesisch-Englisch-Fähigkeiten, Bildverständnis und fortschrittlichen Thinking-Modi für komplexe Aufgaben.
Chinesisches NLPVisionThinkingModelle & Preise ansehen →GLM API
Zhipu AIs GLM-Modellfamilie – zweisprachige Chinesisch-Englisch-Modelle mit schneller Iteration von GLM-4.6 bis GLM-5.3, die starkes Reasoning und Generierungsqualität liefern.
ZweisprachigReasoningChatModelle & Preise ansehen →Kimi API
Kimi K3 API für Moonshot AIs Kimi-Modellfamilie – mit K3 und K2.7 Code, ausgestattet mit starkem Reasoning, Coding-Fähigkeiten und erweiterten Thinking-Modi.
ReasoningCodingThinkingModelle & Preise ansehen →MiniMax API
MiniMaxs Sprachmodellfamilie – von M2.1 bis M3, mit wettbewerbsfähiger Leistung für allgemeinen Chat, Content-Erstellung und zweisprachige Aufgaben.
ChatContent-ErstellungZweisprachigModelle & Preise ansehen →Codex API
Codex API für die Coding-Modelle von OpenAI – GPT-5.3 Codex, GPT-5.2 Codex, GPT-5.1 Codex Max, GPT-5.1 Codex Mini und mehr über eine OpenAI-kompatible API.
CodegenerierungReasoningCode-ReviewModelle & Preise ansehen →
So wählen Sie die richtige LLM-API
Komplexes Reasoning und Coding
Claude Opus 5.5, GPT-6.1 und Qwen 3.8 Max meistern mehrstufiges Reasoning, Agenten und große Codebasen.
Schneller und günstiger Chat
Gemini 3.8 Flash, DeepSeek V4.1 Flash und GLM-5.3 Flash halten Latenz und Token-Kosten für Chat und Extraktion in großem Umfang niedrig.
Langer Kontext
Mehrere Modelle unterstützen sehr lange Kontextfenster für Dokumentanalyse und Retrieval; das Kontextlimit jedes Modells steht auf seiner Familienseite.
Direkt OpenAI-kompatibel
Nutzen Sie Ihr vorhandenes OpenAI SDK: Setzen Sie die Base-URL auf APIMart und ändern Sie den Modellnamen, um den Anbieter zu wechseln.
FAQ zur LLM-API
Ist die LLM-API von APIMart OpenAI-kompatibel?
Ja. Chat-Modelle nutzen das OpenAI-kompatible Chat-Completions-Format, sodass vorhandener OpenAI-SDK-Code nach Änderung von Base-URL, API-Key und Modellname funktioniert. Claude-Modelle sind zusätzlich über das Messages-Format verfügbar.
Wie werden die Preise der LLM-API berechnet?
LLM-Modelle werden pro Million Input- und Output-Tokens abgerechnet, bei einigen Modellen gibt es zudem einen Preis für gecachten Input. Jede Familienseite zeigt die Token-Preise pro Modell, auf jedes Modell gibt es 20 % Rabatt auf den Listenpreis, und mit Mitgliedschaftsstufen sparen Sie bis zu 28 %.
Welche LLM-APIs sind verfügbar?
APIMart bietet 140+ Chat-Modelle von OpenAI, Anthropic, Google, DeepSeek, Alibaba Qwen, xAI, Moonshot Kimi, Zhipu GLM und MiniMax – neue Versionen kommen direkt nach ihrem Release hinzu.
Kann ich einen API-Key für mehrere LLM-Anbieter nutzen?
Ja. Ein einziger APIMart-Key funktioniert für alle Chat-, Bild- und Videomodelle – mit einem Guthaben und einer Rechnung.
Werden Streaming und Function Calling unterstützt?
Ja. Streaming-Antworten, Function- bzw. Tool-Calling und Bildeingabe werden bei Modellen unterstützt, deren Anbieter diese Funktionen bereitstellen.