Das offiziell von Google veröffentlichte multimodale Videomodell unterstützt Generierung, Bearbeitung per natürlicher Sprache, Frame-Interpolation und Videoverlängerung. APIMart stellt es über einen eigenen offiziellen Kanal mit asynchroner Aufgabenverfolgung und auflösungsabhängiger Abrechnung bereit.
Prefer automatic inference unless the intended behavior is ambiguous.
Video link valid for 72 hours
Generiere aus Text, animiere Referenzbilder, interpoliere zwischen Start- und Endbild oder bearbeite einen vorhandenen Clip. Wähle 360p, 720p, 1080p oder 4K und verwalte jeden Auftrag über den asynchronen APIMart-Workflow.
50K+
Aktive Nutzer
99.9%
Verfügbarkeit
2x
Schneller
70%
Kosteneinsparung
Dokumentierte Steuerungen für Generierung, Interpolation, Bearbeitung und Verlängerung
Nutze die dokumentierten Eingabemodi für kontrollierte Produktion und Automatisierung
Schlüssel erstellen, gültige asynchrone Anfrage senden und fertiges Video abrufen
Melde dich bei APIMart an, erstelle einen API-Schlüssel und sende ihn als Bearer-Token im Authorization-Header. Bewahre ihn auf dem Server auf und veröffentliche ihn nicht im Client-Code.
Setze model auf gemini-omni-1.1-flash und gib einen prompt oder mindestens ein unterstütztes Bild beziehungsweise Video an. Ohne Angabe gilt resolution 720p und aspect_ratio 16:9.
Sende die Anfrage und frage die zurückgegebene task_id bis zum Abschluss ab. Die Video-URL steht in result.videos[0].url; lade Ergebnisse herunter, die du langfristig behalten möchtest.
Eingaben, Parameter, Grenzen, Abrechnung und Aufgabenverarbeitung bei APIMart
Sie bietet Googles offiziell veröffentlichtes multimodales Videomodell für Text-zu-Video, Bild-zu-Video, Start-Endbild-Interpolation, Videobearbeitung und dialogbasierte Verlängerung. Bei APIMart verwendest du die eigene Modell-ID gemini-omni-1.1-flash mit der einheitlichen Video-API.
Unterstützt werden model, prompt, resolution, aspect_ratio, image_urls, first_frame_image, last_frame_image, image_with_roles, video_urls, metadata.task und extend_from_task_id. Ein prompt oder mindestens ein Bild beziehungsweise Video ist erforderlich.
Nein. Erzeugte Clips sind ungefähr 3–10 Sekunden lang, aber diese API bietet keinen duration-Parameter. Die Ausgabe läuft mit 24 fps und enthält generiertes Audio.
Nutze first_frame_image allein für Bild-zu-Video oder zusammen mit last_frame_image für die Interpolation. Nur last_frame_image führt zum Fehler 400 invalid_frame_images. Beide Bilder sollten dieselben Proportionen haben und zu aspect_ratio passen.
Du kannst insgesamt bis zu 10 Bilder einschließlich Start- und Endbild sowie höchstens ein Referenz- oder Bearbeitungsvideo von bis zu 10 Sekunden bereitstellen. Öffentliche HTTP(S)-URLs und unterstützte base64-Daten-URLs sind zulässig. Audioeingaben und YouTube-Links werden nicht unterstützt.
Sende POST /v1/videos/generations, speichere die task_id und frage GET /v1/tasks/{task_id} alle 5–10 Sekunden bis completed oder failed ab. Plane für 4K- und Videoeingabe-Aufgaben einen Client-Timeout von bis zu 10 Minuten ein.
Für die direkte Bearbeitung übergibst du einen Clip in video_urls und einen gezielten Prompt. Um ein Ergebnis ohne erneuten Upload fortzusetzen, trägst du die ID einer erfolgreichen APIMart-Aufgabe in extend_from_task_id ein. Sie muss dem aktuellen Benutzer gehören und mit einem Omni-Modell erstellt worden sein.
Die gewählte Auflösung bestimmt den Preis der Ausgabe-Token. APIMart reserviert zunächst Guthaben für maximal 10 Sekunden und passt die Kosten nach Erfolg an die tatsächliche Nutzung an. Fehlgeschlagene Aufgaben kosten nichts; zu wenig Guthaben führt zu HTTP 402.
Die API akzeptiert keinen system prompt, keine temperature, kein separates negative-prompt-Feld, keine Audioeingabe und keinen duration-Parameter. Schreibe Ausschlüsse und Tonanweisungen direkt in prompt.
Sie erreichen uns über den Live-Chat unten rechts auf der Seite, per E-Mail an [email protected] oder über unsere Discord-Community. Unser Team wird sich so schnell wie möglich bei Ihnen melden.
Entdecken Sie weitere Modelle derselben Kategorie.

Gemini Omni Flash Preview
gemini-omni-flash-preview is a multimodal video generation and editing model launched by Google.

Kling 3.0 Turbo
Kling-3.0-Turbo: A high-speed, high-quality AI video generation model ideal for quickly creating short videos.

Pixverse V6
pixverse-v6 is PixVerse's sixth-generation AI video generation model, primarily used for text-to-video and image-to-video generation.

Gemini Omni 1.1 Flash Ext
Omni-Flash-Ext is an extended video generation model in version 4.6.4 of Google's Gemini series.