Prefer automatic inference unless the intended behavior is ambiguous.
Video link valid for 72 hours
テキストからの生成、参照画像のアニメーション、開始・終了フレーム間の補間、既存動画の編集に対応。360p、720p、1080p、4Kを選び、APIMartの非同期タスクで処理を管理できます。
50K+
アクティブユーザー
99.9%
稼働率
2x
高速化
70%
コスト削減
生成、補間、編集、延長ワークフローで利用できる正式な仕様
正式に対応している入力方式を使い、制作と業務処理を細かく制御
キーを作成し、正しい非同期リクエストを送信して完成動画を取得
APIMartにログインしてAPIキーを作成し、AuthorizationヘッダーのBearerトークンとして送信します。キーはサーバー側で保管し、公開クライアントコードには含めないでください。
modelをgemini-omni-1.1-flashに設定し、promptまたは対応する画像・動画素材を1つ以上指定します。省略時はresolutionが720p、aspect_ratioが16:9になります。
生成リクエストを送信し、返されたtask_idを完了まで照会します。動画URLはresult.videos[0].urlから取得し、長期保存する結果はダウンロードしてください。
APIMartで利用できる入力、パラメータ、制限、課金、タスク処理
Googleが正式提供するマルチモーダル動画モデルで、テキスト動画生成、画像動画化、開始・終了フレーム補間、動画編集、対話形式の延長に対応します。APIMartでは専用モデルID gemini-omni-1.1-flashを統一動画APIで使用します。
model、prompt、resolution、aspect_ratio、image_urls、first_frame_image、last_frame_image、image_with_roles、video_urls、metadata.task、extend_from_task_idに対応します。promptまたは画像・動画素材のいずれかが必要です。
指定できません。生成動画は約3〜10秒ですが、このAPIにdurationパラメータはありません。出力は24fpsで、生成音声を含みます。
画像動画化にはfirst_frame_imageだけを、補間にはfirst_frame_imageとlast_frame_imageを一緒に送信します。last_frame_imageだけを送ると400 invalid_frame_imagesになります。2枚の比率は同じにし、aspect_ratioと合わせてください。
開始・終了フレームを含めて画像は合計10枚まで、参照または編集用動画は10秒以内の1本までです。公開HTTP(S) URLと対応するbase64データURLを利用できます。音声入力とYouTubeリンクには対応していません。
POST /v1/videos/generationsに送信してtask_idを保存し、GET /v1/tasks/{task_id}を5〜10秒間隔で照会します。4Kや動画入力は時間がかかるため、クライアントのタイムアウトは最大10分を見込んでください。
直接編集ではvideo_urlsに動画1本と簡潔な指示を渡します。以前の結果を再アップロードせず続ける場合は、extend_from_task_idに成功済みのAPIMartタスクIDを指定します。そのタスクは現在のユーザーが所有するOmniモデルの結果である必要があります。
選択した解像度で出力トークン単価が決まります。APIMartは最大10秒分のクレジットを先に確保し、成功後に実際のトークン使用量へ調整します。失敗時は課金されず、残高不足はHTTP 402になります。
system prompt、temperature、negative prompt専用フィールド、音声入力、durationパラメータには対応していません。除外条件や音声の指示はpromptに直接記述してください。
ページ右下のライブチャット、[email protected] へのメール、またはDiscordコミュニティからお問い合わせいただけます。チームができるだけ早くご対応いたします。
同じカテゴリの他のモデルを探す。

Gemini Omni Flash Preview
gemini-omni-flash-preview is a multimodal video generation and editing model launched by Google.

Kling 3.0 Turbo
Kling-3.0-Turbo: A high-speed, high-quality AI video generation model ideal for quickly creating short videos.

Pixverse V6
pixverse-v6 is PixVerse's sixth-generation AI video generation model, primarily used for text-to-video and image-to-video generation.

Gemini Omni 1.1 Flash Ext
Omni-Flash-Ext is an extended video generation model in version 4.6.4 of Google's Gemini series.