Gemini Omni 1.1 Flash 是 Google 正式发布的多模态视频模型,支持快速生成、自然语言编辑和电影级画面控制。该页面通过 APIMart 统一视频接口接入官方渠道,并使用独立的价格与任务记录。
Prefer automatic inference unless the intended behavior is ambiguous.
Video link valid for 72 hours
通过文本、图片和视频输入创建、编辑与完善 AI 视频。可选择四档输出分辨率、设置首尾帧,并基于已有任务继续编辑或续写。
50K+
活跃用户
99.9%
在线率
2x
更快
70%
成本节省
通过 APIMart 统一接口使用官方渠道的多模态视频生成、编辑和高分辨率输出能力
创作者、开发者和企业如何使用 Gemini Omni 1.1 Flash API 生成视频
从注册账号到生成第一条 Gemini Omni 1.1 Flash AI 视频
注册 APIMart 账号并创建 API Key,用它鉴权 gemini-omni-1.1-flash 模型的统一视频生成请求。
描述主体、动作、场景、镜头、光线和氛围,也可以上传参考图片、指定首尾帧或添加待编辑视频。
将 model 设置为 gemini-omni-1.1-flash 后提交请求,再轮询统一任务状态接口,直到取得生成的视频结果。
在 APIMart 使用 Gemini Omni 1.1 Flash API 与 gemini-omni-1.1-flash 模型时需要了解的信息
Gemini Omni 1.1 Flash 是 Google 正式发布的多模态视频模型,支持文生视频、图生视频、首尾帧插值、视频编辑和对话式续写。在 APIMart 中,请通过统一视频生成接口使用独立模型 ID gemini-omni-1.1-flash。
请求支持 model、prompt、resolution、aspect_ratio、image_urls、first_frame_image、last_frame_image、image_with_roles、video_urls、metadata.task 和 extend_from_task_id。必须提供提示词,或至少提供一个图片或视频素材。
不可以。生成的视频时长约为 3–10 秒,但此 API 不提供 duration 参数。输出为 24 fps,并包含生成的音频。
单独使用 first_frame_image 可进行图生视频;同时提交 first_frame_image 和 last_frame_image 可进行首尾帧插值。只提交 last_frame_image 会返回 400 invalid_frame_images 错误。两张图片应保持相同比例,并与 aspect_ratio 一致。
最多可提供 10 张图片,包括首帧和尾帧;另外最多可提供 1 段不超过 10 秒的参考或待编辑视频。支持公网 HTTP(S) 地址和对应的 base64 data URL,不支持音频输入和 YouTube 链接。
向 /v1/videos/generations 发送 POST 请求并保存返回的 task_id,再每隔 5–10 秒轮询 /v1/tasks/{task_id},直到任务完成或失败。4K 和视频输入任务耗时更长,客户端超时时间建议设置为最多 10 分钟。
直接编辑时,在 video_urls 中提供一段视频并配合明确的提示词。若要在不重新上传视频的情况下继续上一次结果,请在 extend_from_task_id 中提供已成功的 APIMart 任务 ID。该任务必须属于当前用户,并且使用 Omni 模型。
所选分辨率决定输出 Token 费率。APIMart 提交任务时会按最长 10 秒结果预留足够的 Credits,任务成功后再按实际 Token 用量多退少补。失败任务不计费,预留余额不足时会返回 HTTP 402。
该接口不接受 system prompt、temperature、负向提示词字段、音频输入或 duration 参数。请将排除要求和音频生成要求直接写入 prompt。
你可以通过页面右下角的在线客服、发送邮件至 [email protected],或在 Discord 社区中联系我们。我们的团队会尽快回复你的问题。
探索同类型的其他模型。

Gemini Omni Flash Preview
gemini-omni-flash-preview is a multimodal video generation and editing model launched by Google.

Kling 3.0 Turbo
Kling-3.0-Turbo: A high-speed, high-quality AI video generation model ideal for quickly creating short videos.

Pixverse V6
pixverse-v6 is PixVerse's sixth-generation AI video generation model, primarily used for text-to-video and image-to-video generation.

Gemini Omni 1.1 Flash Ext
Omni-Flash-Ext is an extended video generation model in version 4.6.4 of Google's Gemini series.