Prefer automatic inference unless the intended behavior is ambiguous.
Video link valid for 72 hours
텍스트 생성, 참조 이미지 애니메이션, 시작·종료 프레임 보간, 기존 영상 편집을 지원합니다. 360p, 720p, 1080p 또는 4K를 선택하고 APIMart 비동기 작업 흐름으로 모든 작업을 관리하세요.
50K+
활성 사용자
99.9%
가동률
2x
더 빠름
70%
비용 절감
생성, 보간, 편집 및 연장 워크플로에 사용할 수 있는 공식 지원 사양
공식 지원 입력 방식을 활용한 세밀한 제작 및 자동화 작업
키를 만들고 올바른 비동기 요청을 제출한 뒤 완성된 영상 가져오기
APIMart에 로그인해 API 키를 만들고 Authorization 헤더에 Bearer 토큰으로 전송합니다. 키는 서버에서 보관하고 공개 클라이언트 코드에 노출하지 마세요.
model을 gemini-omni-1.1-flash로 설정하고 prompt 또는 지원되는 이미지·동영상 소재를 하나 이상 제공합니다. 생략하면 resolution은 720p, aspect_ratio는 16:9가 됩니다.
생성 요청을 제출하고 반환된 task_id를 완료될 때까지 조회합니다. result.videos[0].url에서 영상 URL을 가져오고 장기간 보관할 결과는 다운로드하세요.
APIMart에서 지원하는 입력, 파라미터, 제한, 요금 및 작업 처리 방식
Google이 정식 제공하는 멀티모달 동영상 모델로 텍스트 동영상 생성, 이미지 동영상 변환, 시작·종료 프레임 보간, 동영상 편집, 대화형 연장을 지원합니다. APIMart에서는 전용 모델 ID gemini-omni-1.1-flash를 통합 동영상 API에 사용합니다.
model, prompt, resolution, aspect_ratio, image_urls, first_frame_image, last_frame_image, image_with_roles, video_urls, metadata.task, extend_from_task_id를 지원합니다. prompt 또는 하나 이상의 이미지·동영상 소재가 필요합니다.
아니요. 생성 영상은 약 3~10초이지만 이 API는 duration 파라미터를 제공하지 않습니다. 출력은 24fps이며 생성된 오디오를 포함합니다.
이미지 동영상 변환에는 first_frame_image만 사용하고, 보간에는 first_frame_image와 last_frame_image를 함께 제출합니다. last_frame_image만 보내면 400 invalid_frame_images 오류가 발생합니다. 두 이미지의 비율을 동일하게 하고 aspect_ratio와 맞추세요.
시작·종료 프레임을 포함해 이미지는 총 10개까지, 참조 또는 편집용 동영상은 10초 이하 1개까지 입력할 수 있습니다. 공개 HTTP(S) URL과 지원되는 base64 데이터 URL을 사용할 수 있습니다. 오디오 입력과 YouTube 링크는 지원하지 않습니다.
POST /v1/videos/generations로 요청하고 task_id를 저장한 다음 GET /v1/tasks/{task_id}를 5~10초 간격으로 조회합니다. 4K 및 동영상 입력 작업은 더 오래 걸리므로 클라이언트 제한 시간을 최대 10분으로 설정하세요.
직접 편집할 때는 video_urls에 동영상 1개와 간단한 프롬프트를 전달합니다. 이전 결과를 다시 업로드하지 않고 이어가려면 extend_from_task_id에 성공한 APIMart 작업 ID를 지정합니다. 해당 작업은 현재 사용자가 소유한 Omni 모델 결과여야 합니다.
선택한 해상도에 따라 출력 토큰 단가가 결정됩니다. APIMart는 최대 10초 분량의 크레딧을 먼저 확보하고 성공 후 실제 토큰 사용량으로 조정합니다. 실패한 작업은 과금되지 않으며 잔액이 부족하면 HTTP 402가 반환됩니다.
system prompt, temperature, negative prompt 전용 필드, 오디오 입력, duration 파라미터를 지원하지 않습니다. 제외 조건과 사운드 지시는 prompt에 직접 작성하세요.
페이지 오른쪽 하단의 실시간 채팅, [email protected] 이메일, 또는 Discord 커뮤니티를 통해 문의하실 수 있습니다. 최대한 빠르게 답변드리겠습니다.
같은 카테고리의 다른 모델을 탐색하세요.

Gemini Omni Flash Preview
gemini-omni-flash-preview is a multimodal video generation and editing model launched by Google.

Kling 3.0 Turbo
Kling-3.0-Turbo: A high-speed, high-quality AI video generation model ideal for quickly creating short videos.

Pixverse V6
pixverse-v6 is PixVerse's sixth-generation AI video generation model, primarily used for text-to-video and image-to-video generation.

Gemini Omni 1.1 Flash Ext
Omni-Flash-Ext is an extended video generation model in version 4.6.4 of Google's Gemini series.