텍스트 투 비디오 API: 25개 이상 AI 동영상 모델
텍스트 투 비디오 API로 프롬프트를 동영상으로 만드세요. Veo 3.1, Seedance 2.5, Kling V3, Wan 3.0, HappyHorse 1.0 등을 하나의 API 키와 공통 비동기 작업으로 호출하며, 모든 모델이 정가 대비 20% 할인됩니다.
APIMart 텍스트 투 비디오 API 모델
아래 모델은 모두 텍스트 프롬프트만으로 동영상을 생성하며, 같은 APIMart 키와 비동기 작업 흐름, 과금 방식을 공유합니다. 모델을 열어 길이, 해상도, 요금표, 코드 예제를 확인하세요.
FLUX 3 Video API
Black Forest Labs의 FLUX 3 Video는 텍스트-동영상, 순서가 지정된 1~10개의 키프레임을 사용하는 이미지-동영상, 동영상 이어 만들기, 초안 향상을 지원합니다. 동기화 오디오가 포함된 5~20초 HD/FHD 동영상을 생성하고 안전 허용 수준을 설정할 수 있으며 결과는 APIMart CDN에 저장됩니다.
네이티브 오디오5~20초순서형 키프레임HD 및 FHDAPI 및 요금 보기 →Wan 3.0 API
Wan 3.0은 일반 생성, 첫·마지막 프레임 생성, 파일/웹 생성의 세 가지 진입점을 제공하는 Alibaba Cloud의 올인원 동영상 모델입니다. 일반 생성은 프롬프트만 사용하거나 이미지·동영상·오디오 참조를 추가할 수 있으며, 프레임 생성은 첫 프레임이 필수이고 마지막 프레임은 선택 사항입니다. 하나의 비동기 APIMart 엔드포인트에서 선택적으로 오디오를 포함한 2~30초 길이의 동영상을 480P, 720P 또는 1080P로 생성할 수 있습니다.
3가지 생성 진입점최대 30초480P~1080P멀티모달 참조 자료API 및 요금 보기 →Veo 3.1 API
APIMart의 Veo 3.1 API는 Google Veo 3 API의 최신 세대로 veo3.1-fast와 veo3.1-quality 두 모델을 모두 제공합니다. Veo 3.1은 Google DeepMind가 Veo 3를 업그레이드한 모델로, 향상된 시청각 품질, 네이티브 동기화 오디오 및 전문 비디오 제작을 위한 고급 시네마틱 제어를 제공합니다.
상업적 사용API 및 요금 보기 →Gemini Omni 1.1 Flash API
Gemini Omni 1.1 Flash는 Google이 정식 제공하는 Gemini Omni API 멀티모달 동영상 모델로, 생성과 자연어 편집, 프레임 보간, 동영상 연장을 지원합니다. APIMart는 전용 공식 채널에서 비동기 작업 추적과 해상도별 과금을 제공합니다. Omni Flash API를 통한 Gemini Omni Flash는 출력 해상도별로 과금되며, 각 등급의 최신 Google Omni 요금은 이 페이지의 실시간 가격표에서 확인할 수 있습니다.
멀티모달 동영상시작·종료 프레임360p~4KAPI 및 요금 보기 →Gemini Omni 1.1 Flash Ext API
APIMart의 Gemini Omni 1.1 Flash Ext API는 gemini-omni-1.1-flash-ext 모델을 통한 간결한 텍스트-비디오 생성을 제공합니다. model, prompt, duration, resolution, size, 선택적 image_urls를 보내 APIMart의 통합 비디오 생성 엔드포인트에서 AI 비디오를 만들 수 있습니다.
텍스트를 비디오로빠른 생성간단한 APIAPI 및 요금 보기 →Gemini Omni Flash Preview API
APIMart의 Gemini Omni Flash Preview API는 Gemini-Omni-Flash-Preview 모델을 통해 간결한 텍스트-영상, 이미지-영상, 영상-영상 생성을 제공합니다. APIMart의 통합 영상 생성 엔드포인트로 model과 prompt를 전송하여 이 모델을 손쉽게 테스트, 통합, 확장할 수 있습니다.
텍스트-영상 변환이미지-영상 변환영상-영상 변환API 및 요금 보기 →PixVerse V6 API
APIMart의 PixVerse V6 API는 정밀 제어와 예술적 표현에 초점을 둔 비디오 모델입니다. PixVerse로 시네마틱 장면, 물리 기반 움직임, 고품질 인물, 참조 미디어 기반 AI 비디오 워크플로를 만들 수 있습니다.
텍스트 투 비디오이미지 투 비디오정밀 제어API 및 요금 보기 →Kling V3 API
APIMart의 Kling V3 API는 Kuaishou의 최신 AI 비디오 생성 모델을 제공합니다 — kling-v3-omni의 올인원 멀티모달 기능과, kling-v3의 영화급 화질 및 최대 15초 비디오 생성. Kling AI 3.0은 이곳에서 Kling 3.0 API로 제공되며, APIMart 키 하나로 두 모델을 모두 사용할 수 있습니다.
상업적 사용고화질멀티 모델API 및 요금 보기 →Kling V2.6 API
Kling 2.6 API는 APIMart에서 우수한 비용 대비 성능을 갖춘 검증된 AI 비디오 생성을 제공합니다. 오디오 생성, 다이내믹 마스크, 카메라 제어, 네거티브 프롬프트를 지원하여 정밀한 창작 제어를 실현합니다.
상업적 사용오디오 지원카메라 제어API 및 요금 보기 →Kling 3.0 Turbo API
Kling 3.0 Turbo는 APIMart에서 제공하는 Kuaishou의 속도 최적화 Kling AI 비디오 모델로, 뛰어난 속도 대비 품질 비율을 위해 설계되었습니다. 낮은 지연 시간의 프로덕션에 맞게 튜닝된 Kling 3.0 Turbo는 텍스트-비디오, 이미지-비디오, 유연한 화면 비율, 네거티브 프롬프트를 지원합니다.
상업적 사용낮은 지연 시간빠른 생성API 및 요금 보기 →Kling Video O1 API
APIMart의 Kling Video O1 API는 Kuaishou의 플래그십 AI 비디오 생성 모델입니다. kling-video-o1의 사고 기반 생성 기술로 고급 추론 능력을 통해 최고 품질의 출력을 제공하며, 비할 데 없는 시각적 충실도를 실현합니다.
플래그십 모델사고 기반최고 품질API 및 요금 보기 →MiniMax Hailuo 02 API
APIMart의 MiniMax Hailuo 02는 최신 세대 AI 비디오 모델로, 뛰어난 시각적 품질, 높은 모션 일관성 및 전문가급 성능을 제공합니다. Hailuo 02(Hailuo 2로 표기되기도 함)는 API 요청에서 모델 ID MiniMax-Hailuo-02를 사용합니다.
상업적 사용고화질API 및 요금 보기 →MiniMax Hailuo 2.3 API
APIMart의 MiniMax Hailuo 2.3는 최신 세대 AI 비디오 모델로, 뛰어난 시각적 품질, 높은 모션 일관성 및 전문가급 성능을 제공합니다. Hailuo 2.3은 MiniMax-Hailuo-2.3과 MiniMax-Hailuo-2.3-Fast 두 가지 모델 ID로 제공되며 하나의 API 키로 사용할 수 있습니다.
상업적 사용고화질API 및 요금 보기 →MiniMax H3 API
APIMart의 MiniMax H3는 네이티브 2K 출력, 높은 모션 일관성, 멀티모달 참조, 프로급 성능을 제공하는 최신 AI 영상 모델입니다.
상업적 이용고화질API 및 요금 보기 →Vidu Q3 API
Vidu Q3 시리즈는 두 가지 강력한 AI 비디오 생성 모델을 제공합니다. Pro 버전은 극상의 화질과 시네마틱 표현력을, Turbo 버전은 생성 속도와 시각적 품질의 균형을 추구하여 고급 제작부터 빠른 반복 작업까지 다양한 시나리오에 대응합니다.
상업적 사용고화질고속 생성API 및 요금 보기 →Wan 2.5 API
APIMart의 WAN 2.5 API는 최신 AI 비디오 생성 모델로, 뛰어난 시각적 품질, 극도로 높은 동작 일관성 및 전문가 수준의 화면 표현을 제공합니다. Alibaba Wan 2.5는 하나의 API로 텍스트-비디오와 이미지-비디오를 모두 지원합니다.
상업적 사용고화질API 및 요금 보기 →Wan 2.6 API
APIMart의 WAN 2.6 API는 최신 AI 비디오 생성 모델로, 뛰어난 시각적 품질, 극도로 높은 동작 일관성 및 전문가 수준의 화면 표현을 제공합니다. APIMart의 wan2.6 API에는 wan2.6, wan2.6-i2v, wan2.6-i2v-flash 세 가지 모델 ID가 있으며 모두 하나의 키로 호출할 수 있습니다.
상업적 사용고화질API 및 요금 보기 →Wan 2.7 API
APIMart의 WAN 2.7 API는 최신 세대 AI 영상 생성 모델로, 뛰어난 시각적 품질, 높은 모션 일관성, 전문가급 성능을 제공합니다. Wan I2V(이미지-비디오)를 사용하려면 wan2.7에서 첫 프레임과 선택적으로 마지막 프레임을 지정하거나, 참조 기반 영상에는 wan2.7-r2v를 사용하세요.
상업적 사용고화질API 및 요금 보기 →Grok Imagine Video API
APIMart의 Grok Imagine Video API는 xAI의 비디오 모델로 텍스트-투-비디오와 Grok 이미지-투-비디오를 모두 지원합니다. 프롬프트만 보내거나 참조 이미지 URL을 추가해 정지 이미지를 움직이게 할 수 있으며, 뛰어난 시각적 충실도의 고품질 비디오를 생성합니다. 이 Grok video API는 grok-imagine-video, grok-imagine-video-1.5, grok-imagine-1.5-video-ext 세 가지 Grok 영상 모델 ID를 하나의 APIMart 키로 제공합니다.
비디오 생성고품질API 및 요금 보기 →SkyReels V4 API
APIMart의 SkyReels V4 API는 Skywork AI 최초의 영상+오디오 통합 기반 모델입니다. SkyReels V4는 1080p/32 FPS/15초 클립, 네이티브 오디오, 시네마틱 멀티샷 일관성을 한 번의 생성으로 제공합니다.
영상+오디오1080p / 32 FPSAPI 및 요금 보기 →Seedance 1.0 Pro API
Seedance 1.0 Pro Fast 비디오 생성 기술을 경험해보세요. 텍스트나 이미지에서 논리적인 움직임과 높은 충실도를 가진 멋진 비디오를 생성합니다.
상업적 사용API 및 요금 보기 →Seedance 1.5 Pro API
Seedance 1.5 Pro 비디오 생성 기술의 힘을 경험해보세요. 이전 Seedance 버전과 비교하여 더 부드러운 움직임, 더 높은 이미지 품질 및 더 강력한 명령 수행 능력을 제공합니다.
상업적 이용신규Seedance 1.5 ProAPI 및 요금 보기 →Seedance 2.0 API
APIMart의 Seedance 2.0 API는 ByteDance의 최신 AI 비디오 생성 모델로, 놀라운 시각적 품질, 부드러운 모션, 전문가급 시네마틱 출력을 제공합니다. 하나의 Seedance API 키로 Seedance 2 API의 모든 버전(seedance-2.0, seedance-2.0-fast, seedance-2.0-mini)을 사용할 수 있습니다.
상업적 사용고화질API 및 요금 보기 →Seedance 2.5 API
Seedance 2.5는 ByteDance의 차세대 오디오·비디오 기반 모델로, 약 30초 단일 패스 클립, 최대 약 50개 멀티모달 참조, 첫·끝 프레임 제어, 영역 편집, 광고·이커머스·프리비즈를 위한 향상된 연속성을 제공합니다.
AI 영상30초 클립멀티모달 참조네이티브 오디오API 및 요금 보기 →HappyHorse 1.0 API
HappyHorse 1.0 API로 제공되는 HappyHorse는 Alibaba ATH-AI의 통합 멀티모달 비디오 모델입니다. HappyHorse은 단일 forward pass로 동기화된 네이티브 오디오와 함께 1080p 비디오를 생성하며, 7개 언어 립싱크를 지원하고, Artificial Analysis의 text-to-video 및 image-to-video 리더보드에서 1위를 차지했습니다. Happy Horse 1.0으로도 표기되는 이 HappyHorse AI 영상 모델은 같은 플레이그라운드에서 최신 HappyHorse 1.1과 함께 사용할 수 있습니다.
Text to VideoImage to VideoNative Audio1080pAPI 및 요금 보기 →
텍스트 투 비디오 API 선택 가이드
네이티브 오디오 동시 생성
Veo 3.1, Seedance 2.5, HappyHorse 1.0, SkyReels V4, FLUX 3 Video는 화면과 동기화된 사운드를 생성해 대사, 효과음, 환경음을 프롬프트로 지정할 수 있습니다.
긴 클립과 스토리텔링
Seedance 2.5는 30초 클립을 네이티브로 생성하고 Wan 3.0은 2~30초를 지원합니다. Kling V3는 최대 15초입니다.
해상도와 디테일
Gemini Omni 1.1 Flash는 360p~4K, MiniMax H3는 네이티브 2K를 출력합니다.
빠른 초안과 복잡한 프롬프트
Kling 3.0 Turbo, Veo 3.1 Fast, Vidu Q3 Turbo는 빠른 반복에 적합하고, Kling Video O1은 상세한 프롬프트를 추론한 뒤 생성합니다.
텍스트 투 비디오 API FAQ
텍스트 투 비디오 API란 무엇인가요?
텍스트 투 비디오 API는 글로 쓴 프롬프트를 HTTP 요청 한 번으로 동영상 클립으로 바꿔 줍니다. APIMart에서는 모델명, 프롬프트, 길이·해상도 같은 옵션을 보내면 작업 ID를 받고, 완료 후 동영상을 가져옵니다.
어떤 텍스트 투 비디오 API 모델을 골라야 하나요?
용도에 맞춰 고르세요. 오디오가 있는 시네마틱 영상은 Veo 3.1, Seedance 2.5, 움직임 제어는 Kling과 Wan, 대량 초안은 Turbo·Fast 버전이 적합합니다. 키 하나로 같은 프롬프트를 비교할 수 있습니다.
텍스트 투 비디오 API 요금은 어떻게 계산되나요?
모델별로 초 단위 또는 클립 단위로 과금되며 해상도와 길이에 따라 달라집니다. 실시간 요금은 각 모델 페이지의 요금표를 확인하세요. 정가 대비 20% 할인이며 상위 멤버십은 최대 28%까지 절약합니다.
텍스트 투 비디오 API 키는 어떻게 받나요?
APIMart에 가입한 뒤 대시보드의 API Keys 페이지에서 키를 생성하세요. 같은 키로 여기의 모든 동영상 모델과 플랫폼의 190개 이상 모델을 호출할 수 있습니다.
텍스트 투 비디오 API는 어떻게 호출하나요?
프롬프트와 파라미터로 생성 요청을 보낸 뒤, 동영상이 준비될 때까지 작업 ID를 폴링합니다. 요청 형식이 모델 간에 동일해 모델 전환은 대부분 모델명만 바꾸면 됩니다.
텍스트 투 비디오 API는 무료인가요?
아니요. APIMart는 무료 크레딧이 없으며 구독 없는 종량제이고, 실패한 생성은 과금되지 않습니다. 멤버십 할인은 정가 대비 20%~28%입니다.