kling-motion-control en APIMart utiliza una imagen de referencia más un video de referencia para transferir el movimiento del sujeto a los clips generados. Agrega un prompt opcional, elige la orientación del personaje y el modo, y controla el sonido o la configuración de la marca de agua para los flujos de trabajo de kling motion.
Video link valid for 72 hours
Precios transparentes sin tarifas ocultas. Paga solo por lo que uses.
* Los costos reales dependen del resultado final.
Accede a kling-motion-control en APIMart para generación con imagen de referencia + video de referencia. Sube la imagen del sujeto y el video de movimiento, luego elige la orientación y el modo de calidad para la producción de kling motion.
50K+
Usuarios Activos
99.9%
Tiempo Activo
2x
Más Rápido
70%
Ahorro de Costos
Características clave que hacen diferente a kling-motion-control para los equipos de kling motion
Aplicaciones del mundo real impulsadas por imagen de referencia y video de referencia para casos de uso de kling motion y creadores de Kling
Genera clips con control de movimiento en tres pasos
Regístrate en APIMart y crea tu clave de API para acceder a kling-motion-control.
Sube una imagen de referencia y un video de referencia, luego configura la orientación del personaje, el modo, el sonido original y las opciones de marca de agua para la generación de Kling.
Usa el endpoint nativo de motion-control con image_url, video_url, character_orientation, mode y campos opcionales de prompt o element_list para la integración de aplicaciones de Kling.
Lo que los equipos están diciendo sobre kling-motion-control
“kling-motion-control es exactamente lo que necesitábamos para una iteración rápida. Una imagen de referencia fija al sujeto, mientras que un video de referencia nos brinda un tiempo de movimiento confiable.”
Sarah Johnson
Director Creativo
“Incorporamos kling-motion-control a nuestro pipeline e inmediatamente redujimos el tiempo de integración. La superficie mínima de la API la hace un placer de escalar.”
James Liu
Desarrollador Senior
Preguntas comunes sobre kling-motion-control y la implementación de kling motion
kling-motion-control utiliza una imagen de referencia más un video de referencia para transferir el movimiento a los clips generados. El playground expone los campos multimedia requeridos y la configuración común de generación.
Sí. La ruta nativa de motion-control requiere tanto image_url como video_url. El prompt es opcional, mientras que character_orientation y mode son requeridos para los flujos de trabajo de Kling y las tareas de kling motion.
La salida predeterminada es de 5 segundos. Las extensiones de backend pueden exponer duraciones más largas más adelante.
El precio se cobra por segundo y sigue el modo de generación seleccionado. Consulta el bloque de precios en esta página para conocer las últimas tarifas.
Sí. Envía model, image_url, video_url, character_orientation y mode a /kling/v1/videos/motion-control. La API devuelve un ID de tarea que puedes consultar para obtener la URL del clip final.
Puedes contactarnos a través del chat en vivo en la esquina inferior derecha de la página, enviarnos un correo a [email protected] o unirte a nuestra comunidad de Discord. Nuestro equipo te responderá lo antes posible.
Explora más modelos de la misma categoría.

HappyHorse
HappyHorse-1.0 is an AI model that generates videos based on text input.

SkyReels V4 Fast
SkyReels-V4-Fast is the first unified framework for joint audiovisual generation, restoration, and editing at cinema-grade quality, efficiently achieving 1080p, 15-second multi-shot video generation with synchronized audio and visuals through a dual-stream MMDiT architecture

Wan 2.7
Wan-2.7 is Alibaba’s next-generation multimodal AI video model that generates high-quality videos from text prompts, images, or reference footage. It supports text-to-video, image-to-video, and instruction-based video editing, producing short clips (up to ~15 seconds) with 720p–1080p resolution, realistic motion, and strong character consistency. 

ViduQ 3
Vidu Q3 is an advanced AI video generation model developed by Shengshu Technology that creates cinematic videos from text prompts or images. It supports both text-to-video and image-to-video workflows, generating clips up to around 16 seconds with synchronized native audio, including dialogue and sound effects.