La FLUX 3 API de Black Forest Labs reúne generación y edición de imágenes, video con audio nativo y predicción de acciones en un único modelo fundacional multimodal. Descubre las capacidades FLUX confirmadas mientras APIMart prepara los detalles de acceso.
Un primer vistazo a las capacidades multimodales anunciadas por Black Forest Labs
APIMart está preparando la integración de FLUX 3 API. En el lanzamiento, la página de FLUX 3 API publicará las modalidades compatibles, los formatos de solicitud, los límites y los detalles de acceso.
Capacidades FLUX confirmadas en el anuncio de acceso anticipado de Black Forest Labs
Escenarios creativos y de producción para futuros flujos FLUX entre medios conectados
Lo que Black Forest Labs ha confirmado sobre el modelo FLUX 3 API y su próxima disponibilidad en APIMart
FLUX 3 API hace referencia al acceso al modelo fundacional multimodal de Black Forest Labs para imagen, video, audio y predicción de acciones, con entradas de texto y referencias visuales.
FLUX 3 API llegará próximamente a APIMart. No se ha anunciado una fecha de lanzamiento. Las modalidades compatibles, la documentación, los límites y los precios se publicarán cuando la integración esté lista.
BFL describe el modelo FLUX 3 API como capaz de generar video y audio nativo de forma conjunta, incluidos diálogo multilingüe, sonido ambiente y sonidos asociados a los eventos de la escena.
Para el modelo FLUX 3 API, BFL afirma que el video con audio nativo puede alcanzar 20 segundos en una sola generación. Las secuencias más largas pueden usar encadenamiento y referencias; los límites de APIMart aún no están confirmados.
El anuncio de capacidades de FLUX 3 API incluye texto a video, imagen a video, video a video, fotograma clave a video, continuación de video, continuación de video con audio y guía mediante referencias.
BFL afirma que el modelo FLUX 3 API puede sintetizar y editar imágenes en distintos estilos, relaciones de aspecto y resoluciones, con una mejor interpretación de prompts complejos y texto multilingüe.
En el modelo FLUX 3 API, la predicción de acciones usa la dinámica visual aprendida para anticipar qué podría ocurrir a continuación. APIMart no ha confirmado el acceso a esta capacidad.
El alcance final de la integración de FLUX 3 API no se ha anunciado. Las modalidades compatibles, los formatos de solicitud, los límites de salida, las condiciones comerciales y los precios se publicarán cuando el acceso esté disponible.
Explora más modelos de la misma categoría.

Gemini Omni Flash Preview
gemini-omni-flash-preview is a multimodal video generation and editing model launched by Google.

Kling 3.0 Turbo
Kling-3.0-Turbo: A high-speed, high-quality AI video generation model ideal for quickly creating short videos.

Pixverse V6
pixverse-v6 is PixVerse's sixth-generation AI video generation model, primarily used for text-to-video and image-to-video generation.

Omni Flash Ext
Omni-Flash-Ext is an extended video generation model in version 4.6.4 of Google's Gemini series.