FLUX 3 API de Black Forest Labs réunit la génération et la retouche d’images, la vidéo avec audio natif et la prédiction d’actions dans un même modèle fondamental multimodal. Découvrez les capacités FLUX confirmées pendant qu’APIMart prépare les modalités d’accès.
Un premier aperçu des capacités multimodales annoncées par Black Forest Labs
APIMart prépare l’intégration de FLUX 3 API. Au lancement, la page FLUX 3 API présentera les modalités prises en charge, les formats de requête, les limites et les conditions d’accès.
Les capacités FLUX confirmées dans l’annonce d’accès anticipé de Black Forest Labs
Scénarios créatifs et de production pour de futurs workflows FLUX sur des médias interconnectés
Ce que Black Forest Labs a confirmé sur le modèle FLUX 3 API et sa future disponibilité sur APIMart
FLUX 3 API désigne l’accès au modèle fondamental multimodal de Black Forest Labs pour l’image, la vidéo, l’audio et la prédiction d’actions, avec des entrées textuelles et des références visuelles.
FLUX 3 API arrive bientôt sur APIMart. Aucune date de lancement n’a été annoncée. Les modalités prises en charge, la documentation, les limites et les tarifs seront publiés lorsque l’intégration sera prête.
BFL décrit le modèle FLUX 3 API comme capable de générer simultanément de la vidéo et de l’audio natif, notamment des dialogues multilingues, des ambiances et des sons associés aux événements de la scène.
Pour le modèle FLUX 3 API, BFL indique qu’une vidéo avec audio natif peut atteindre 20 secondes en une génération. Les séquences plus longues peuvent recourir à l’enchaînement et aux références ; les limites d’APIMart ne sont pas encore confirmées.
L’annonce des capacités de FLUX 3 API comprend les conversions texte-vers-vidéo, image-vers-vidéo, vidéo-vers-vidéo et image-clé-vers-vidéo, ainsi que la prolongation vidéo, la prolongation vidéo-plus-audio et le guidage par références.
BFL indique que le modèle FLUX 3 API peut créer et retoucher des images dans différents styles, rapports d’aspect et résolutions, avec une meilleure prise en charge des prompts complexes et du texte multilingue.
Dans le modèle FLUX 3 API, la prédiction d’actions exploite la dynamique visuelle apprise afin d’anticiper ce qui pourrait se produire ensuite. APIMart n’a pas confirmé l’accès à cette capacité.
Le périmètre final de l’intégration de FLUX 3 API n’a pas été annoncé. Les modalités prises en charge, les formats de requête, les limites de sortie, les conditions commerciales et les tarifs seront publiés lorsque l’accès sera disponible.
Découvrez d'autres modèles de la même catégorie.

Gemini Omni Flash Preview
gemini-omni-flash-preview is a multimodal video generation and editing model launched by Google.

Kling 3.0 Turbo
Kling-3.0-Turbo: A high-speed, high-quality AI video generation model ideal for quickly creating short videos.

Pixverse V6
pixverse-v6 is PixVerse's sixth-generation AI video generation model, primarily used for text-to-video and image-to-video generation.

Omni Flash Ext
Omni-Flash-Ext is an extended video generation model in version 4.6.4 of Google's Gemini series.