Multimodal de verdad
Imagen, vídeo, audio y predicción de acciones comparten una arquitectura, así que los estilos y los sujetos se mantienen al pasar de la imagen fija al movimiento.
Microsoft Clarity y Google Analytics están siempre activos para medir las visitas, conectar la actividad entre páginas, comprender el recorrido de los visitantes y ayudarnos a detectar errores.
Al elegir Continuar también se activan otras funciones opcionales, incluido el acceso con Google.
Política de cookiesFlux 3 es el nuevo modelo multimodal de Black Forest Labs: imagen, vídeo, audio y predicción de acciones en una sola arquitectura, con Flux 3 Video en acceso anticipado. Prepara aquí tu plano y consulta el coste exacto en créditos antes de pasar al espacio de trabajo de Imya.
Crea videos con IA a partir de texto o imagen con el modelo Seedance 2.0 desarrollado por ByteDance.
Describe una escena y el modelo la crea desde cero, con audio nativo.
Detalla el sujeto, el movimiento de cámara, la iluminación y el ambiente. Los prompts en inglés suelen dar mejores resultados.
Modelo
Resolución
Relación de aspecto
La generación tarda unos minutos. Mantén esta pestaña abierta: el video terminado aparecerá aquí cuando esté listo.
4 s · 480p · 16:9 · audio activado · 230 créditos
Un modelo
Imagen, vídeo, audio y acción
Hasta 20 s
Multiplano con un solo prompt
Diálogo
Voz generada con la escena
23 jul 2026
BFL anuncia Flux 3
UNA ARQUITECTURA, TODOS LOS MEDIOS
Flux 3 es el modelo multimodal que Black Forest Labs presentó el 23 de julio de 2026: una única arquitectura entrenada de forma conjunta que genera imágenes, vídeo, audio y predicciones de acción, en lugar de modelos separados unidos entre sí. Flux 3 Video abrió su acceso anticipado ese mismo día.
Los primeros probadores destacan dos cosas: clips de hasta 20 segundos que se sostienen a lo largo de varios planos a partir de un solo prompt, y diálogos que funcionan desde indicaciones sorprendentemente vagas. Flux 3 todavía no está en Imya: esta página sigue el acceso con honestidad y te da mientras tanto un creador que funciona, generando vídeo con Seedance 2.0 mientras Flux 2 cubre la parte de imagen.
Imagen, vídeo, audio y predicción de acciones comparten una arquitectura, así que los estilos y los sujetos se mantienen al pasar de la imagen fija al movimiento.
El modelo genera hasta 20 segundos en planos conectados a partir de un prompt: suficiente para una escena con principio, medio y final.
Las demos muestran a Flux 3 produciendo frases habladas a partir de indicaciones tan vagas como un tema. El audio se genera con la escena, no se superpone después.
ACCESO ANTICIPADO A FLUX 3
Flux 3 Video está ahora mismo detrás del acceso anticipado. Estas son las vías reales de entrada y la forma honesta de montar el flujo de trabajo antes de la disponibilidad general.
Black Forest Labs gestiona el acceso anticipado a Flux 3 Video por sus propios canales y el anuncio enlaza el formulario. Las plazas se abren por oleadas, así que solicitarlo pronto cuenta.
Fuente: el anuncio oficial de BFL del 23 de julio de 2026.
Han aparecido vistas previas de Flux 3 por tiempo limitado en plataformas asociadas, a veces solo durante un día o dos. Son reales pero fugaces: trátalas como demos, no como un flujo de trabajo.
Regla: contrasta cualquier vista previa con las publicaciones de BFL.
El creador de arriba genera hoy con Seedance 2.0: prompts pensados para multiplano, audio nativo y precios en créditos publicados. El mismo borrador se traslada cuando llegue Flux 3.
Prueba: un borrador de 5 s a 720p para fijar primero el plano.
La línea de imagen Flux ya está activa en Imya. Para carteles, fotos de producto e imágenes fotorrealistas, Flux 2 funciona ahora: misma familia, sin lista de espera.
Está en /flux-2, enlazado al final de esta página.
TRES FLUJOS DE TRABAJO PRÁCTICOS
Las demos de acceso anticipado se concentran en tres tareas. Cada una puede esbozarse hoy con el creador de esta página y repetirse en Flux 3 cuando se abra el acceso.
Imagen inicial de ejemploLa demo estrella de Flux 3 es la conversación: personajes que despotrican, bromean o explican a partir de indicaciones de una línea, con la voz generada dentro de la escena. Fija ahora el encuadre: un solo hablante y un solo movimiento de cámara.
“Ella se inclina sobre la mesa del restaurante y suelta una frase seca a cámara; luz de tungsteno, poca profundidad de campo, acercamiento lento, sin cortes.”
Imagen inicial de ejemploComo la imagen y el vídeo comparten arquitectura, una foto de producto con estilo Flux puede extenderse a un spot sin que el estilo se desvíe. Prepara hoy el fotograma principal en Flux 2 y anímalo aquí.
“El vapor sube del café mientras la luz de la mañana recorre la mesa; la cámara hace media órbita lenta, la etiqueta se lee y el fondo permanece quieto.”
Imagen inicial de ejemploA los probadores les gusta Flux 3 por la textura histórica: aulas grabadas con cámara de los noventa, noticiarios con grano, sangrado de color de VHS. Nombra la época, el medio y una acción; deja que el modelo aporte los artefactos.
“Grabación de videocámara de los años noventa: niños ante voluminosos ordenadores CRT en un aula; ligero sangrado de color VHS, un niño se gira y sonríe al objetivo, cámara en mano.”
BIBLIOTECA DE PLANOS FLUX 3
Fotogramas de referencia de los estilos a los que vuelven los primeros probadores de Flux 3, y cómo encaja la arquitectura multimodal. Cada uno es un fotograma inicial, no un resultado garantizado.

Black Forest Labs entrenó de forma conjunta imagen, vídeo, audio y predicción de acciones, así que una foto fija y un clip del mismo sujeto mantienen el mismo estilo. Eso permite que una imagen Flux se extienda a un spot de 20 segundos sin desviarse.




PROMPTS DE FLUX 3
Flux 3 responde a indicaciones sueltas mejor que la mayoría de modelos, pero la estructura sigue ganando. Cuatro partes, y la misma forma funciona hoy con los modelos actuales del creador.
Acción del sujeto + diálogo o sonido + movimiento de cámara + época y estilo
Una acción visible ancla el plano: se inclina sobre la mesa, se gira hacia el objetivo, levanta la taza. Primero los verbos, después los adjetivos.
Dale al modelo un tema o una sola frase: «despotricando sobre el tráfico» basta para una interpretación de nivel demo. En los modelos silenciosos de hoy, esa línea simplemente se ignora.
Un movimiento por plano: acercamiento, travelling, órbita, cámara en mano o fija. Lo multiplano sale de tiempos ordenados, no de movimientos apilados.
Flux 3 destaca con medios con nombre propio: videocámara de los noventa, noticiario en 16 mm, digital moderno. Nombra el medio y sus artefactos una vez, y para ahí.
Ejemplo de prompt completo
“Un presentador cansado ordena sus papeles y suelta una frase inexpresiva sobre el tiempo; estética televisiva de los ochenta, ligeras líneas de barrido y temblor de cinta, cámara fija, zumbido de estudio bajo su voz.”
Una acción, una frase hablada, una cámara fija y una época con nombre y sus artefactos: la estructura de cuatro partes que premian las demos de Flux 3, y un borrador silencioso limpio con los modelos de hoy.
CÓMO FUNCIONA
Empieza desde texto, anima un primer fotograma con un último fotograma opcional, o combina imágenes, vídeo y audio de referencia.
Escribe la escena, añade el material de referencia que necesites y elige duración, resolución, encuadre y audio. El presupuesto en créditos se actualiza antes de enviar.
Inicia sesión si hace falta, confirma el coste de Seedance 2.0 que se muestra y envía una sola vez. El progreso y el vídeo terminado aparecen junto a los controles.
LÍMITES REALES Y CRÉDITOS
Esta página de Flux 3 calcula los créditos según el modelo realmente seleccionado en el creador. Las capacidades anunciadas de Flux 3 —multiplano de 20 segundos, diálogo nativo— se etiquetan como anunciadas, no se venden como funciones activas.
Entrada
Texto, fotogramas o referencias
Formatos
Imágenes, MP4/MOV y audio
Límite de subida en Imya
30 MB por archivo
Prompt
Hasta 5.000 caracteres
Duración
4–15 s con Seedance 2.0
Resolución
480p / 720p / 1080p
El presupuesto sigue al modelo, la duración y la resolución seleccionados: con Seedance 2.0 por defecto, un borrador de 5 s a 720p es una forma barata de fijar un plano. Los planes que cumplan los requisitos aplican su descuento automáticamente antes de continuar.
ELIGE SEGÚN EL FLUJO DE TRABAJO
Cómo se sitúa el Flux 3 anunciado junto a su antecesor solo de imagen y al modelo de vídeo que sirve hoy esta página. Las especificaciones anunciadas se indican como tales.
Estado en Imya
Acceso anticipado en BFL: aún no en Imya
Puntos fuertes
Anunciado: vídeo multiplano de 20 s, diálogo nativo, una arquitectura multimodal
Elígelo cuando
Quieres coherencia de imagen, vídeo y audio desde un solo modelo. Sigue esta página para el cambio.
Estado en Imya
Activo ahora para imágenes
Puntos fuertes
Imágenes fotorrealistas, carteles y fotos de producto, resultados editables
Elígelo cuando
Necesitas hoy la estética Flux en imagen fija: fotogramas que esta página puede animar después.
Estado en Imya
Activo ahora (opción por defecto de esta página)
Puntos fuertes
4–15 s, hasta 1080p, audio nativo, seis relaciones de aspecto
Elígelo cuando
Quieres generar vídeo real hoy y con sonido, a precios de créditos publicados.
Esboza primero corto y barato. Cuando Flux 3 se abra, repite la misma imagen inicial y el mismo prompt para juzgar la mejora con tu propio material.
ARREGLA EL BORRADOR
Estas soluciones sirven para los modelos que dan servicio hoy a esta página y se trasladan a Flux 3: la disciplina de cambiar una variable cada vez no cambia nunca.
La época se describe con demasiados artefactos que compiten entre sí, o la imagen inicial contradice el medio indicado.
Nombra el medio una vez con dos artefactos como mucho, y parte de una imagen ya etalonada cerca de esa época.
El modelo seleccionado genera salida silenciosa o solo ambiente: el diálogo nativo es una función estrella todavía en acceso anticipado.
Mantén la frase hablada en tu prompt para más adelante, cambia hoy a un modelo con audio para el ambiente y añade la voz en posproducción.
Los prompts con varios tiempos revelan ángulos no vistos y el retrato de origen está poco definido.
Imagen inicial más nítida, giros más pequeños, un «mantén la cara consistente» explícito y menos tiempos por clip.
Varias acciones, efectos y movimientos de cámara compiten en unos pocos segundos.
Una acción, un movimiento de cámara, una línea de época. Borra adjetivos hasta que el movimiento físico se lea con claridad.
PRIVACIDAD Y CONSERVACIÓN
Puedes preparar la imagen inicial, el prompt y los ajustes antes de iniciar sesión. Durante la preparación, la imagen permanece en este navegador y en este dispositivo. Al pulsar Generar se guarda un borrador local de corta duración; tras iniciar sesión, Imya sube el material únicamente para realizar la generación solicitada a través de Imya y de los proveedores de procesamiento de IA contratados.
Leer la Política de Privacidad completa de ImyaVisitar el sitio oficial de Black Forest LabsLa imagen seleccionada no se sube. Borrar el borrador o el almacenamiento del navegador elimina de este dispositivo los datos locales de preparación.
Los resultados siguen la conservación del historial de Imya: 7 días para cuentas gratuitas y hasta 30 días para miembros de pago activos o Lifetime. Puedes borrar un resultado antes en cualquier momento.
Imya es una interfaz independiente; Flux es una familia de modelos de Black Forest Labs. Imya no reclama ninguna asociación, no vende tus archivos ni los usa para entrenar modelos propios.
PREGUNTAS RESUELTAS
Flux 3 es el modelo multimodal de Black Forest Labs anunciado el 23 de julio de 2026: una arquitectura que genera imágenes, vídeo, audio y predicciones de acción, sucediendo a la línea de imagen Flux.
Sí, el vídeo es lo principal. Flux 3 Video genera clips de hasta 20 segundos repartidos en varios planos a partir de un prompt, y abrió su acceso anticipado el día del anuncio.
Sí. Las demos muestran diálogo hablado producido con la escena desde indicaciones sueltas, además de ambiente y efectos. El audio forma parte de la misma generación, no de un paso aparte.
A través del formulario oficial de acceso anticipado de Black Forest Labs enlazado en el anuncio del 23 de julio de 2026. También han aparecido vistas previas públicas breves en plataformas asociadas.
Se anunció el 23 de julio de 2026, con Flux 3 Video en acceso anticipado desde el primer día. Las fechas de disponibilidad general no se han fijado públicamente; esta página cambia su modelo por defecto cuando Flux 3 llegue a Imya.
Flux 2 es un modelo de imagen. Flux 3 integra imagen, vídeo y audio en una arquitectura, y añade vídeo multiplano de 20 segundos y diálogo nativo. Flux 2 sigue activo hoy en Imya para imágenes fijas.
Todavía no: Flux 3 está en acceso anticipado en BFL. El creador de esta página genera hoy con Seedance 2.0 y lo indica bajo el botón de generar; Flux 2 cubre la parte de imagen.
Preparar las entradas aquí es gratis. Las cuentas nuevas reciben 20 créditos y el presupuesto en vivo de Seedance 2.0 se muestra antes de generar. El precio de Flux 3 en Imya se publicará cuando el modelo esté activo.
No. Las búsquedas mezclan este modelo con el Flux Construct III de Zelda y con el «flujo» de la física. Esta página trata del modelo de IA Flux 3 de Black Forest Labs: generación de imagen, vídeo y audio.
MODELOS RELACIONADOS
El modelo de imagen Flux activo en Imya: imágenes fotorrealistas, carteles y fotos de producto hoy mismo.
El nuevo modelo de vídeo de ByteDance: clips de 30 segundos, hasta 50 entradas de referencia y un creador online.
El nuevo modelo de vídeo de MiniMax con audio nativo y clips en 2K: seguimiento del estado y creador.
Fija ahora tu imagen inicial y tu prompt, esboza con los modelos de hoy y esta página entregará el mismo flujo de trabajo a Flux 3 en cuanto esté activo.
Preparar un borrador de Flux 3