updateModelos e insights13 min de lectura

FLUX 3 al descubierto: qué se lanzó realmente y qué no

FLUX 3 llegó el 23 de julio de 2026 con vídeo de 20 segundos y audio nativo, pero sin modelo de imagen. Qué se lanzó, qué dicen los benchmarks y qué usar hoy.

Equipo OmniArt
FLUX 3 al descubierto: qué se lanzó realmente y qué no

Black Forest Labs anunció FLUX 3 el 23 de julio de 2026 y lo describió como un modelo multimodal de frontera para la inteligencia visual. Dos días después, el titular que importa a la mayoría de creadores no es lo que hace FLUX 3 — es lo que puedes ejecutar de verdad. FLUX 3 Video está detrás de un formulario de solicitud. FLUX 3 Action está detrás de un acuerdo de partner. Y FLUX 3 Image, la parte sobre la que se construyó el nombre FLUX, no se ha lanzado en absoluto.

Esa brecha es la noticia. La empresa que convirtió la generación de imágenes con pesos abiertos en una opción seria ha lanzado un buque insignia en el que la mitad de imagen es justamente la pieza que falta, y ha orientado el resto del anuncio hacia el vídeo, el audio y la robótica. Es un giro real, y dice algo sobre dónde está la presión en este mercado.

Este artículo separa el anuncio del producto: qué existe hoy, qué demuestran y qué no demuestran las cifras de benchmark de BFL, cuál es realmente la afirmación arquitectónica y a qué recurrir mientras FLUX 3 Image siga detrás de la lista de espera.

Qué anunció realmente Black Forest Labs

FLUX 3 se presenta como una única familia de modelos entrenada conjuntamente en imagen, vídeo, audio y acción, en lugar de cuatro sistemas separados. El anuncio cubre FLUX 3 Video, FLUX 3 Image, FLUX 3 Action (con una variante de robótica llamada FLUX-mimic) y un futuro FLUX 3 Dev de pesos abiertos.

La disponibilidad es otra tabla completamente distinta.

Estado de lanzamiento de cada componente de FLUX 3 dos días después del anuncio: vídeo y acción en acceso anticipado, mientras el modelo de imagen, los pesos abiertos y los precios siguen sin publicarse
Estado de lanzamiento de cada componente de FLUX 3 dos días después del anuncio: vídeo y acción en acceso anticipado, mientras el modelo de imagen, los pesos abiertos y los precios siguen sin publicarse

Advertencia

No hay precios públicos de FLUX 3, ni recuento de parámetros publicado, ni informe técnico de la familia de modelos, ni condiciones de licencia para el prometido lanzamiento de pesos abiertos. Cualquier ficha técnica que encuentres citando la resolución de FLUX 3 Image, sus límites de imágenes de referencia o su coste por imagen es extrapolación, no documentación.

El modelo de imagen es la pieza que falta

Las propias palabras de BFL son que FLUX 3 Image tendrá "una fase de acceso anticipado en las próximas semanas". Ese es todo el compromiso público. Sin fecha, sin especificaciones, sin benchmark.

Esto importa más que un despliegue escalonado normal, porque la generación de imágenes es lo que significa la marca FLUX. FLUX.1 y su línea de edición Kontext se convirtieron en el estándar de facto de los pipelines de pesos abiertos. Anunciar una generación insignia sin ese componente disponible — mientras los competidores lanzan modelos de imagen cada semana — deja a los creadores con afirmaciones que no pueden comprobar.

La consecuencia práctica: hoy no puedes evaluar FLUX 3 para trabajo de imagen, y nadie más puede hacerlo. Las afirmaciones que circulan sobre su renderizado de texto, su consistencia de personajes o su adherencia al prompt no tienen ninguna evaluación independiente detrás. Trátalas como marketing hasta que el modelo se pueda probar.

FLUX 3 Video: 20 segundos con audio nativo

El componente que sí se ha lanzado — a los solicitantes aprobados en acceso anticipado — es el genuinamente interesante. FLUX 3 Video genera clips de hasta 20 segundos con audio sincronizado de forma nativa, en lugar de generar vídeo mudo y sonorizarlo después. También cubre imagen a vídeo, keyframe a vídeo y encadenado de varios planos.

Veinte segundos con sonido nativo es una duración significativa. La mayoría de modelos de vídeo insignia siguen ajustados a clips de 5 a 10 segundos, y coserlos hasta obtener algo coherente es donde se va buena parte del tiempo de producción. Si FLUX 3 mantiene la continuidad de personaje y de audio a lo largo de 20 segundos, eso sí es un cambio real de flujo de trabajo.

También te dice cuál cree BFL que es el mercado en crecimiento. Una casa de imagen fija que construye imagen a vídeo y encadenado de planos es una empresa que intenta apropiarse de todo el pipeline, no solo del primer fotograma.

Cómo leer con honestidad la tabla de benchmarks de BFL

BFL publicó tasas de preferencia de FLUX 3 Video frente a ocho competidores. Antes de leerlas, fíjate en los cuatro matices que el propio BFL añade: las cifras son autoinformadas, preliminares, medidas durante el entrenamiento intermedio, sobre clips de 10 segundos a 720p. No hay verificación independiente.

Gráfico de barras con las tasas de preferencia de FLUX 3 Video frente a ocho modelos competidores, con los cinco modelos disponibles en OmniArt destacados
Gráfico de barras con las tasas de preferencia de FLUX 3 Video frente a ocho modelos competidores, con los cinco modelos disponibles en OmniArt destacados

Destacan dos cosas.

Las victorias son frente a los modelos más alejados de la frontera. El 93% es frente a Luma Ray 3.2 y el 77% frente a Runway Gen-4.5. Son los márgenes más amplios del gráfico, y también las dos comparaciones donde el listón está más bajo.

Frente a la frontera actual, es un empate. FLUX 3 fue preferido en el 52% de las comparaciones frente a Seedance 2.0 y en el 52% frente a Gemini Omni Flash. En una prueba de preferencia, un 52% es lanzar una moneda al aire. Hay que reconocerle a BFL que lo publique con honestidad en lugar de eliminar discretamente esas filas — pero un cara o cruz frente a modelos con los que ya puedes generar hoy no es motivo para esperar a una lista de espera.

Cinco de los ocho modelos de ese gráfico están ahora mismo en el selector de vídeo de OmniArt: Grok Imagine, Kling, Happy Horse, Seedance 2.0 y Gemini Omni Flash. Puedes ejecutar esta misma tarde el briefing con el que BFL hizo el benchmark y juzgar tú mismo la línea base.

Nota

Los clips de abajo son resultados de Seedance generados en OmniArt — el modelo frente al que FLUX 3 obtuvo un 52%. Están aquí para mostrar la línea base que puedes producir hoy, no para representar el output de FLUX 3. No existen muestras públicas de FLUX 3 que podamos verificar de forma independiente.

Seedance en OmniArt: la escala hace el trabajo emocional — una figura diminuta frente a una señal inmensa. Este es el nivel frente al que FLUX 3 Video declara una tasa de preferencia del 52%.
Una relación sin diálogo sostenida por la luz del fuego, el vapor y un niño dormido — atmósfera y gesto en lugar de exposición.

Self-Flow: la afirmación arquitectónica que merece seguimiento

La idea técnica detrás de FLUX 3 se llama Self-Flow: flow matching autosupervisado con condicionamiento de timestep por token, publicado como investigación junto al lanzamiento. La afirmación es una convergencia más rápida que los enfoques previos de alineación de representaciones, y una única arquitectura subyacente en la que el entrenamiento de imagen, vídeo, audio y acción se restringe mutuamente.

Si eso se sostiene, la consecuencia interesante no es un mejor modelo de imagen. Es que las mejoras en una modalidad deberían elevar a las demás, porque comparten la representación en lugar de vivir en torres separadas. Es la misma apuesta que hizo Google con la línea omni de Gemini, llegando desde la dirección opuesta — Google vino del lenguaje, BFL viene de los píxeles.

Es una apuesta que merece seguimiento. Todavía no es un resultado que puedas usar.

El baño de realidad de FLUX.2

Como FLUX 3 Image no existe públicamente, el modelo de imagen FLUX más nuevo que se puede usar sigue siendo FLUX.2, que se lanzó en noviembre de 2025 y se amplió con un nivel max en diciembre y una línea compacta klein en enero de 2026.

VarianteDisponibilidadPrecio de listaNotas
FLUX.2 [max]API0,07 $ / MPNivel superior; añade generación fundamentada con recuperación web en vivo
FLUX.2 [pro]API0,03 $ / MPLa opción por defecto más rentable para generar y editar
FLUX.2 [flex]API0,06 $ / MPExpone los pasos y la guía; ajustado para tipografía
FLUX.2 [dev] 32BPesos abiertosAutoalojadoLicencia no comercial; el uso comercial es un nivel de pago
FLUX.2 [klein] 4BPesos abiertosAutoalojadoApache 2.0 — la única variante con licencia permisiva

Dónde sigue ganando FLUX.2

  • Consistencia con múltiples referencias. Ocho imágenes de referencia a través de la API, diez en el playground. Fija una cara, un producto, un esquema de iluminación y genera una serie coherente. Sigue siendo su ventaja estructural más clara.
  • Color exacto de marca. Los valores hexadecimales asociados a un objeto con nombre son una función documentada y de primer nivel. Vincula el valor al objeto — "el coche es #FF0000" — en lugar de dejarlo flotando en el prompt.
  • Fotorrealismo de materiales. Dispersión subsuperficial en la piel, comportamiento especular en el cristal y el metal, cómo la tela absorbe frente a cómo refleja.
  • Generación fundamentada en [max]. Recuperación web en vivo durante la generación, para productos actuales y eventos recientes. Nada más en su nivel hace esto.

Dónde se ha quedado atrás

El panorama de preferencia a ciegas es menos halagador. En la arena de texto a imagen de Artificial Analysis, FLUX.2 [max] se sitúa actualmente en torno al puesto 16, por detrás de GPT Image 2, la familia Nano Banana 2 y Seedream 5.0 Pro. FLUX.2 [dev] — el buque insignia abierto de 32B — queda por debajo de Qwen Image 2.0 Pro, un modelo de 7B con licencia Apache 2.0.

Otras fricciones que conviene conocer antes de comprometer un pipeline con él:

  • Sin prompts negativos. Reescribe todo en positivo. "Enfoque nítido en toda la imagen" en lugar de "sin desenfoque".
  • Límites de licencia. Los pesos de 32B [dev] son no comerciales. Solo la variante klein de 4B es Apache 2.0.
  • Coste de hardware. El [dev] a precisión completa más su codificador de texto Mistral de 24B se sale con creces de la VRAM de consumo; la comunidad ejecuta builds cuantizadas con pérdida de calidad.
  • Quejas de anatomía. Las manos y la interacción entre varias personas son fallos recurrentes en los hilos de la comunidad, sobre todo en las variantes klein destiladas con su bajo número de pasos por defecto.

Patrones de prompt que se pueden reutilizar

La guía de prompting que BFL publicó para FLUX.2 es buen consejo de oficio y se transfiere a la mayoría de modelos de imagen modernos, incluidos los de OmniArt.

Estructura como Sujeto + Acción + Estilo + Contexto. El orden de las palabras pesa; empieza por lo que más importa. De treinta a ochenta palabras es el punto óptimo documentado.

Entrecomilla el texto literal. The text 'OPEN' appears in red neon letters — y después especifica colocación, grosor y color.

Describe las tipografías, no las nombres. "Sans-serif geométrica en negrita con el interletraje ligeramente ampliado" funciona mucho más fiablemente que nombrar una fuente concreta.

Asigna un rol a cada imagen de referencia. Di qué entrada aporta el sujeto, cuál aporta el estilo y cuál aporta el fondo.

Usa JSON cuando necesites versionar un briefing. Congela la estructura, cambia exactamente una clave por variante y obtendrás una comparación controlada en lugar de una tirada nueva al azar:

{
  "scene": "Studio product photography on polished concrete",
  "subjects": [{ "description": "Matte black ceramic mug, steam rising", "position": "center foreground" }],
  "style": "Ultra-realistic commercial product photography",
  "color_palette": ["matte black", "concrete gray", "soft white highlights"],
  "lighting": "Three-point softbox, soft diffused highlights, no harsh shadows",
  "camera": { "angle": "high", "lens-mm": 85, "f-number": "f/5.6" }
}

Consejo

El hábito de mayor valor de la guía de BFL es la reescritura en positivo. En lugar de "los faros no sobre el sujeto", escribe "los faros apuntando carretera abajo, iluminando el asfalto mojado por delante, dejando la figura en suave silueta". Funciona en todos los modelos, no solo en FLUX.

Qué hacer esta semana

Si estabas esperando a FLUX 3 para arrancar un proyecto, el consejo honesto es que no esperes. El modelo de imagen no tiene fecha, y el de vídeo está restringido tras una solicitud sin precios publicados.

Si querías FLUX 3 para…Haz esto hoy
Fotos fijas fotorrealistas y trabajo de productoGPT Image 2 o Seedream 5.0 Pro en el selector de imagen de OmniArt
Consistencia de personaje con múltiples referenciasSeedream 5.0 Pro, que acepta hasta 10 imágenes de referencia
Composiciones y pósteres con mucho textoGPT Image 2 — el líder actual en texto dentro de la imagen
Clips largos con sonido sincronizadoSeedance 2.0 o Gemini Omni Flash, ambos disponibles ya
Una imagen que ya te gusta, convertida en movimientoCualquier modelo de imagen a vídeo de OmniArt

La última fila es la que más se infravalora. El pipeline que BFL intenta apropiarse — generar una imagen fija y luego animarla — ya funciona de extremo a extremo en un solo espacio de trabajo. Nuestra guía de modelos de imagen a vídeo explica qué modelo elegir para cada tipo de movimiento, y la guía de prompts de Seedance explica cómo dirigir un plano en lugar de limitarse a describirlo.

Descrito

Dirigido

Mismo concepto, dos prompts. Dirigir el plano — el tono, la intención de cámara y de qué va la escena — supera a enumerar su contenido. Esa habilidad se transfiere al modelo que acabe ganando.

Qué vigilar a continuación

Tres señales te dirán si merece la pena volver a mirar FLUX 3.

  1. La apertura del acceso anticipado de FLUX 3 Image, con especificaciones. El número de imágenes de referencia, la resolución nativa y el precio son las cifras que determinan si compite.
  2. Benchmarks independientes de FLUX 3 Video. Las pruebas de preferencia del proveedor medidas durante el entrenamiento intermedio son un punto de partida, no un resultado. La posición en la arena frente a Seedance y la línea omni de Gemini es la prueba real.
  3. La licencia de pesos abiertos. FLUX.2 [dev] era no comercial, y esa única decisión le costó a BFL buena parte de su posición en el código abierto. Que FLUX 3 Dev lo repita o no decidirá si el ecosistema local vuelve.

Cómo empezar en OmniArt

No necesitas tomar partido en el despliegue de FLUX 3 para crear algo esta semana. OmniArt mantiene la generación de imagen, vídeo, audio y música en un solo espacio de trabajo, con los modelos insignia actuales — GPT Image 2, Nano Banana, Seedream, Seedance, Kling, Veo, Grok Imagine y Gemini Omni Flash — tras un único selector y un único saldo de créditos.

Esa es la respuesta práctica a un lanzamiento restringido: evalúas los modelos frente a tu propio briefing en lugar de frente al gráfico de un proveedor, y cambias cuando llega algo genuinamente mejor. Cuando FLUX 3 Image se pueda probar, lo pasaremos por los mismos briefings y publicaremos la comparación. Hasta entonces, consulta todos los modelos de vídeo en un solo espacio de trabajo para ver lo que hay disponible hoy.

¿Listo para crear?

Empieza a generar contenido increíble con IA

Empezar gratis