FLUX.1 Kontext Pro no es la página que conviene abrir cuando tu trabajo consiste sobre todo en “dame una imagen totalmente nueva desde texto y no me importa cómo se haga la edición”. Resulta mucho más útil en otro escenario: ya tienes una imagen, un borrador, un cartel, una foto de producto o una referencia de personaje y quieres cambiar una parte concreta sin tirar el resto de la escena. En la documentación oficial de Black Forest Labs, FLUX.1 Kontext [pro] se describe como un modelo previous-generation que combina text-to-image con image editing.
Esa formulación importa porque coloca el modelo en el lugar correcto. Kontext Pro no es simplemente otro generador de imágenes genérico con un nombre nuevo. Es un modelo edit-first que además puede generar desde texto. En la documentación oficial se destacan local image editing, character consistency, text editing y style transformation como sus fortalezas centrales. Si tu trabajo real consiste en cambiar el color de un producto, reescribir texto dentro de un póster, mantener el mismo personaje a través de varias ediciones o reestilizar una imagen sin romper la composición, Kontext Pro tiene mucho más sentido que una página que solo promete text-to-image rápido.
También hay una advertencia honesta que no conviene esconder. A fecha de 18 de abril de 2026, la documentación oficial de Black Forest Labs recomienda explícitamente FLUX.2 para nuevos proyectos de generación y edición de imágenes. Eso no vuelve inútil a Kontext Pro. Sí significa que esta página debe ayudar a decidir cuándo Kontext Pro sigue siendo una elección inteligente y cuándo conviene pasar directamente a una ruta más nueva.
Empieza con FLUX.1 Kontext Pro cuando el trabajo real sea edición de imágenes guiada por prompt: recolor de producto, cambios de texto en carteles, swaps de fondo, actualizaciones iterativas de personajes y cambios de estilo donde la mayor parte de la imagen debe seguir siendo reconocible.
Las fuentes primarias clave detrás de esta página son la overview oficial de Kontext, la documentación oficial de image editing, la documentación oficial de text-to-image y la guía oficial de prompting para image-to-image.
La forma más rápida de entender Kontext Pro es dejar de verlo como “un mejor generador de imágenes” y empezar a verlo como un modelo para revisión de imagen dirigida por prompt. La documentación oficial de edición explica que puedes editar imágenes con instrucciones de texto simples, sin workflows complejos ni fine-tuning. Ese es el valor central aquí: indicas qué debe cambiar y la meta es que el resto de la imagen permanezca lo bastante estable como para que la edición se sienta deliberada, no destructiva.
En la práctica, eso vuelve a Kontext Pro especialmente útil para assets de marketing, imágenes de producto, creatividades para social y visuales editoriales que necesitan cambios selectivos en lugar de un reroll completo. También es especialmente práctico para reemplazar texto dentro de imágenes, porque Black Forest Labs documenta un quoted-text workflow directo para cambiar palabras en señales, pósteres y etiquetas manteniendo el contexto y el estilo alrededor.
Edición local sin workflow mask-first
La documentación oficial posiciona a Kontext Pro como un editor de imágenes guiado por prompts simples, algo que facilita mucho las rondas rápidas de revisión para equipos no técnicos.
Consistencia de personaje entre turnos
La guía de prompting muestra explícitamente ediciones multi-step que mantienen a la misma persona consistente al cambiar entorno, estilo y objetos.
Reemplazo directo de texto dentro de imágenes
Black Forest Labs documenta un patrón claro con comillas para sustituir texto sin perder styling ni layout alrededor.
Modelo unificado para generar y editar
La overview oficial presenta a Kontext Pro como un único modelo capaz de crear imágenes desde texto y editar una imagen existente dentro de la misma familia.
Una página SEO fuerte se vuelve más útil cuando acepta ser más precisa y no más inflada. El source anterior intentaba decir demasiado: benchmarks sin respaldo, promesas enterprise y comparaciones vagas. Los documentos oficiales de Black Forest Labs ya aportan suficiente detalle verificado para construir una página sólida sin inventar nada.
| Área | Confirmado oficialmente | Qué significa para el usuario |
|---|---|---|
| Estado del modelo | Los docs oficiales describen FLUX.1 Kontext [pro] como un modelo previous-generation y recomiendan FLUX.2 para nuevos proyectos de generación y edición de imágenes | Kontext Pro sigue teniendo sentido, pero las integraciones nuevas deberían compararlo con una ruta más reciente de Black Forest Labs antes de comprometerse. |
| Capacidades principales | Text-to-image, image editing, character consistency, text editing y style transformation | No es solo un generador. Es un modelo unificado de generación y edición con una identidad claramente edit-first. |
| Posicionamiento dentro de la familia | La overview sitúa a Kontext Pro como la opción fast production-ready con unified editing and generation, great prompt following, tiempo de generación de 5-6 segundos y $0.04 por imagen | Pro es el punto de equilibrio de la familia Kontext, no la capa de mayor calidad ni la versión research con open weights. |
| Base del editing API | El endpoint de edición /flux-kontext-pro requiere tanto un prompt de texto como un input_image |
Si tu workflow parte de una imagen existente, Kontext Pro encaja de manera natural en ese edit loop. |
| Límites del image editing | La imagen de entrada admite hasta 20MB o 20 megapíxeles; la edición intenta mantener las dimensiones del input redondeadas a múltiplos de 32; el rango de aspect ratio va de 3:7 a 7:3 | Está pensado para mantenerse cerca de las dimensiones del original y no para empujar cada edición a un canvas fijo genérico. |
| Default de text-to-image | Los docs de text-to-image dicen que FLUX.1 Kontext crea 1024x1024 por defecto y usa 1:1 si no se especifica aspect ratio |
Cuando generas desde cero, Kontext Pro se comporta como un modelo de aproximadamente 1MP salvo que guíes el formato. |
| Output y recuperación | El output puede ser jpeg o png; las URLs firmadas del resultado son válidas durante 10 minutos |
Operativamente esto importa mucho para pipelines que hacen polling y necesitan recuperar el asset enseguida. |
| Límite de prompt | La guía oficial de image-to-image indica un máximo de 512 tokens | Es otra razón para escribir instrucciones de edición precisas en vez de párrafos largos y desordenados. |
El error fácil sería leer “BFL recomienda FLUX.2 para proyectos nuevos” y asumir que Kontext Pro ya no vale la pena. Eso simplifica demasiado. Kontext Pro puede seguir siendo una opción fuerte cuando el usuario necesita un modelo edit-first rápido y production-friendly, y las tareas encajan con las fortalezas documentadas oficialmente: modificaciones locales, quoted text replacement, style restyling e iteraciones que conservan el personaje.
Es especialmente útil para equipos que trabajan mediante rondas de revisión y no con un one-shot final render. Los equipos de marketing, producto y contenido muchas veces no necesitan una nueva obra maestra desde cero en cada iteración. Necesitan una ruta rápida para cambiar una palabra, un fondo, una variante de color, un objeto o un contexto mientras el resto sigue siendo reconocible. Y ahí Kontext Pro sigue siendo una respuesta muy práctica.
| Ruta | Posicionamiento oficial | Mejor encaje |
|---|---|---|
| FLUX.1 Kontext Pro | Fast production-ready; unified editing and generation; 5-6 segundos; $0.04 por imagen | Workflows de edición guiada por prompt donde la velocidad y la revisión repetible importan más que la calidad tope absoluta. |
| FLUX.1 Kontext Max | Best output quality; industry-leading typography; maximum prompt adherence; premium consistency; $0.08 por imagen | Trabajos de alto impacto donde typography, premium consistency y output de máximo nivel pesan más que la eficiencia de coste. |
| FLUX.2 | Black Forest Labs lo recomienda para nuevos proyectos de image generation y editing; superior quality; multi-reference support de hasta 10 imágenes; improved text editing; output hasta 4MP | Proyectos nuevos que prefieren la ruta actual recomendada por BFL en lugar de una opción previous-generation. |
La guía oficial de prompting para Kontext es más útil que muchos artículos genéricos sobre prompts porque se centra en aquello que debe seguir estable. Si necesitas character consistency a través de varios turnos, Black Forest Labs propone una estructura simple: establecer la referencia con claridad, especificar la transformación y después indicar explícitamente los identity markers que deben mantenerse. Incluso señala un error habitual: decir “her” en lugar de nombrar claramente a la persona.
Esa recomendación se traslada muy bien al trabajo real. Kontext Pro responde mejor cuando el prompt suena a instrucción de edición y no a poema. Nombra el objeto. Nombra el cambio. Nombra lo que debe quedarse igual. Si la transformación es grande, los propios docs recomiendan hacerla paso a paso en lugar de intentar un salto dramático en un solo turn.
Úsalo para cambios locales de objeto: cambiar un producto o prop sin reconstruir toda la escena.
Prompt: Change the bottle cap from matte black to brushed silver while keeping the same product shape, label layout, lighting, and background.
Úsalo para character consistency: conservar la identidad a través de varios turnos.
Prompt: Place the woman with short black hair in a rainy Tokyo street at night while maintaining the same facial features, hairstyle, eye shape, and expression.
Úsalo para reemplazo de texto: seguir la estructura de comillas recomendada oficialmente.
Prompt: Replace 'SUMMER SALE' with 'FLUX DROP' while maintaining the same font style, color, and placement.
Úsalo para restyles grandes: mejor paso a paso que todo de una vez.
Prompt: Transform the portrait into a claymation style while preserving the same person, then use that output as the base for the next scene change.
Los docs oficiales de editing y la guía de prompting son inusualmente concretos en dos workflows de mucho valor. Primero, text editing: BFL recomienda explícitamente usar comillas alrededor del texto que quieres cambiar, con la estructura Replace '[original text]' with '[new text]'. También señala que la edición de texto funciona mejor cuando las fuentes son claras y legibles, y cuando la longitud del nuevo texto sigue siendo razonablemente parecida a la del original.
Segundo, annotation boxes: los docs oficiales explican que se pueden usar cajas de colores brillantes como pistas visuales para targeted local editing, especialmente cuando los cambios de texto requieren reposicionamiento o redimensionado. Kontext Pro reconoce automáticamente esas boxes como parte de la input_image y las elimina en el output. Para banners, posters, packaging y ad layouts es un detalle muy práctico.
| Tarea | Best practice oficial | Por qué importa |
|---|---|---|
| Reemplazo de texto | Usar comillas: Replace 'old text' with 'new text' |
Le da al modelo una instrucción limpia de edición en lugar de una petición vaga sobre tipografía. |
| Preservar tipografía | Especificar preservación cuando haga falta, por ejemplo: keep the same font style and color | Sin esa precisión, el cambio puede resolver el wording pero desviarse en el styling. |
| Estabilidad del layout | Mantener una longitud similar del texto de reemplazo cuando sea posible | Los cambios grandes de longitud suelen romper spacing y placement. |
| Ediciones locales dirigidas | Usar bright colored annotation boxes como referencia | Esto ayuda especialmente cuando hay que mover o redimensionar texto dentro de layouts cargados. |
Ninguna página útil debería fingir que Kontext Pro es la respuesta universal. Black Forest Labs ya deja claro que FLUX.2 es la recomendación actual para proyectos nuevos. Por eso es más útil explicar con honestidad con qué conviene comparar Kontext Pro cuando ya no parece el fit más limpio para la tarea real del usuario.
Quédate con Kontext Pro
cuando el workflow real sea revisión iterativa de imagen y necesites ediciones rápidas guiadas por prompt sobre una imagen o referencia existente.
Compáralo con Kontext Max
cuando premium consistency, una typography más fuerte y máxima prompt adherence importen más que el equilibrio velocidad-coste de Pro.
Compáralo con FLUX.2
cuando estés iniciando hoy una integración nueva con Black Forest Labs y quieras ir por la ruta current-generation recomendada oficialmente.
Compáralo con Imagen 4 Fast
cuando el trabajo sea principalmente generar imágenes nuevas y encontrar direcciones rápido, no editar una imagen base.
Compáralo con Ideogram
cuando lo decisivo sea readable poster text, label design o tipografía muy dependiente del layout.
Usa el image model hub
cuando todavía estés decidiendo entre workflows edit-first, text-first y generation-first.
Los API docs oficiales incluyen varios detalles prácticos que se pierden fácilmente si solo lees la página de marketing. Para image editing, Kontext Pro espera tanto un text prompt como una input image. Para text-to-image, el modelo usa 1024x1024 por defecto salvo que se defina aspect ratio. Para editing, en cambio, intenta mantenerse cerca de las dimensiones del input y redondearlas a múltiplos de 32 salvo que lo sobrescribas con aspect_ratio.
Los docs también mencionan un polling flow para recuperar el resultado y el hecho de que la signed output URL solo dura 10 minutos. No es la parte más glamourosa de la página, pero sí muy importante para la fiabilidad en producción. Si estás diseñando una herramienta interna o una automatización alrededor de Kontext Pro, estos pequeños detalles operativos importan casi tanto como la calidad de la imagen.
input_image: este es un edit-first API path, no un simple endpoint de prompt-only.3:7 portrait a 7:3 landscape.Una buena página edit-first debería terminar en criterio humano, no en confianza ciega. Kontext Pro puede preservar bastante, pero la responsabilidad final sigue en la persona que revisa el resultado. Revisa la tipografía. Revisa si la identidad del sujeto realmente se mantuvo. Revisa si la región cambiada encaja limpiamente con las zonas intactas. Y revisa si el prompt resolvió el problema real del negocio en lugar de producir algo simplemente distinto.
Esta página está basada en documentación primaria de Black Forest Labs: la overview oficial de Kontext, la documentación oficial de image editing, la documentación oficial de text-to-image y la guía oficial de prompting para image-to-image. Eliminé claims de benchmark sin respaldo, exceso de plataformas de terceros, consejos especulativos sobre hardware y pricing, y comparaciones que en el texto anterior se presentaban como hechos sin base primaria suficiente.
Según Black Forest Labs, FLUX.1 Kontext [pro] es un modelo previous-generation que combina text-to-image generation con image editing.
Puede hacer ambas cosas, pero la razón práctica más fuerte para elegirlo es la edición de imágenes guiada por prompt con preservación de contexto, no la generación genérica desde cero.
La overview oficial enumera text-to-image, image editing, character consistency, text editing y style transformation.
La documentación oficial recomienda FLUX.2 para nuevos proyectos de generación y edición de imágenes.
Los docs oficiales recomiendan poner entre comillas el cambio exacto, por ejemplo: Replace 'old text' with 'new text'.
Sí. La guía oficial de prompting presenta la character consistency como una fortaleza clara y recomienda nombrar la referencia de forma precisa mientras se preservan rasgos de identidad como facial features y hairstyle.
Los docs oficiales de edición indican que input_image admite hasta 20MB o 20 megapíxeles.
Los docs oficiales describen outputs de aproximadamente 1MP total, con text-to-image en 1024x1024 por defecto salvo que se especifique aspect ratio.
En la overview oficial, Kontext Pro aparece como la opción fast production-ready con 5-6 segundos de generación y un precio de $0.04 por imagen.
Compáralo con Kontext Max cuando typography de máximo nivel, máxima prompt adherence y premium consistency sean más importantes que el equilibrio velocidad-coste de Pro.