La nueva IA de imágenes de Alibaba puede dibujar una página entera de periódico, con texto diminuto legible incluido
Qwen-Image-3.0 crea diseños densos como infografías y páginas completas de una pasada, con texto legible de diez píxeles. Pero esta vez Alibaba no comparte el modelo abiertamente.
El equipo Qwen de Alibaba ha lanzado Qwen-Image-3.0, un generador de imágenes pensado menos para imágenes bonitas y más para diseños densos y cargados de información: infografías, guiones gráficos, hojas de examen e incluso una página completa de periódico ficticio. Su truco es producir todo eso en una sola pasada, con texto lo bastante pequeño como para poder leerse de verdad.
La característica destacada es el texto. La mayoría de las IA de imagen son famosas por convertir las palabras en disparates, pero Qwen afirma que esta reproduce texto legible de tan solo diez píxeles de alto, maneja fórmulas matemáticas y escribe en doce idiomas. Acepta prompts de hasta 4.500 tokens, aproximadamente unas pocas páginas de instrucciones, lo que le da espacio suficiente para organizar escenas complejas de una vez en lugar de unirlas después. En una demostración colocó nueve infografías independientes en una cuadrícula de 3×3, cada una con su propio texto, diagramas y fórmulas, sobre temas que iban de la seguridad en túneles a la biología celular. Otra mostraba una página completa de un examen de matemáticas ficticio con ecuaciones de varias líneas. Qwen resume el objetivo de esta versión en una palabra: “Real”.
Ahora, la parte importante si sigues el lado de código abierto de la IA. Alibaba construyó parte de su reputación publicando sus modelos como “open-weight”, lo que significa que cualquiera podía descargar el modelo y ejecutarlo gratis. El Qwen-Image original salió así, con una licencia permisiva y un informe técnico que explicaba su funcionamiento. Qwen-Image-3.0 no. Por ahora solo está disponible mediante acceso a API por invitación, sin pesos abiertos, sin pruebas comparativas y sin informe técnico. Es un cambio notable y conviene recordarlo antes de entusiasmarse demasiado: por impresionantes que sean las demostraciones, aún no puedes ejecutarlo tú mismo ni comprobar de forma independiente sus afirmaciones. También hay una duda razonable sobre su utilidad. Una página de periódico o un trabajo de investigación representados como una imagen plana quedan bien, pero no puedes editarlos ni buscarlos como harías con un documento real, así que los mejores usos podrían ser maquetas y borradores visuales, no trabajo terminado.
Qué significa esto para ti: Si haces presentaciones, carteles o gráficos explicativos, herramientas como esta se acercan a convertir en realidad “descríbelo y obtén un diseño utilizable”, texto incluido. Si te importa ejecutar IA en tu propio hardware o comprobar cómo funciona, este lanzamiento es una pequeña decepción y posiblemente una señal de que incluso los laboratorios inclinados a lo abierto protegen más sus mejores modelos. Para la mayoría, no hay nada que instalar hoy, pero sí un adelanto claro de hacia dónde se dirigen las herramientas de imagen.
Fuentes
Hacer trampas con IA es cada vez más fácil y demostrarlo, más difícil
Las trampas en pruebas en línea y evaluaciones de contratación prácticamente se han duplicado a medida que se extienden las herramientas de IA, y los detectores concebidos para descubrirlas son menos fiables de lo que parecen. Qué significa si estudias, contratas o te evalúan.