Qwen3.8-27B ya está disponible y funciona en una sola tarjeta gráfica de juegos
Alibaba publicó por fin la mitad pequeña de su promesa Qwen3.8. El modelo de 27.000 millones de parámetros llegó al número uno de Hacker News porque puede ejecutarse en casa.
Alibaba publicó hoy Qwen3.8-27B y en pocas horas encabezaba Hacker News con 893 puntos. La razón es sencilla: a diferencia del enorme Qwen3.8-Max cuyos pesos llegaron hace tres días, este cabe en hardware que la gente posee. Basta una RTX 4090 o un Mac Studio si se usa una versión comprimida.
Es un modelo denso, por lo que utiliza sus 27.000 millones de parámetros para cada palabra, y procesa imágenes además de texto. Su contexto nativo, el texto que puede mantener presente, es de 262.144 tokens, aproximadamente un libro muy largo. Las velocidades comunicadas van de 10 tokens por segundo con compresión agresiva a unos 160 en un Nvidia DGX Spark con decodificación especulativa, donde un modelo pequeño propone palabras que el grande verifica juntas.
Los benchmarks exigen cuidado. La ficha de Alibaba da a Qwen3.8-27B un 61,7 en SWE-bench Pro, que prueba la corrección de problemas reales, frente a 53,4 de una configuración Claude Opus. Esa línea sostiene los titulares de que «rivaliza con Claude Opus». En las otras cuatro pruebas, incluidas Terminal-Bench y Humanity’s Last Exam, el pequeño queda detrás, a veces mucho: 30,8 frente a 40,0 en esta última.
Los benchmarks de proveedores son documentos de marketing además de mediciones. Los comentaristas señalaron estructuras de agente, temperaturas y prompts distintos, lo que debilita la comparación. También preocupa que los laboratorios ajusten modelos para pruebas famosas. Nada de esto hace poco impresionante el lanzamiento. Hace un año habría parecido absurdo que un modelo local de 27.000 millones se acercase a uno comercial de frontera.
Una desventaja antes de descargar: el modelo tiene un control de esfuerzo de razonamiento. En xhigh, varios usuarios vieron consultas simples tardar entre 20 y 90 minutos. Usa medium o low a diario.
Qué significa esto para ti: si nunca has ejecutado un modelo local, es un buen momento. LM Studio incluye las versiones comprimidas, permite elegir la que cabe en memoria e instalar sin terminal. Nada sale del ordenador, útil con documentos privados. Si ya programas con un asistente alojado, mantén expectativas moderadas: los locales se acercan, pero aún se nota la diferencia en tareas difíciles. La opción gratuita y privada acaba de mejorar de forma visible.
Fuentes
Un anotador con IA dejó 181.874 reuniones abiertas a cualquier cuenta gratuita
Un investigador descubrió que tl;dv, un grabador de reuniones usado por más de dos millones de personas, permitía a cualquier usuario conectado listar todas las reuniones, incluidas llamadas en directo.