2 de septiembre de 2026 · Alibaba / CellCog
Qwen3.8-Max-0902 mejora todos sus benchmarks de programación con el mismo precio
Mi opinión: Alibaba lanzó hoy Qwen3.8-Max-0902, una versión mejorada de su modelo más capaz, con ganancias notables en benchmarks de programación y trabajo agéntico. En TerminalBench 3.0 el salto es de 11.3 a 29.0, en DeepSWE 1.1 de 56.6 a 69.3, y en QwenSWEbench V2 de 55.1 a 70.0. El precio no cambia: $2 por millón de tokens de entrada y $6 por millón de salida.
Vale notar que varios de estos benchmarks fueron diseñados por el propio equipo de Alibaba, así que al ser juez y parte, conviene esperar evaluaciones independientes antes de tomar esos números como definitivos. Lo que sí está confirmado sin necesidad de validación externa es el precio: igual que antes, con un modelo que mejora.
Si usas Qwen en tu stack de agentes o en flujos de trabajo de programación, ¿ya tienes un plan para probar este snapshot nuevo contra tu caso de uso real antes de migrar?
¿Quieres usar estas herramientas? Mira las reseñas sin filtro o vuelve a las noticias.