Lo último en IA, cada díaNoticias IA
← Noticias IA

2 de septiembre de 2026 · Alibaba / CellCog

Qwen3.8-Max-0902 mejora todos sus benchmarks de programación con el mismo precio

Mi opinión: Alibaba lanzó hoy Qwen3.8-Max-0902, una versión mejorada de su modelo más capaz, con ganancias notables en benchmarks de programación y trabajo agéntico. En TerminalBench 3.0 el salto es de 11.3 a 29.0, en DeepSWE 1.1 de 56.6 a 69.3, y en QwenSWEbench V2 de 55.1 a 70.0. El precio no cambia: $2 por millón de tokens de entrada y $6 por millón de salida.

Vale notar que varios de estos benchmarks fueron diseñados por el propio equipo de Alibaba, así que al ser juez y parte, conviene esperar evaluaciones independientes antes de tomar esos números como definitivos. Lo que sí está confirmado sin necesidad de validación externa es el precio: igual que antes, con un modelo que mejora.

Si usas Qwen en tu stack de agentes o en flujos de trabajo de programación, ¿ya tienes un plan para probar este snapshot nuevo contra tu caso de uso real antes de migrar?

Leer en la fuente: Alibaba / CellCog ↗

¿Quieres usar estas herramientas? Mira las reseñas sin filtro o vuelve a las noticias.