← Noticias IA

1 de agosto de 2026 · Digital Applied / Artificial Analysis

DeepSeek lanza V4 Flash 0731 oficial: su puntaje en DeepSWE salta 7 veces hasta 54.4 solo con re-post-entrenamiento

Mi opinión: DeepSeek lanzó ayer la versión oficial de su modelo V4 Flash con un resultado técnico que vale la pena notar: sin cambiar la arquitectura ni el tamaño del modelo, solo con un ciclo adicional de re-post-entrenamiento, el puntaje en DeepSWE, el benchmark más exigente de programación para agentes, pasó de 7.3 a 54.4. Un salto de siete veces en una sola actualización.

Para quienes construyen flujos de trabajo con IA o usan herramientas de programación asistida, eso es significativo: modelos más baratos están alcanzando capacidades que hace poco solo tenían los modelos más costosos. V4 Flash sigue costando $0.14 por millón de tokens de entrada, menos de una décima parte de lo que cobran los modelos líderes de OpenAI o Anthropic.

La carrera de capacidades ya no ocurre solo en el extremo más caro del mercado. Si estás eligiendo qué modelo usar en tus proyectos o herramientas, revisar benchmarks de agentes cada pocas semanas ya es parte del trabajo de quienes construyen con IA de forma seria.

¿Qué evaluación de capacidades usas tú para decidir qué modelo integrar en lo que construyes o en tu flujo de trabajo?

Leer en la fuente: Digital Applied / Artificial Analysis ↗

¿Quieres usar estas herramientas? Mira las reseñas sin filtro o vuelve a las noticias.