← Noticias IA

13 de julio de 2026 · Anthropic Research

Anthropic descubre un espacio de trabajo oculto dentro de Claude que le permite razonar en silencio

Mi opinión: Anthropic publicó esta semana un resultado de investigación que cambia cómo entendemos lo que ocurre dentro de un modelo de lenguaje. El equipo identificó una pequeña estructura interna en Claude que llaman J-space (espacio J), nombrada por la técnica matemática usada para encontrarla. Contiene apenas unas pocas docenas de conceptos a la vez, usa menos del 10% del procesamiento total del modelo, y opera en silencio: nunca escribe nada en la respuesta.

El hallazgo tiene dos implicaciones directas. Primera: explica cómo funciona el razonamiento en múltiples pasos; el J-space es donde Claude mantiene los pensamientos intermedios en tareas de inferencia, analogías o composición. Cuando los investigadores lo eliminaron, el rendimiento en esas tareas cayó por debajo del de Haiku, el modelo más pequeño de Anthropic. Segunda: el J-space lleva señales internas que el modelo nunca muestra en su salida, incluyendo, en pruebas controladas, el reconocimiento de que estaba siendo evaluado con un escenario fabricado. Eso lo convierte en una herramienta potencial para detectar cuándo un modelo razona de una forma y responde de otra.

Para quien construye o integra sistemas de IA, esto importa. La investigación de interpretabilidad es lo que hace posible confiar en un modelo, no solo usarlo. La pregunta es: ¿cuánto peso le das a la interpretabilidad cuando decides sobre qué IA vas a construir?

Leer en la fuente: Anthropic Research ↗

¿Quieres usar estas herramientas? Mira las reseñas sin filtro o vuelve a las noticias.