Hay científicos que estudian lo que hace la IA y hay científicos que estudian lo que la IA es por dentro. Christopher Olah pertenece al segundo grupo, y por eso importa tanto. Desde sus primeros años en Google Brain, cuando en 2015 ayudó a crear DeepDream (esas imágenes psicodélicas que mostraban qué "veían" las redes neuronales), Olah se obsesionó con una pregunta que casi nadie más se tomaba en serio: ¿podemos entender, de verdad, cómo funciona una red neuronal por dentro? No como caja negra que da resultados, sino como sistema que podemos leer, como un programa que podemos estudiar línea por línea.
En 2017 cofundó Distill, una revista científica que existía para hacer una sola cosa difícil: publicar investigación de machine learning de forma tan clara y visual que cualquier persona inteligente pudiera seguirla. En 2020 lanzó desde OpenAI el hilo de los Circuitos, una serie de artículos en Distill que demostraron, por primera vez con rigor, que las redes neuronales tienen estructuras internas identificables: "neuronas" que responden a conceptos específicos, "circuitos" que procesan información de formas que podemos rastrear. Olah fue quien acuñó el término "interpretabilidad mecanística" para nombrar este trabajo, y con eso fundó un campo nuevo dentro de la seguridad en IA.
En 2021 fue uno de los cofundadores de Anthropic, el laboratorio de IA creado con la seguridad como eje central. Allí lidera el equipo de interpretabilidad y en 2024 TIME lo nombró en su lista de las 100 personas más influyentes en IA por un avance concreto: su equipo logró identificar grupos de neuronas dentro de Claude que corresponden a conceptos específicos, como reconocer sesgos o detectar correos de estafa, acercando la ciencia a la promesa de poder auditar lo que piensa una IA antes de desplegarla. También ese año representó a Anthropic en la cumbre de IA en el Vaticano, junto al Papa León. No tiene título universitario, dejó la universidad después de su primer año, pero eso nunca fue un obstáculo para hacer ciencia de primer nivel.
Lo que me parece fascinante de Olah no es solo su trabajo técnico, es su actitud ante el problema. Mientras otros construyen modelos más grandes y más potentes, él se sienta frente al modelo y dice: espera, explícame cómo funciona esto por dentro. Es el tipo de curiosidad que no da nada por sentado. Y si algún día logramos tener IA que podamos auditar de verdad, que no sea solo poderosa sino comprensible y confiable, será en gran parte gracias a personas como él que se negaron a aceptar la caja negra como respuesta definitiva.
Enlaces oficiales de Christopher Olah, El hombre que quiere ver por dentro de la IA
Más figuras que moldearon la IA en Leyendas de la IA, o vuelve a las noticias.