Carnet IA / personne

Vérifié le 2026-08-16

Chris Olah

Chercheur chez Anthropic connu pour l'interprétabilité mécaniste et pour des formes de publication visuelle qui rendent les réseaux de neurones plus compréhensibles.

Rôle actuel

Fait vérifié. Chris Olah travaille chez Anthropic sur la rétro-ingénierie et l'interprétabilité des réseaux de neurones. Son parcours public mentionne Google Brain, l'équipe Clarity d'OpenAI et Distill.

Contributions importantes

Il est une figure centrale de l'interprétabilité mécaniste : chercher des circuits, représentations et mécanismes internes plutôt que seulement mesurer les entrées et sorties. Il a aussi contribué à Distill, revue qui associait explication technique et visualisation interactive.

Pourquoi le suivre

Interprétation personnelle. Il montre qu'une explication technique peut être rigoureuse sans être opaque. Son travail aide à comprendre ce que signifie réellement « regarder à l'intérieur » d'un modèle, avec les incertitudes que cela implique.

Ressource de départ

Commencer par ses articles visuels sur les réseaux de neurones, puis la série « Circuits » pour l'interprétabilité mécaniste.

Dans Alfred

Expérimentation Alfred. La carte relationnelle du Carnet reprend cette intuition : montrer les mécanismes et les liens, pas seulement afficher une liste de définitions.

Liens officiels