PhD Student

Nathalie Kirch

Mechanistic interpretability, robustness and trustworthy language models.

Nathalie Kirch studies mechanistic interpretability and robustness in large language models. Her interdisciplinary background includes cognitive psychology, philosophy and artificial intelligence.