Publications

* denotes equal contribution.

2025

  1. Figure for RelP: Faithful and Efficient Circuit Discovery in Language Models via Relevance Patching

    MechInterp Workshop @ NeurIPS 2025, Spotlight

    RelP: Faithful and Efficient Circuit Discovery in Language Models via Relevance Patching

    F. Rezaei Jafari , O. Eberle , A. Khakzar , N. Nanda

    Circuit/Subgraph-Level Model Analysis; LLMs; Mechanistic Interpretability; Sparse Feature Circuits

  2. Figure for Towards Symbolic XAI – Explanation Through Human Understandable Logical Relationships Between Features

    Information Fusion · 2025

    Towards Symbolic XAI – Explanation Through Human Understandable Logical Relationships Between Features

    T.* Schnake , F.* Rezaei Jafari , J Lederer , P. Xiong , S. Nakajima , S. Gugler , G. Montavon , K-R. Müller

    Compositional Reasoning in LLMs & Vision Transformers; Subgraph-Level Model Analysis; Bridging Mechanistic Interpretability with Symbolic Reasoning; Logical Explanations for Transformers & GNNs

2024

  1. Figure for MambaLRP: Explaining Selective State Space Sequence Models

    NeurIPS · 2024

    MambaLRP: Explaining Selective State Space Sequence Models

    F. Rezaei Jafari , G. Montavon , K-R. Müller , O. Eberle

    State-Space Models; Mamba LLMs; Vision Mamba; Interpretability; Identifying Model Biases; Analyzing Long-Range Dependencies; Introducing a Novel Evaluation Metric for Needle-in-a-Haystack

2022

  1. Figure for Adaptive Token Sampling For Efficient Vision Transformers

    ECCV, Oral · 2022

    Adaptive Token Sampling For Efficient Vision Transformers

    M.* Fayyaz , S.* Abbasi Kouhpayegani , F.* Rezaei Jafari , S. Sengupta , E. Sommerlade , H. Vaezi Joze , H. Pirsiavash , J. Gall

    Test-Time Computation Scaling; Efficient Image/Video Transformers; Parameter-Free Adaptive Token Sampling; Emergent Capabilities in Vision Transformers