Alex Open Research Wiki

Tag: mechanistic-interpretability

4 items with this tag.

  • Jul 12, 2026

    Is One Layer Enough? Understanding Inference Dynamics in Tabular Foundation Models

    • tabular-data
    • foundation-models
    • in-context-learning
    • mechanistic-interpretability
    • intermediate-layers
    • recurrent-depth
    • dynamic-compute
  • Jun 26, 2026

    Param Decomp

    • mechanistic-interpretability
    • parameter-decomposition
    • model-editing
    • software
    • weight-space
  • Jun 26, 2026

    Exploration: Fine-Tuning With Parameter Decomposition

    • mechanistic-interpretability
    • parameter-decomposition
    • model-editing
    • lora
    • weight-space
    • llm-post-training
  • May 24, 2026

    Convergent Evolution: How Different Language Models Learn Similar Number Representations

    • number-tokenization
    • fourier-features
    • representation-learning
    • mechanistic-interpretability

Created with Quartz v4.5.2 © 2026