Skip to main content

probing

Probing methods interpret model signals by training an auxiliary predictor (often linear) to decode a labeled property y from an internal vector $z$ (e.g., the residual stream state $x_l$ at layer $l$). Operationally, probing treats the model as a frozen feature extractor and assesses decodability: whether $y$ is recoverable from $z$ by a restricted hypothesis class (commonly linear), which supports localization by comparison across candidate objects (layers/heads/FFNs) via decoding performance or information-theoretic surrogates, typically followed by Causal Attribution to test functional necessity.

Ir para a instalação

Informações da origem

Repositório
zjunlp/Mechanist
Última atividade na origem
11 de julho de 2026 às 04:09
Idioma detectado do SKILL.md
inglês
Estrelas
50
Forks
6

Opções de instalação

Por padrão, está selecionado o prompt que primeiro revisa a origem. Você pode mudar para um comando direto ou baixar uma cópia local.

Revise os arquivos de origem

Leia o SKILL.md e os arquivos complementares exibidos pelo SkillsMP antes de decidir se vai instalar.