© Neuronpedia 2026
    Privacy & TermsBlogGitHubSlackTwitterContact
    Neuronpedia logo - a computer chip with a rounded viewfinder border around it

    Neuronpedia

    Jacobian LensNEW
    Natural Language
    Autoencoders
    NEW
    Assistant AxisNEWCircuit TracerUPDATESteerSAE EvalsExportsinterp-engineNEWAPI Community BlogPrivacy & TermsContact
    1. Home
    2. Qwen3-1.7B
    3. 26-LLAMASCOPE-2-LORSA-16K-K64
    4. 1818
    Prev
    Next
    INDEX
    Explanations

    do not say hair

    unknown · unknown
    New Auto-Interp
    Top Features by Cosine Similarity
    Embeds
    IFrame
    Link
    Not in Any Lists

    No Comments

    Negative Logits
     hair
    -43.00
     Hair
    -40.00
    Hair
    -37.00
     hairs
    -36.25
    hair
    -36.00
    lambda
    -35.50
    λ
    -32.25
     λ
    -31.38
     lambda
    -30.25
     волос
    -30.13
    POSITIVE LOGITS
    工程
    22.63
     engineering
    21.63
     Engineering
    20.13
    -engine
    20.13
     Medic
    18.63
    engine
    18.63
    Med
    18.50
    Engineering
    18.50
    药物
    18.25
     Medina
    17.75
    Activations Density 0.054%

    No Known Activations