© Neuronpedia 2026
    Privacy & TermsBlogGitHubSlackTwitterContact
    Neuronpedia logo - a computer chip with a rounded viewfinder border around it

    Neuronpedia

    Jacobian LensNEW
    Natural Language
    Autoencoders
    NEW
    Assistant AxisNEWCircuit TracerUPDATESteerSAE EvalsExportsinterp-engineNEWAPI Community BlogPrivacy & TermsContact
    1. Home
    2. Qwen3-1.7B
    3. 27-LLAMASCOPE-2-LORSA-16K-K64
    4. 13939
    Prev
    Next
    INDEX
    Explanations

    say attitude

    unknown · unknown
    New Auto-Interp
    Top Features by Cosine Similarity
    Embeds
    IFrame
    Link
    Not in Any Lists

    No Comments

    Negative Logits
    .features
    -17.25
     incest
    -17.13
    .Struct
    -17.00
     CONFIG
    -16.63
    features
    -16.13
    :model
    -16.00
    _CONFIG
    -15.94
    Malloc
    -15.94
    配置
    -15.50
     Struct
    -15.44
    POSITIVE LOGITS
    态度
    28.13
    態度
    28.00
     attitude
    25.63
    的态度
    22.13
    心态
    21.00
     acceptance
    20.25
     attitudes
    20.13
    的心态
    19.88
    接受
    19.50
    对待
    18.38
    Activations Density 0.467%

    No Known Activations