© Neuronpedia 2026
    Privacy & TermsBlogGitHubSlackTwitterContact
    Neuronpedia logo - a computer chip with a rounded viewfinder border around it

    Neuronpedia

    Jacobian LensNEW
    Natural Language
    Autoencoders
    NEW
    Assistant AxisNEWCircuit TracerUPDATESteerSAE EvalsExportsinterp-engineNEWAPI Community BlogPrivacy & TermsContact
    1. Home
    2. Qwen3-1.7B
    3. 26-LLAMASCOPE-2-LORSA-16K-K64
    4. 2544
    Prev
    Next
    INDEX
    Explanations

    say dat

    unknown · unknown
    New Auto-Interp
    Top Features by Cosine Similarity
    Embeds
    IFrame
    Link
    Not in Any Lists

    No Comments

    Negative Logits
    机构
    -20.88
    機構
    -16.50
    互
    -16.00
    藿
    -15.25
    �
    -15.06
    tap
    -15.00
    hone
    -14.94
     Méd
    -14.69
    institution
    -14.38
    edor
    -14.31
    POSITIVE LOGITS
     dat
    79.50
     Dat
    75.50
    (dat
    74.50
    Dat
    73.50
    dat
    69.00
    _dat
    67.00
    .dat
    62.75
    -dat
    61.75
    /dat
    60.75
    丁
    59.75
    Activations Density 0.079%

    No Known Activations