© Neuronpedia 2026
    Privacy & TermsBlogGitHubSlackTwitterContact
    Neuronpedia logo - a computer chip with a rounded viewfinder border around it

    Neuronpedia

    Jacobian LensNEW
    Natural Language
    Autoencoders
    NEW
    Assistant AxisNEWCircuit TracerUPDATESteerSAE EvalsExportsinterp-engineNEWAPI Community BlogPrivacy & TermsContact
    1. Home
    2. Qwen3-1.7B
    3. 27-LLAMASCOPE-2-LORSA-16K-K64
    4. 14283
    Prev
    Next
    INDEX
    Explanations

    <THINKING> Method 1: MAX_ACTIVATING_TOKENS show many printing‑related phrases but no single consistent source→target token pattern. Method 2: TOKENS_AFTER_MAX_ACTIVATING_TOKEN are varied, no clear commonality. Method 3: TOP_POSITIVE_LOGITS are dominated by printing‑related tokens (printing, 印刷, print, printer, etc.), indicating the neuron predicts printing terms. Methods 4 and 5 add no clearer pattern. Thus Method 3 provides the clearest explanation. </THINKING> say "printing"

    unknown · unknown
    New Auto-Interp
    Top Features by Cosine Similarity
    Embeds
    IFrame
    Link
    Not in Any Lists

    No Comments

    Negative Logits
    解析
    -18.13
    美丽乡村
    -16.63
    分析
    -16.38
    腮
    -15.94
    角
    -15.50
    parser
    -15.38
    海棠
    -15.38
    ajar
    -15.31
    Parse
    -15.19
    /android
    -15.19
    POSITIVE LOGITS
     printing
    32.75
    印刷
    32.25
    打印
    31.25
     Printing
    31.13
    printing
    29.88
    Printing
    29.50
     print
    28.88
     printer
    28.50
    印
    28.50
    PRINT
    28.13
    Activations Density 0.254%

    No Known Activations