© Neuronpedia 2026
    Privacy & TermsBlogGitHubSlackTwitterContact
    Neuronpedia logo - a computer chip with a rounded viewfinder border around it

    Neuronpedia

    Jacobian LensNEW
    Natural Language
    Autoencoders
    NEW
    Assistant AxisNEWCircuit TracerUPDATESteerSAE EvalsExportsinterp-engineNEWAPI Community BlogPrivacy & TermsContact
    1. Home
    2. Qwen3-1.7B
    3. 27-LLAMASCOPE-2-LORSA-16K-K64
    4. 14117
    Prev
    Next
    INDEX
    Explanations

    say reinforcement

    unknown · unknown
    New Auto-Interp
    Top Features by Cosine Similarity
    Embeds
    IFrame
    Link
    Not in Any Lists

    No Comments

    Negative Logits
     dok
    -17.63
    isoft
    -17.50
    储量
    -16.50
    /security
    -15.13
     Spirits
    -14.88
    线上
    -14.88
     livest
    -14.81
     Webcam
    -14.69
    FIELDS
    -14.56
    烟火
    -14.56
    POSITIVE LOGITS
    强化
    22.63
     conditioning
    22.25
     training
    21.75
     reinforcement
    21.50
    Training
    21.50
    奖励
    21.38
     reinforced
    21.13
     reward
    20.88
    培训
    20.88
     reinforcements
    20.38
    Activations Density 0.271%

    No Known Activations