© Neuronpedia 2026
Privacy & Terms
Blog
GitHub
Slack
Twitter
Contact
Neuronpedia
Jacobian Lens
NEW
Natural Language
Autoencoders
NEW
Assistant Axis
NEW
Circuit Tracer
UPDATE
Releases
Jump To
Search
Steer
SAE Evals
Exports
interp-engine
NEW
Guides
API
Community
Blog
Privacy & Terms
Contact
Sign In
Home
Qwen3-1.7B
26-LLAMASCOPE-2-LORSA-16K-K64
1750
Prev
Next
MODEL
26-llamascope-2-lorsa-16k-k64
Source/SAE
INDEX
Go
Explanations
say safety
unknown · unknown
No Scores
New Auto-Interp
AutoInterp Type
claude-4-5-haiku
Generate
Top Features by Cosine Similarity
Embeds
Show Plots
Show Explanation
Show Activations
Show Test Field
Show Steer
Show Link
IFrame
<iframe src="https://www.neuronpedia.org/qwen3-1.7b/26-llamascope-2-lorsa-16k-k64/1750?embed=true&embedexplanation=true&embedplots=true&embedsteer=true&embedactivations=true&embedlink=true&embedtest=true" title="Neuronpedia" style="height: 300px; width: 540px;"></iframe>
Link
https://www.neuronpedia.org/qwen3-1.7b/26-llamascope-2-lorsa-16k-k64/1750?embed=true&embedexplanation=true&embedplots=true&embedsteer=true&embedactivations=true&embedlink=true&embedtest=true
Not in Any Lists
Add to List
▼
No Comments
ADD
Negative Logits
罗马
-34.25
Roman
-33.00
Romans
-31.13
Rome
-31.00
Roman
-28.13
roman
-27.13
roman
-24.75
汉
-23.75
Roma
-23.63
漢
-22.50
POSITIVE LOGITS
safety
16.88
safe
16.25
Safety
15.56
QLD
15.25
在深圳
15.13
翼
15.00
安全
14.81
safely
14.56
KING
14.44
Safety
14.38
Act
ivations
Density 0.110%
Stacked
Snippet
Full
Show Breaks
Hide Breaks
No Known Activations