© Neuronpedia 2026
Privacy & Terms
Blog
GitHub
Slack
Twitter
Contact
Neuronpedia
Jacobian Lens
NEW
Natural Language
Autoencoders
NEW
Assistant Axis
NEW
Circuit Tracer
UPDATE
Releases
Jump To
Search
Steer
SAE Evals
Exports
interp-engine
NEW
Guides
API
Community
Blog
Privacy & Terms
Contact
Sign In
Home
Gemma-3-12B-IT
12-GEMMASCOPE-2-RES-16K
5892
Prev
Next
MODEL
12-gemmascope-2-res-16k
Source/SAE
INDEX
Go
Explanations
promotion of respect and safety
np_acts-logits-general · gemini-2.5-flash-lite
No Scores
New Auto-Interp
AutoInterp Type
claude-4-5-haiku
Generate
Interpretable Score
Intrusion Detection
Top Features by Cosine Similarity
Configuration
google/gemma-scope-2-12b-it/resid_post/layer_12_width_16k_l0_medium
How To Load
Prompts (Dashboard)
238,145 prompts, 512 tokens each
Dataset (Dashboard)
lmsys + oasst1
No Configuration Found
Show All
Embeds
Show Plots
Show Explanation
Show Activations
Show Test Field
Show Steer
Show Link
IFrame
<iframe src="https://www.neuronpedia.org/gemma-3-12b-it/12-gemmascope-2-res-16k/5892?embed=true&embedexplanation=true&embedplots=true&embedsteer=true&embedactivations=true&embedlink=true&embedtest=true" title="Neuronpedia" style="height: 300px; width: 540px;"></iframe>
Link
https://www.neuronpedia.org/gemma-3-12b-it/12-gemmascope-2-res-16k/5892?embed=true&embedexplanation=true&embedplots=true&embedsteer=true&embedactivations=true&embedlink=true&embedtest=true
Not in Any Lists
Add to List
▼
No Comments
ADD
Negative Logits
LER
2.48
臾
2.48
poiché
2.31
LOW
2.19
причем
2.16
Ее
2.14
ɱ
1.91
NESS
1.88
NK
1.86
reloc
1.85
POSITIVE LOGITS
ט
2.45
स
2.31
지
2.28
ter
2.14
et
2.13
س
2.13
ch
2.06
en
2.05
었다
1.88
т
1.88
Act
ivations
Density 0.064%
Stacked
Snippet
Full
Show Breaks
Hide Breaks
No Known Activations