INDEX
    Explanations
    New Auto-Interp
    Negative Logits
    тур
    -0.07
    ­های
    -0.07
     theories
    -0.07
    коном
    -0.07
     '@
    -0.06
    -direct
    -0.06
    خاص
    -0.06
    _Con
    -0.06
    annotation
    -0.06
    _customer
    -0.06
    POSITIVE LOGITS
     Slav
    0.08
    xCC
    0.07
     slaves
    0.07
     Slayer
    0.07
    ослав
    0.07
     Tv
    0.07
     Sl
    0.06
    0.06
    านคร
    0.06
     sollen
    0.06
    Act Density 0.002%

    No Known Activations