INDEX
    Explanations
    New Auto-Interp
    Negative Logits
    لا
    -0.08
     stimulant
    -0.08
     antagonist
    -0.08
     ultrasound
    -0.08
     सोन
    -0.08
     taco
    -0.08
    穿
    -0.08
     قطعة
    -0.07
    koop
    -0.07
     suicide
    -0.07
    POSITIVE LOGITS
    0.08
    _campaign
    0.08
    615
    0.08
    0.08
    97
    0.08
    ಂತೆ
    0.07
    上涨
    0.07
    _vec
    0.07
    下降
    0.07
    0.07
    Act Density 0.022%

    No Known Activations