INDEX
    Explanations
    New Auto-Interp
    Negative Logits
    ーロ
    -0.07
     схем
    -0.07
     Kế
    -0.07
     γεν
    -0.07
     yöntem
    -0.07
     แต
    -0.07
     thấy
    -0.06
    šov
    -0.06
     níž
    -0.06
    раста
    -0.06
    POSITIVE LOGITS
    _select
    0.07
    áu
    0.06
    .Top
    0.06
    Feed
    0.06
    Bookmark
    0.06
    .Predicate
    0.06
     iPad
    0.06
     biking
    0.06
    _SEL
    0.06
     Oktober
    0.06
    Act Density 0.001%

    No Known Activations