INDEX
    Explanations
    New Auto-Interp
    Negative Logits
    3
    -0.11
    7
    -0.10
    177
    -0.08
     Bernard
    -0.08
    27
    -0.07
     Bij
    -0.07
    777
    -0.07
    ран
    -0.07
     Bye
    -0.07
    67
    -0.07
    POSITIVE LOGITS
     October
    0.16
    October
    0.13
     Oct
    0.11
    Oct
    0.10
     Oktober
    0.09
     октября
    0.09
     اکتبر
    0.08
    0.08
     Autumn
    0.07
     Oregon
    0.07
    Act Density 0.015%

    No Known Activations