there's a second mode (bottom right): tokens read directly from inside llama's weights via control vectors, aka no text generated, just the preference itself. beautiful: moon, beneath, like, 息, bath…
Este tweet describe una nueva modalidad en modelos de lenguaje como LLaMA, utilizando vectores de control para leer tokens directamente de los pesos del modelo. Esta técnica podría revolucionar cómo se generan y manipulan preferencias en modelos de IA, ofreciendo nuevas posibilidades para la investigación y desarrollo en inteligencia artificial.