If you're spending extra tokens making an LLM critique itself, this paper says a simpler move can be better: just let it try again. Before you make an LLM reflect on its answer, try giving it another…
Este estudio proporciona insights valiosos sobre la eficiencia de diferentes métodos de razonamiento en tiempo de prueba para modelos de lenguaje grandes. Al comparar técnicas de reflexión con muestreo repetido, ofrece recomendaciones prácticas para optimizar el uso de tokens en tareas de IA, lo cual es relevante para equipos de investigación y desarrollo en inteligencia artificial.