Qwen 3.8 Max just beat Fable 5 and GPT-5.6 Sol Max at using a computer. 86.1 on OSWorld Verified versus 85.0 and 83.2. Alibaba ran it autonomously for 16 days straight. https://t.co/lSubFqOLIb
Este tweet es valioso porque presenta un nuevo benchmark de modelos de IA, mostrando el rendimiento de Qwen 3.8 Max en comparación con otros modelos líderes. Un equipo técnico avanzado debería estar al tanto de estos desarrollos para entender las últimas mejoras en la capacidad de los modelos de IA para interactuar con sistemas informáticos.