Se ha lanzado un nuevo desafío en GitHub para la optimización de modelos de inteligencia artificial, específicamente el fine-tuning de LoRA en el modelo Qwen2.5-1.5B, con el objetivo de alcanzar al menos un 57% de precisión en el conjunto de datos GSM8K. Este evento, conocido como 'LoRA Speedrun', permite a los participantes competir en un entorno controlado utilizando hardware específico, en este caso, una GPU L40S. El récord actual es de 6 minutos y 5 segundos, establecido por el usuario @Saivineeth147, quien utilizó técnicas avanzadas de empaquetado de secuencias y enmascaramiento de pérdidas para mejorar la precisión y velocidad del entrenamiento.
github.com
Tecnologa
Desafío 'LoRA Speedrun': Optimiza Qwen2.5-1.5B y supera el récord de precisión en 6 minutos