Unsloth Studio Flaw Turns Routine Model Inspection Into Code Execution
La empresa Unsloth ha corregido una vulnerabilidad descubierta en su interfaz web Unsloth Studio, la cual permitía que modelos de inteligencia artificial maliciosos ejecutaran código de Python de manera arbitraria durante la fase de revisión. El fallo se activaba simplemente al consultar la configuración de un modelo alojado en un repositorio de Hugging Face, sin que fuera necesario cargar los pesos ni realizar inferencias, bastando la mera revisión para que el código oculto comenzara a operar.
Como el código se ejecutaba aprovechando los permisos del usuario, esta falla exponía a los entornos empresariales de desarrollo de IA a riesgos graves, tales como la filtración de datos de entrenamiento confidenciales, modificaciones en los modelos y la posible sustracción de credenciales como claves SSH o inicios de sesión en la nube. Aunque no se detectaron ataques reales utilizando este mecanismo, el investigador que identificó el problema advirtió que entornos internos de experimentación con acceso privilegiado quedaban expuestos a pesar de no gestionar tráfico de producción.
El problema radicaba en el uso del ajuste de configuración que permitía a la biblioteca subyacente descargar y ejecutar código personalizado citado en los archivos de configuración del modelo antes de que este fuera cargado. Tras ser notificados, los responsables de Unsloth lanzaron una actualización para cerrar el vector de ataque, aunque surgieron discrepancias respecto a la evaluación de seguridad, ya que los mantenedores argumentaban que los análisis de malware de Hugging Face eran suficientes y que la herramienta se encontraba en fase beta.