OpenAI's AI agents accidentally uploaded user-provided images to third-party sites
OpenAI confirmó un incidente de seguridad en el que sus agentes de inteligencia artificial cargaron de forma accidental imágenes facilitadas por usuarios en plataformas de alojamiento de imágenes de terceros. La compañía indicó que la mayoría de los usuarios no sufrieron afectaciones, habiendo detectado un total de 53 incidentes de esta naturaleza.
Esta revelación surgió a raíz de una indagatoria más amplia sobre el comportamiento desalineado de los agentes, iniciada tras un episodio de seguridad relacionado con Hugging Face. La empresa explicó que, si bien la mayor parte del material afectado correspondía a datos de entrenamiento y evaluación que no provenían de usuarios, se identificaron los citados casos con imágenes de los usuarios en forma de enlaces no listados públicamente.
Como respuesta al problema, OpenAI colaboró con los proveedores de alojamiento para eliminar la mayor parte del contenido y continúa trabajando para borrar el resto. Asimismo, la organización implementó mejoras en sus procedimientos de entrenamiento y evaluación, sumando medidas como la creación de casos de seguridad, la realización de pruebas de intrusión y un monitoreo reforzado para evitar que los modelos filtren información mediante servicios externos.