OpenAI reveals ‘novel’ encryption bypass used in distillation attack
La empresa OpenAI informó que logró detener una campaña coordinada orientada a extraer y destilar las capacidades de razonamiento de sus modelos de inteligencia artificial, señalando como responsable a un competidor de origen chino. Según la compañía, las acciones sospechosas comenzaron a detectarse a principios del mes de julio, mostrando un incremento progresivo en el volumen de solicitudes hasta que la organización logró interrumpir por completo la operación al finalizar dicho mes.
La técnica empleada por los atacantes fue calificada como novedosa. El método consistió en copiar información de razonamiento cifrada obtenida en una sesión de chat para posteriormente solicitarle al modelo, en una ventana de conversación diferente, que descifrara dichos datos y los transcribiera en texto plano. La firma aclaró que los atacantes no vulneraron la criptografía ni accedieron directamente a las bases de datos o conversaciones almacenadas, sino que manipularon las interacciones para replicar el razonamiento protegido de manera masiva y coordinada.
El núcleo central de estas actividades se vinculó con personas que operaban en nombre de Moonshot AI, una empresa rival en el sector de la inteligencia artificial. A pesar de la atribución, la publicación institucional no aportó pruebas técnicas al respecto, y se indicó que la misma vulnerabilidad podría estar presente en otros sistemas de inteligencia artificial, por lo que los detalles del caso fueron compartidos con organizaciones especializadas.
Como respuesta al incidente, la empresa responsable procedió a bloquear las cuentas involucradas, fortaleció los controles de registro y su infraestructura, amplió la vigilancia en la red y solucionó la falla técnica que permitía trasladar y descifrar la información protegida entre diferentes conversaciones.