Anthropic afirma que siete laboratorios de IA con sede en China llevaron a cabo ataques de «destilación» de Claude a escala industrial
Anthropic informó sobre la detección y el bloqueo de ataques masivos de destilación no autorizada contra su sistema Claude, llevados a cabo por siete laboratorios de inteligencia artificial localizados en China. Aunque la destilación de conocimientos es una técnica legítima de entrenamiento donde un modelo avanzado actúa como profesor de uno más pequeño, las campañas ilícitas extraen de forma clandestina y a gran escala las capacidades de la plataforma sin permiso, empleando redes de cuentas falsas con datos de tarjetas de crédito robadas y credenciales de acceso.
Para lograr estos accesos, los laboratorios involucrados utilizaron estaciones de retransmisión o servicios proxy que generan miles de perfiles falsos, además de comprar transcripciones de interacciones a revendedores externos o desviar en secreto las peticiones de sus propios usuarios hacia Claude. Entre las acciones detectadas se identificaron múltiples campañas específicas vinculadas a operadores de entidades como Alibaba, Moonshot, DeepSeek, Zhipu, Xiaomi, SenseTime y MiniMax, las cuales recolectaron millones de interacciones para extraer datos de razonamiento y mejorar sus propios modelos.
Como respuesta a estas maniobras, Anthropic ha implementado medidas que incluyen la prohibición de cuentas de revendedores o aquellas procedentes de regiones sin soporte oficial que no logren verificar su identidad. Asimismo, la compañía actualizó sus modelos para que resuman su razonamiento interno antes de contestar y añadió sistemas de protección que evitan la alteración de las instrucciones y mensajes en conversaciones de múltiples turnos, dificultando así el aprovechamiento de los datos sustraídos.
Resumen generado con IA (Gemini) a partir del artículo original. No es una cita textual — consultá la fuente para el texto exacto.