GPT-6 Astra Scores 100% on ExploitBench as OpenAI Blocks PoC Exploit Requests
OpenAI ha presentado oficialmente GPT-6 Astra, catalogado como el modelo más inteligente y alineado del mundo, tras haber alcanzado un umbral de capacidad de ciberseguridad calificado como crítico según su marco de preparación. La herramienta destaca en áreas como el uso de ordenadores, navegación, ingeniería de software y ciencias, logrando puntajes sobresalientes en evaluaciones especializadas como FrontierMath, ARC-AGI-3 y una puntuación máxima en ExploitBench. Su despliegue inicial se dirige a un grupo reducido de organizaciones, con planes de expansión para usuarios de ChatGPT, la API de la compañía y servicios en la nube de terceros.
En la prueba ExploitBench, el sistema demostró la capacidad de transformar fallas de software conocidas en exploits funcionales con una efectividad perfecta, superando a versiones anteriores y registrando mayores tasas de ejecución de código arbitrario al emplear vulnerabilidades divulgadas recientemente. Sin embargo, debido al doble uso de estas tecnologías, la versión actual limita sus funciones a la revisión de código seguro y la corrección de errores, rechazando solicitudes vinculadas a la creación de pruebas de concepto de explotación, aunque se prevé reducir las restricciones de seguridad próximamente.
Para mitigar los riesgos de mal uso, la tecnología incorpora mayor solidez contra intentos de evasión, sistemas de monitoreo contextual y protecciones adicionales para detectar desviaciones en su comportamiento, operando con cautela en entornos delicados. Paralelamente, la organización ha puesto en marcha una iniciativa destinada a ofrecer acceso subvencionado, capacitación y soporte técnico a sectores de infraestructura crítica y entidades con recursos limitados de seguridad.
El artículo original no aporta más detalle sobre especificaciones técnicas adicionales del modelo o los nombres concretos del software afectado por las vulnerabilidades mencionadas.