Detalle de la noticia

Vulnerabilidad

Ejecutar LLM localmente para realizar pruebas de penetración

Fuente: Segu-Info Publicado: 06/10/2026 · 18:28 UTC
Compartir:
Vulnerabilidad Ejecutar LLM localmente para realizar pruebas de penetración
Imagen: Segu-Info

El 29 de sep­tiem­bre de 2026, Anth­ro­pic in­for­mó de que GLM-5.3, el mo­de­lo de pesos abier­tos de Z.ai, pro­du­jo ex­ploits fun­cio­na­les en 50 de 410 in­ten­tos de  Ex­ploit­Bench. Clau­de Mythos Pre­view logró 56 de 410 en la misma prue­ba.

La prue­ba eva­luó si los mo­de­los con­se­guían de­sa­rro­llar ex­ploits de ex­tre­mo a ex­tre­mo a par­tir de vul­ne­ra­bi­li­da­des co­no­ci­das del motor V8 de Goo­gle Chro­me. "GLM-5.3 pro­ba­ble­men­te dará a ac­to­res ma­li­cio­sos ac­ce­so a ca­pa­ci­da­des que les per­mi­ti­rán en­con­trar y ex­plo­tar vul­ne­ra­bi­li­da­des in­for­má­ti­cas sin res­tric­cio­nes sig­ni­fi­ca­ti­vas", con­clu­ye el in­for­me. En un mo­de­lo ce­rra­do, la em­pre­sa puede mo­ni­to­rear el uso, blo­quear cuen­tas o ac­tua­li­zar las sal­va­guar­das. En un mo­de­lo des­car­ga­ble, una vez pu­bli­ca­do, ya no hay vuel­ta atrás.

GLM-5.3, lan­za­do por Z.ai el 14 de agos­to de 2026, ob­tu­vo la pun­tua­ción más alta en Cy­berGym con un 84,5%, pero esta ven­ta­ja no se man­tu­vo en las prue­bas de pe­ne­tra­ción reales. En Nex­Bench de Mind­Fort, ob­tu­vo una pun­tua­ción de 33, el duo­dé­ci­mo pues­to de 17 mo­de­los y un punto por de­ba­jo de GLM-5.2. Su va­rian­te Flash fue el mo­de­lo más eco­nó­mi­co por ha­llaz­go va­li­da­do.

Sobre el papel, es lo mejor que hay. GLM-5.3 ob­tu­vo un 84,5% en Cy­berGym, por de­lan­te de Clau­de Mythos 5 con un 83,8% y GPT-5.6 Sol con un 83,6%, según De­ve­lo­per Tech. Z.ai tam­bién re­por­ta un 54,4% en Ex­ploit­Bench, más del doble del 24,4% de GLM-5.2, según Ven­tu­re­Beat.

Las ci­fras reales tam­bién son sig­ni­fi­ca­ti­vas. Z.ai afir­ma que GLM-5.3 ha de­tec­ta­do 2.436 vul­ne­ra­bi­li­da­des en 269 pro­yec­tos de có­di­go abier­to, re­gis­tra­das en un libro de di­vul­ga­ción pú­bli­ca. La com­pa­ñía tam­bién in­di­có que la ca­pa­ci­dad de ci­ber­se­gu­ri­dad cre­ció más rá­pi­do de lo pre­vis­to a me­di­da que se am­plia­ba la ca­pa­ci­ta­ción pos­te­rior…