Detalle de la noticia

Ciberseguridad

Hack The Box helps enterprises evaluate AI agents for cybersecurity roles

Fuente: Help Net Security Publicado: 06/10/2026 · 09:45 UTC
Compartir:
Ciberseguridad Hack The Box helps enterprises evaluate AI agents for cybersecurity roles
Imagen: Help Net Security

Hack The Box ha lan­za­do la edi­ción em­pre­sa­rial de su pla­ta­for­ma di­se­ña­da para que los equi­pos de se­gu­ri­dad cor­po­ra­ti­vos prue­ben y midan la efi­ca­cia de los agen­tes de in­te­li­gen­cia ar­ti­fi­cial en fun­cio­nes de ci­ber­se­gu­ri­dad. La he­rra­mien­ta per­mi­te a las or­ga­ni­za­cio­nes eva­luar si sus pro­pios agen­tes son ca­pa­ces de de­sem­pe­ñar los tra­ba­jos asig­na­dos y tomar de­ci­sio­nes fun­da­men­ta­das sobre su in­cor­po­ra­ción a la fuer­za la­bo­ral, con­si­de­ran­do que el ren­di­mien­to de la in­te­li­gen­cia ar­ti­fi­cial puede al­te­rar­se a me­di­da que cam­bian los mo­de­los, el soft­wa­re, los datos y las ame­na­zas.

La es­tra­te­gia de de­sa­rro­llo de la fuer­za la­bo­ral ci­ber­né­ti­ca de la com­pa­ñía com­bi­na las ca­pa­ci­da­des hu­ma­nas y de los agen­tes me­dian­te pro­ce­sos de eva­lua­ción ba­sa­dos en roles. Por un lado, per­mi­te com­pro­bar de forma con­ti­nua si un agen­te cum­ple con los es­tán­da­res re­que­ri­dos para un pues­to es­pe­cí­fi­co. Por otro lado, in­cor­po­ra un sis­te­ma de pun­tua­ción para eva­luar si los pro­fe­sio­na­les de la ci­ber­se­gu­ri­dad po­seen el cri­te­rio ne­ce­sa­rio para su­per­vi­sar, cues­tio­nar e in­ter­ve­nir en el tra­ba­jo rea­li­za­do por la in­te­li­gen­cia ar­ti­fi­cial cuan­do sea ne­ce­sa­rio.

La pla­ta­for­ma re­gis­tra de ma­ne­ra in­de­pen­dien­te cómo los agen­tes ma­ne­jan las ta­reas asig­na­das, mos­tran­do sus acier­tos y di­fi­cul­ta­des para que los lí­de­res de se­gu­ri­dad de­ci­dan en qué áreas se re­quie­re su­per­vi­sión hu­ma­na. Asi­mis­mo, los es­ce­na­rios prác­ti­cos eva­lúan a los ope­ra­do­res hu­ma­nos en si­tua­cio­nes rea­lis­tas donde uti­li­zan la in­te­li­gen­cia ar­ti­fi­cial para in­ves­ti­gar ac­ti­vi­da­des sos­pe­cho­sas, re­vi­sar aler­tas y de­ter­mi­nar el mo­men­to opor­tuno para in­ter­ve­nir o per­mi­tir que los pro­ce­sos au­to­ma­ti­za­dos con­ti­núen.