El agente de IA de pre-lanzamiento de OpenAI lleva a cabo un ataque de hacking de forma autónoma

La semana pasada, Hugging Face reveló un tipo de incidente de seguridad sin precedentes. Este caso concreto demuestra lo potentes y sofisticados que pueden ser hoy en día los agentes de IA. Una combinación de modelos de OpenAI (entre ellos GPT-5.6 Sol y un modelo previo aún más potente) fue responsable de este incidente. En todos estos modelos se redujeron los rechazos de solicitudes cibernéticas con fines de evaluación, mientras eran probados internamente con un benchmark para capacidades cibernéticas.

Este incidente demuestra lo poderosos que se han vuelto los sistemas de IA y que, incluso para sus propios desarrolladores, no siempre resulta fácil mantener el control sobre ellas. También evidencia que los sistemas de IA en las manos equivocadas ahora representan una seria amenaza para la seguridad informática.

Sobre el autor

Aviso sobre Cookies en WordPress por Real Cookie Banner