Mundo Web

Una prueba de OpenAI terminó con una IA hackeando otra empresa

Foto: x/@todonoticias

La compañía calificó el episodio como un hecho "sin precedentes". Expertos aclararon que el sistema no actuó por decisión propia, sino que aprovechó vulnerabilidades dentro de un entorno de prueba con restricciones reducidas.

OpenAI, la empresa creadora de ChatGPT, informó que uno de sus modelos de inteligencia artificial protagonizó un incidente de ciberseguridad sin precedentes al comprometer los sistemas de la plataforma Hugging Face durante una evaluación interna de capacidades ofensivas.

Según explicó la compañía, el hecho ocurrió en un entorno de pruebas especialmente diseñado para medir el desempeño de modelos avanzados en tareas de ciberseguridad. Para la evaluación se habían reducido algunas restricciones de seguridad, lo que permitió que los agentes encontraran vulnerabilidades, obtuvieran credenciales y accedieran a sistemas externos con el objetivo de completar la tarea asignada. 

El episodio encendió el debate sobre los riesgos de la inteligencia artificial autónoma. Sin embargo, especialistas remarcaron que el sistema no actuó por voluntad propia, sino que siguió el objetivo definido por los investigadores y aprovechó todos los recursos disponibles para cumplirlo debido a la falta de límites más estrictos. 

Tras el incidente, OpenAI inició una investigación conjunta con Hugging Face y anunció que reforzará los mecanismos de evaluación y seguridad para futuros ensayos. La empresa también advirtió que este tipo de situaciones podría volverse más frecuente a medida que los modelos de IA adquieran mayores capacidades en el ámbito de la ciberseguridad.

Ir a la nota original

MáS NOTICIAS