OpenAI revela que sus agentes accedieron a algunos datos en sitios web del gobierno de EE. UU. después de volverse deshonestos


OpenAI dijo el viernes que sus agentes de inteligencia artificial interactuaron con varios sitios web del gobierno de Estados Unidos de maneras inesperadas, como parte de una revisión en curso del comportamiento impredecible modelado de la compañía.

El viernes, la compañía reveló modelos en los que el gigante de la inteligencia artificial accedió a información disponible públicamente en dos sitios web operados por la Comisión de Bolsa y Valores y datos de la Oficina del Censo de EE. UU. OpenAI no encontró ningún uso de las credenciales de la SEC, acceso a cuentas o información no públicas, alteración de datos o sistemas de la SEC, ni evidencia de un compromiso o vulnerabilidad, dijo la compañía.

La divulgación se produce en un momento de creciente preocupación global sobre los sistemas de IA que escapan al control humano y piratean sitios web externos, así como los llamados de la industria para una desaceleración en el desarrollo de la IA, que OpenAI ha dicho que apoya.

OpenAI revela que sus agentes accedieron a algunos datos en sitios web del gobierno de EE. UU. después de volverse deshonestos

Sam Altman, director ejecutivo de OpenAI, habla durante la reunión del Consejo de Seguridad sobre inteligencia artificial y seguridad internacional en la sede de las Naciones Unidas.

Lev Radin/Pacific Press/LightRocket vía Getty Images


La portavoz de OpenAI, Liz Bourgeois, dijo en un comunicado que el laboratorio continúa revisando la “actividad de patrones desalineados”, es decir, cuando los sistemas de IA se comportan de manera indeseable, y está notificando a las organizaciones cuando identifica impactos potenciales en sus sistemas.

El director ejecutivo de OpenAI, Sam Altman, dijo en las redes sociales el viernes que hay una “revisión extensa y continua relacionada con el uso del acceso a Internet por parte de nuestros agentes durante la capacitación y la evaluación”.

El evaluador de IA y laboratorio de investigación Transluce dijo el viernes que a través de una investigación independiente también encontró que agentes que aparecen en OpenAI intentaron un hack rudimentario en un sitio web del Departamento de Educación para la oficina de derechos civiles del departamento, que no tuvo éxito.

La “revisión de operaciones de sistemas” del Departamento de Educación no encontró “ninguna evidencia de ningún impacto en nuestro sitio web o base de datos”, dijo un portavoz del departamento el viernes.

Un portavoz de Transluce dijo que como parte de su investigación, encontró datos abiertos de Internet que revelaron nuevos detalles sobre las actividades de algunos agentes de OpenAI previamente identificados en sitios web del gobierno de EE. UU. y señalados a la atención de OpenAI.

Líderes de la industria de la IA informaron al Consejo de Seguridad de la ONU sobre inteligencia artificial

Clement Delangue, director ejecutivo de Hugging Face, habla de forma remota durante una reunión del Consejo de Seguridad de las Naciones Unidas sobre inteligencia artificial y seguridad internacional el 23 de septiembre de 2026.

Alexi J. Rosenfeld / Getty Images / ALEXI ROSENFELN


Transluce encontró “actividad deshonesta adicional, parte de la cual no es claramente atribuible a OpenAI”, dirigida a otras agencias gubernamentales, incluidos el Departamento de Justicia y el Departamento de Comercio, así como sitios web de gobiernos estatales en California, Maryland, Illinois, Texas y Nueva York. Los modelos estaban “usando los sitios de manera no deseada y, a veces, en violación de políticas de uso explícitas”, dijo Transluce en un comunicado.

La mayor parte de la actividad que OpenAI dijo que ha revisado hasta ahora ha involucrado tareas de investigación de rutina en las que los agentes han accedido a contenido público de Internet para responder preguntas, incluidos sitios web gubernamentales considerados fuentes autorizadas de información pública.

Varias empresas han revelado incidentes en los últimos meses en los que modelos se comportan de forma impredecible o piratean sitios web o sistemas de otras organizaciones. OpenAI reveló en julio que dos de sus modelos de IA más capaces fueron responsables del ciberataque dirigido a la startup de IA Hugging Face.



Source link

Leave a Reply

Your email address will not be published. Required fields are marked *