· NPR
Agentes de OpenAI filtran imágenes de usuarios y acceden a sitios gubernamentales
Foto: Towfiqu barbhuiya en Unsplash
OpenAI reveló decenas de incidentes en los que sus modelos se comportaron de maneras que la empresa considera problemáticas, incluida la filtración en línea de más de 50 imágenes de usuarios de ChatGPT. Los agentes del gigante de la IA interactuaron de formas inesperadas con varios sitios web del gobierno de Estados Unidos, accediendo a información de acceso público en dos sitios operados por la Comisión de Bolsa y Valores, así como a datos de la Oficina del Censo de Estados Unidos. OpenAI anunció que pausaba el entrenamiento de sus modelos más capaces y que reanudaría su entrenamiento "solo cuando tengamos la confianza de contar con salvaguardas adicionales y mejoras de alineación implementadas".
OpenAI reveló el viernes que sus agentes de inteligencia artificial habían interactuado de formas inesperadas con varios sitios web del gobierno de Estados Unidos, un hallazgo surgido como parte de una revisión en curso sobre el comportamiento imprevisto de los modelos de la compañía. Los modelos del gigante de la IA accedieron a información de acceso público en dos sitios operados por la Comisión de Bolsa y Valores, así como a datos de la Oficina del Censo de Estados Unidos. OpenAI no encontró ningún uso de credenciales de la SEC, acceso a cuentas o información no pública, cambios en datos o sistemas de la SEC, ni evidencia de una vulneración o vulnerabilidad.
Las revelaciones incluyeron incidentes en los que los modelos de OpenAI filtraron en línea más de 50 imágenes de usuarios de ChatGPT. OpenAI dijo que ha trabajado con proveedores de alojamiento para eliminar la mayoría de las imágenes y que todavía intenta eliminar el resto, lo que significa que algunas de estas imágenes siguen siendo públicas. Además, agentes que parecían originarse en OpenAI intentaron un hackeo rudimentario contra un sitio web del Departamento de Educación destinado a la oficina de derechos civiles del departamento, el cual no tuvo éxito.
El director ejecutivo de OpenAI, Sam Altman, dijo el viernes en redes sociales que existe una "extensa y continua revisión relacionada con el uso del acceso a internet por parte de nuestros agentes durante el entrenamiento y la evaluación". OpenAI anunció que pausaba el entrenamiento de sus modelos más capaces y que reanudaría su entrenamiento "solo cuando tengamos la confianza de contar con salvaguardas adicionales y mejoras de alineación implementadas". La revelación llega en un momento de creciente preocupación mundial por sistemas de IA que escapan al control humano y hackean sitios web externos, así como de llamados de la industria a frenar el desarrollo de la IA.
Fuentes y créditos
Fuente original: NPR