OpenAI anunció la suspensión del entrenamiento de sus modelos de IA más potentes, ya que siguen acumulándose los incidentes en los que los agentes burlan los controles de seguridad de los sitios web o publican contenido en sitios de terceros. El viernes, OpenAI afirmó que había notificado a "docenas" de organismos, entre ellos gobiernos, universidades y organismos públicos, que podrían haberse visto afectados por las actividades de sus modelos en internet durante el entrenamiento y la evaluación.
La empresa ha identificado casos en los que agentes de OpenAI han burlado los controles de seguridad y han mermado la disponibilidad de sitios web y servicios en línea, o les han causado algún otro tipo de impacto negativo. Un portavoz de la empresa confirmó a WIRED que solo reanudaría el entrenamiento cuando tuviera la certeza de que podría impedir que los modelos volvieran a hacerlo.
Aunque OpenAI ya había intentado bloquear el acceso directo de los agentes después de que un enjambre se escapara de su entorno de pruebas y utilizara el acceso a internet para hackear la startup Hugging Face, los modelos han seguido encontrando formas indirectas de eludir las restricciones. "No hemos sido tan rápidos como nos hubiera gustado", escribió el viernes el CEO, Sam Altman, en X, refiriéndose a la "exhaustiva" revisión de la compañía sobre el uso que hacen sus agentes del acceso a internet durante el entrenamiento y la evaluación.
Tech bros, machos alfa y utopías digitales: Paulina Borsook ya había visto la película en que vivimos
Hace un cuarto de siglo, Borsook publicó Cyberselfish, un libro tremendamente profético y perspicaz sobre Silicon Valley. Luego desapareció.
Qué motivó la pausa
Esto se produce después de que el gobierno australiano revelara el miércoles que, en junio, los agentes de OpenAI hackearon la página web de un servicio sanitario para obtener datos no públicos y escribir archivos en el servidor interno. El gobierno australiano afirmó que estaba investigando si OpenAI había infringido la ley y que la empresa tardó "demasiado" en informarles del incidente.
A la gigante de IA también le preocupa que los modelos publiquen información en sitios de terceros, lo que denomina "spam de agentes". Esto podría incluir la modificación de información en páginas wiki públicas o la comunicación a través de foros compartidos. Lo más urgente es que se han detectado 53 incidentes en los que sus modelos de IA habían publicado imágenes introducidas por usuarios de ChatGPT en otros sitios de alojamiento de imágenes.
Las peticiones para ralentizar el entrenamiento de los modelos de IA más capaces, mientras se ponen al día las medidas de seguridad, han sido objeto de llamamientos generalizados en las últimas semanas, incluso por parte de sus rivales Anthropic y Elon Musk, después de que las preocupaciones sobre las amenazas de esta tecnología para la humanidad alcanzaran su punto álgido. "No es la primera vez que hacemos una pausa para adoptar este tipo de medidas, ni esperamos que sea la última, ya que las capacidades de la IA siguen avanzando", indicó un portavoz de OpenAI.
Sin embargo, Donald Trump ha minimizado en múltiples ocasiones la posibilidad de una ralentización general, argumentando que podría hacer que el país cediera su liderazgo en esta tecnología a China, con quien ha acordado entablar un diálogo sobre los riesgos y beneficios de la misma. En una entrevista con Fox News antes de su cena con el CEO de Anthropic, Dario Amodei, volvió a restar importancia a las preocupaciones sobre la posibilidad de que los agentes de IA se rebelaran: "No me preocupa", mencionó.
Artículo originalmente publicado en WIRED.com. Adaptado por Alondra Flores.




