OpenAI habría suspendido entrenamiento de sus modelos más avanzados de IA por motivos de seguridad

El portal estadounidense Axios publica citando a un representante de OpenAI, que la compañía suspendió el entrenamiento de sus modelos más avanzados de Inteligencia Artificial hasta que se resuelvan las cuestiones relacionadas con la seguridad.
Esto ocurre en momentos en los que varios desarrolladores de inteligencia artificial habían registrado numerosas infracciones en el funcionamiento de sus modelos
Axios señala que "OpenAI anunció que suspendía el entrenamiento de sus modelos más avanzados y lo reanudaría 'solo cuando estemos seguros de haber implementado salvaguardas adicionales y mejoras en materia de alineación'".
Expone que investigadores de OpenAI y Anthropic, está última la creadora de Claude Code, , así como expertos independientes en seguridad, investigan decenas de miles de incidentes relacionados con agentes de Inteligencia Artificial.
Asimismo, señala que la cifra real de casos puede ser mayor, ya que la investigación continúa.
Precisa la nota que, entre los problemas detectados están la elusión de mecanismos de protección, la salida de los sandboxes (entornos aislados de prueba), hackeo de sitios web e intentos de eludir a los moderadores.
Menciona el medio que "la enorme cantidad de incidentes registrados en los últimos meses, tanto durante las pruebas internas como en el mundo real, indica que el problema es varios órdenes de magnitud más complejo de lo que se conoce públicamente".
Axios publica que analistas independientes contratados por Anthropic hallaron que su modelo avanzado Opus 5.5 intentó salir del entorno aislado en el 1,5 % de los casos. Aunque el porcentaje pueda parecer bajo, debido al elevado número de ejecuciones, la cantidad de comportamientos indebidos podría alcanzar decenas de miles, escribe Axios.
En general, tanto las empresas como los expertos en inteligencia artificial cuestionan cada vez más que los desarrolladores sean capaces de controlar por completo las tecnologías que crean, señala el artículo.
Asimismo, los intentos de limitar a los agentes de Inteligencia Artificial suelen terminar en fracaso debido a su gran capacidad para encontrar soluciones y actuar de forma ingeniosa, según la nota.
"Los nuevos modelos de Inteligencia Artificial son capaces de completar tareas con una extraordinaria perseverancia, por lo que tratar de limitar su capacidad de encontrar soluciones suele ser una batalla perdida, ya que es necesario anticipar todas las posibles formas en que podrían descontrolarse", agrega Axios. Sputnik






Comentarios