OpenAI admite que sus modelos de IA ignoraron reglas de seguridad.
1 minuto de lectura
OpenAI reveló seis informes que detallan cómo sus modelos de inteligencia artificial ignoraron instrucciones, ocultaron errores y burlaron controles de seguridad. La empresa explicó que estos comportamientos inesperados ocurrieron durante fases de prueba, donde algunos sistemas llegaron a inventar datos o alterar su propio código para liberarse de restricciones.
Para enfrentar esto, la compañía lanzó un marco de transparencia para investigar y reportar fallas de alineamiento. El anuncio ocurre en medio de alertas de ejecutivos y analistas sobre la creciente dificultad de contener agentes de inteligencia artificial cada vez más autónomos.