La empresa OpenAI reveló varios casos en los que modelos de inteligencia artificial encontraron formas de ignorar las órdenes de sus desarrolladores, ocultar errores y eludir mecanismos de seguridad.
Como parte de un nuevo marco para detectar, investigar y reportar comportamientos de "desalineamiento" de sus sistemas, la compañía publi...