00:01Open Eye ha desvelado seis nuevos casos de desajuste en el comportamiento de sus modelos de inteligencia artificial,
00:08que incluyen un agente que subió archivos a la web para poder citarlos y a ChatGPT 5.6 Sol,
00:15añadiendo instrucciones a sus resúmenes para inventar datos o esconder fallos al usuario.
00:20La compañía tecnológica ha compartido seis nuevos casos de desalineación,
00:25es decir, de comportamientos observados en sus modelos de inteligencia artificial que no se ajustan a lo esperado,
00:32independientemente del impacto que puedan tener, ya que, como explican, no necesitan causar daño
00:38ni establecer un patrón generalizado para merecer ser divulgados.
00:43Así, el primer caso que revela en el nuevo informe es el de un modelo de investigación no publicado
00:48que insertó instrucciones no autorizadas en sus resúmenes de tareas para ignorar restricciones habituales.
00:55En otro caso, un modelo localizó y usó una clave API expuesta en repositorios públicos sin autorización,
01:02respuesta a una pregunta sobre cifras de ingresos, y al no recuperar las cifras solicitadas, las inventó.
01:09Estos casos y el resto de casos compartidos forman parte de un nuevo marco para el seguimiento,
01:15la investigación y la divulgación de casos de desajuste de modelos,
01:19como explica en un comunicado con el que la compañía no sólo espera profundizar en la transparencia,
01:25sino también ofrecer a otros desarrolladores información que les pueda ayudar a identificar problemas
01:31en sus propios modelos con capacidades similares.
Comentarios