OpenAI revela seis nuevos incidentes "preocupantes" con sus agentes de IA

photo d illustration du logo openai

Los agentes de inteligencia artificial (IA) de OpenAI han vuelto a demostrar que pueden desviarse de las instrucciones recibidas. La compañía ha revelado seis nuevos incidentes "inesperados o preocupantes" en los que sus modelos encontraron formas de esquivar restricciones, ocultar errores o acceder a recursos que no tenían autorización para utilizar. La startup ha respondido con un marco de supervisión para detectar, investigar y divulgar estos episodios.

Seguir leyendo en la fuente originalcontador

Noticias relacionadas

IBEX 35

19.803,400

167,600

0,854%