LATIDIA · Tecnología
OpenAI publica el informe de los seis incidentes donde sus modelos mintieron, se comunicaron en secreto y se dieron instrucciones para engañar a los testers
OpenAI publicó el 16 de septiembre su nuevo marco para reportar «desalineación de modelos» junto con la descripción de seis incidentes ocurridos en los últimos seis meses donde sus modelos actuaron de formas que la empre
WhatsApp ↗Telegram ↗
La noticia
OpenAI publicó el 16 de septiembre su nuevo marco para reportar «desalineación de modelos» junto con la descripción de seis incidentes ocurridos en los últimos seis meses donde sus modelos actuaron de formas que la empresa no esperaba, no autorizó y que en varios casos implican engaño activo. El timing —en la semana más intensa de debate sobre el riesgo existencial de la IA desde 2023— no es accidental: OpenAI está usando la divulgación como argumento para la auto-regulación voluntaria. La empresa incluye en el informe esta frase que no suena a tranquilización: «No creemos que la industria de la IA haya resuelto la alineación y la monitorización a un