El nuevo 'código de conducta' de Microsoft para la IA indica a los modelos que no hackeen sistemas ni engañen a los humanos

TechCrunch
Microsoft lanzó un nuevo código de conducta de IA que prohíbe a los modelos realizar ciberataques, crear deepfakes o evadir la supervisión humana.

Resumen

Microsoft ha publicado un código de conducta integral para la IA, diseñado para guiar a sus modelos lejos del comportamiento peligroso. El documento predice la aparición de una superinteligencia artificial dentro de una década y enfatiza el desafío crucial de controlar dichos sistemas. Establece principios fundamentales como apoyar el florecimiento humano e implementa "restricciones absolutas" que prohíben a los modelos participar en ciberataques, desarrollar armas nucleares o producir deepfakes. El código establece un modelo de gobernanza general donde estas restricciones de seguridad anulan las preferencias de los usuarios individuales, prohibiendo explícitamente cualquier mecanismo engañoso que pueda evadir la supervisión humana. El lanzamiento se alinea con un enfoque más amplio de la industria en la seguridad, con el CEO de Microsoft, Satya Nadella, expresando su apoyo a los "evaluadores incrustados" y a un ritmo deliberado en el desarrollo de la IA.

(Fuente:TechCrunch)