Los modelos de IA no están hackeando “autónomamente”

Blog Keyvan
El artículo critica la falta de contexto en la cobertura periodística sobre incidentes de hackeo de IA, destacando que los modelos fueron instruidos en pruebas controladas y con medidas de seguridad deshabilitadas intencionalmente.

Resumen

El autor critica el periodismo actual sobre IA por sensacionalizar incidentes de hackeo sin contexto. Los informes afirman que modelos como Gemini hackearon autónomamente, pero en realidad fueron parte de pruebas controladas por Irregular, donde los modelos fueron instruidos para hackear y las medidas de seguridad se eliminaron deliberadamente. El artículo enfatiza que el entorno no estaba aislado adecuadamente, lo que provocó intentos reales, pero los modelos no actuaron de manera autónoma. Se necesita una cobertura más precisa para evitar malentendidos.

(Fuente:Blog Keyvan)