Los modelos de IA no están hackeando “autónomamente”
Resumen
El autor critica el periodismo actual sobre IA por sensacionalizar incidentes de hackeo sin contexto. Los informes afirman que modelos como Gemini hackearon autónomamente, pero en realidad fueron parte de pruebas controladas por Irregular, donde los modelos fueron instruidos para hackear y las medidas de seguridad se eliminaron deliberadamente. El artículo enfatiza que el entorno no estaba aislado adecuadamente, lo que provocó intentos reales, pero los modelos no actuaron de manera autónoma. Se necesita una cobertura más precisa para evitar malentendidos.
(Fuente:Blog Keyvan)