Investigadores de seguridad utilizaron Claude para ayudarles a hackear OpenAI

The Verge
Tres investigadores usaron Claude de Anthropic para hackear cuentas de empleados de OpenAI en menos de 72 horas a través de una falla en un foro de terceros.

Resumen

Un equipo de tres investigadores de seguridad independientes de Hacktron informó que utilizaron los modelos de IA Claude Opus de Anthropic para acceder a cuentas de empleados de OpenAI. Los investigadores explotaron una vulnerabilidad en el sistema de procesamiento de imágenes HEIF de Discourse, la plataforma que aloja los foros de la comunidad de OpenAI. En menos de 72 horas del lanzamiento de Claude Opus 5, lograron la ejecución remota de código en Discourse Cloud y accedieron a la instancia de OpenAI. Demostraron su acceso enviando una solicitud de extracción desde la cuenta Codex de un empleado al repositorio interno de GitHub de OpenAI llamado "Monorepo", aunque no accedieron a su código. El proyecto "HEIF Heist" se adaptó para apuntar a múltiples otras empresas, incluyendo Slack y Meta, por menos de $3,000 en tokens, y solo Shopify detectó el intento. Las vulnerabilidades fueron posteriormente corregidas y OpenAI pagó a Hacktron $6,500 por encontrar el error. Los investigadores enfatizaron que no son un actor de amenaza importante, destacando el potencial del hackeo asistido por IA.

(Fuente:The Verge)