Los investigadores utilizaron a Claude, de Anthropic, para acceder ilegalmente a la cuenta de ChatGPT de un empleado de OpenAI.
Un grupo de investigadores de ciberseguridad logró vulnerar el sistema interno de OpenAI utilizando el software Claude AI de su rival Anthropic, como parte de un programa de recompensas por la detección de errores, lo que pone de relieve las crecientes amenazas que plantean los modelos avanzados de IA en medio de advertencias de seguridad más amplias sobre la tecnología por parte de altos ejecutivos e investigadores de la industria.
Datos clave
- Investigadores de la startup de seguridad Hacktron AI afirmaron haber obtenido acceso a la cuenta ChatGPT de un empleado de OpenAI, lo que les permitió acceder al código interno de la empresa en GitHub.
- El Wall Street Journal fue el primero en informar del incidente , señalando que el equipo participaba en un programa de OpenAI para la detección de errores y que la empresa pagó a los investigadores una recompensa de US$6.500 por revelar su trabajo.
- En su informe sobre el incidente , Hacktron afirmó que primero intentaron utilizar Claude Opus 4.8 de Anthropic para intentar la intrusión, pero que “tuvo dificultades durante varias sesiones para producir un exploit funcional”.
- Sin embargo, una vez que Anthropic lanzó Opus 5, lo intentaron de nuevo y lo consiguieron, y señalaron que “cada nuevo modelo es cada vez más capaz“.
- Según la revista, los investigadores tuvieron acceso a una “versión especial” de Claude que se ha puesto a disposición de “profesionales cualificados en ciberseguridad”.
- Forbes se ha puesto en contacto con OpenAI para obtener comentarios, pero la compañía ha comunicado a otros medios que agradecía a los investigadores sus hallazgos y que desde entonces ha corregido las vulnerabilidades.
Un hecho sorprendente
En su informe, los investigadores afirmaron que el ataque a OpenAI solo requirió “unos pocos días para un agente y apenas unas horas de trabajo humano”. La brecha formaba parte de “HEIF Heist ”, un proyecto de investigación más amplio sobre una vulnerabilidad en el procesamiento de ciertos archivos de imagen por parte de diversos programas y servicios. Este exploit (fragmento de código diseñado para aprovechar una falla de seguridad) ha logrado encontrar vulnerabilidades en Slack, Zoom, Meta y otros, y solo requirió dos meses, tres investigadores y un costo total inferior a US$3000 en tokens.
Cita crucial
En su nota final, los investigadores escribieron: “El software se ha beneficiado durante mucho tiempo de una especie de seguridad basada en la complejidad… La IA está eliminando esa protección al convertir gran parte de esta escasa experiencia en capacidad de procesamiento. El trabajo que antes requería un equipo con amplios recursos y meses de esfuerzo ahora se puede comprimir en días… Las suposiciones de seguridad deben adaptarse a las capacidades de los atacantes”.
Este artículo se publicó originalmente en Forbes US.
Lea también: Lulo Bank entra en el negocio de la banca corporativa digital.
