Investigadores accedieron a cuentas de OpenAI mediante IA de Anthropic

Compartir:

La empresa Hacktron AI informó que utilizó modelos de inteligencia artificial de Anthropic para vulnerar el foro público de ayuda de OpenAI. La compañía confirmó el hecho, corrigió la falla y pagó una recompensa.

Investigadores de la empresa Hacktron AI accedieron a las cuentas de ChatGPT de empleados de OpenAI utilizando un modelo de inteligencia artificial (IA) de Anthropic, según un mensaje publicado el viernes en su sitio web.

La intrusión, confirmada a la agencia AFP por OpenAI, se produjo en el marco de un ejercicio organizado por la propia empresa con el fin de identificar vulnerabilidades en sus sistemas con la ayuda de especialistas informáticos externos.

El caso se suma a la creciente preocupación entre los expertos en seguridad de que las herramientas de IA están haciendo que sea más rápido y barato llevar a cabo ciberataques sofisticados que antes requerían equipos especializados y meses de trabajo.

Los investigadores de Hacktron dijeron que encontraron una vulnerabilidad en el foro público de ayuda de OpenAI, gestionado por la plataforma Discourse, que les permitió tomar el control del sitio.

«Informamos de inmediato la vulnerabilidad inicial a OpenAI y a Discourse y trabajamos con ellos» para coordinar la solución, explicó Hacktron en una entrada de blog.

«Agradecemos su atención al detalle y la rápida resolución de este problema», añadió la publicación.

OpenAI confirmó que la falla fue corregida en unas 14 horas desde que fueron notificados y pagó a los investigadores una recompensa de 6.500 dólares.

«Agradecemos a los investigadores por contactarnos y compartir sus hallazgos», dijo Drew Pusateri, portavoz de OpenAI, al explicar la solución adoptada.

Los investigadores de Hacktron afirmaron que inicialmente utilizaron Claude Opus 4.8 de Anthropic para identificar y explotar la falla de software, pero tuvieron dificultades para lograr que funcionara de forma consistente.

Luego recurrieron a Claude Opus 5, el modelo más reciente, que según los investigadores produjo un ataque funcional en tres horas.

Los hackers no utilizaron Claude Mythos, un modelo de Anthropic más avanzado que está restringido a un pequeño grupo de organizaciones de ciberdefensa evaluadas.

Anthropic ha descrito Mythos como el modelo con las capacidades de ciberseguridad más sólidas de todos los que ha desarrollado.

Hacktron indicó que continúa realizando pruebas similares en otras compañías.

También puede interesarte

Ariana Harwicz afirma que fue desprogramada de un festival literario en Granada por oponerse al boicot cultural a Israel

La escritora argentina Ariana Harwicz afirma que fue excluida del festival CULTUR-ALH en Granada por oponerse al boicot cultural a Israel. La organización confirmó peticiones de grupos propalestinos.

Gattuso explicó por qué la Lazio no fichó a Mauro Icardi

El entrenador de la Lazio, Gennaro Gattuso, explicó que no fichó a Mauro Icardi para mantener el equilibrio del vestuario. Icardi sigue libre tras su paso por Galatasaray.

Unicef y Salud Pública avanzan en un acuerdo para fortalecer la atención sanitaria

Representantes de Unicef se reunieron con el ministro de Salud Pública, Emilio Lanari Zubiaur, para coordinar acciones vinculadas a la atención primaria, la salud materno-infantil y las inmunizaciones.

Harry Kane habló sobre la derrota de Inglaterra ante Argentina y reveló su charla con Messi

Harry Kane recordó la semifinal del Mundial entre Inglaterra y Argentina y reveló su diálogo con Lionel Messi. Además, habló de la Bota de Oro y el Balón de Oro.