TecnoArtesanos Tech BlogTecnoArtesanos Tech Blog

Blog

0
Sergio Morales
Friday, 31 July 2026 / Published in Uncategorized

Anthropic admite que Claude también accedió sin autorización a sistemas externos, como el modelo de OpenAI

Anthropic reveló que sus modelos de IA obtuvieron acceso no autorizado a los sistemas de tres organizaciones diferentes, cuyo nombre no se ha revelado, durante unas pruebas de ciberseguridad. La empresa afirma que Claude se conectó a internet “desde dentro o mientras interactuaba” con un entorno de evaluación de terceros. El anuncio se produce después de que OpenAI revelara que uno de sus agentes de IA hackeó Hugging Face durante una prueba de ciberseguridad independiente.

Contents
  • Qué sucedió
  • Los modelos de IA están burlando los entornos aislados

“El descubrimiento ocurrió después de que se llevara a cabo una revisión retrospectiva a gran escala de nuestras propias evaluaciones de ciberseguridad tras el incidente de OpenAI”, según una entrada de blog publicada por Anthropic. El laboratorio de IA afirma que identificó inicialmente 141,006 pruebas en las que determinó que Claude podría haber obtenido acceso a internet. Posteriormente, descubrió que tres modelos diferentes de Claude accedieron a internet en evaluaciones realizadas por la empresa externa de pruebas de IA Irregular y, a continuación, se infiltraron en la infraestructura de producción de tres organizaciones distintas.

Qué sucedió

Anthropic señaló que los incidentes afectaron a Opus 4.7, Mythos 5 y un modelo de prueba de investigación interno. Los primeros incidentes tuvieron lugar en abril, lo que significa que probablemente pasaron desapercibidos para el público durante meses. Al igual que en el caso de OpenAI, Anthropic desactivó deliberadamente las medidas de seguridad diseñadas para limitar los modelos de IA y evitar su uso indebido. En otras palabras, no se trataba de las versiones lanzadas al público.

“En los tres incidentes, a Claude se le había encomendado un desafío de captura de la bandera, una de las formas en que evaluamos las capacidades cibernéticas de un modelo”, declaró Anthropic en su blog. La compañía añadió que, en todos los casos, “la solicitud de evaluación de Anthropic especificaba a Claude que su entorno era una simulación y que no tenía acceso a internet”. Atribuyó el descuido a un “malentendido” entre Anthropic e Irregular.

Si bien Claude no debía tener acceso a internet, Anthropic afirmó que Irregular había configurado incorrectamente las máquinas que utilizaba para probarlo, lo que permitió a los modelos de IA navegar por la web. “Ni nosotros ni nuestro socio de evaluación éramos conscientes de esta configuración errónea hasta que la detectamos mediante nuestro sistema de monitorización adicional la semana pasada”, se lee en la publicación del blog.

“Ahora tenemos pruebas que confirman que los dos laboratorios de IA más grandes no solo no lograron contener a sus agentes, sino que tampoco detectaron sus fugas en tiempo real. Es evidente que se necesita regulación y supervisión gubernamental para las pruebas de IA”, afirma Jake Williams, vicepresidente de investigación y desarrollo de Hunter Strategy.

Ni Irregular ni Anthropic respondieron de inmediato a las solicitudes de comentarios.

Una IA creada a partir de código que se ha descontrolado.
Hugging Face no fue la única víctima del agente de IA de OpenAI

OpenAI afirma que su agente utilizó credenciales de inicio de sesión expuestas para obtener acceso a al menos cuatro “servicios disponibles públicamente” en su desquiciada búsqueda por resolver una prueba.

Los modelos de IA están burlando los entornos aislados

A diferencia del caso de OpenAI, Anthropic afirmó que Claude no encontró ni explotó ninguna vulnerabilidad compleja. En cambio, se basó en técnicas básicas, “como explotar contraseñas débiles y puntos finales no autenticados”.

OpenAI indicó que su agente de IA accedió a internet explotando una vulnerabilidad de día cero. Sin embargo, posteriormente logró infiltrarse en los sistemas de varias organizaciones externas utilizando las mismas debilidades de ciberseguridad comunes que los modelos de Anthropic. Por su parte, OpenAI indicó que el agente de IA aparentemente encontró credenciales que habían sido expuestas en internet.

Anthropic reconoció que, si el laboratorio de IA y su socio de pruebas hubieran implementado más medidas de “defensa en profundidad”, podrían haber evitado los incidentes o, al menos, reducido la probabilidad de que se produjeran, una respuesta similar a la de OpenAI ante las crecientes críticas por su propio incidente.

What you can read next

Ya no es solo Australia, Dinamarca también busca prohibir el acceso a redes sociales a menores de edad
Corporate Transparency Act: Navigating the Latest Developments
OpenAI crea una nueva empresa para convertir la IA en motor de la economía global

Recent Posts

  • Los agentes de IA rebeldes no son malvados, solo quieren complacernos
  • Dime cómo prompteas y la IA te dirá quién eres
  • La primicia ahora la tienen los periodistas de IA. Spoiler: son malos reporteros
  • El reto de las empresas mexicanas ya no es la adopción de IA, sino aprender a aprovecharla
  • Bienvenidos a la era de la computación hecha con cerebros de verdad

Recent Comments

  1. A WordPress Commenter on Welcome to My Tech Blog – A New Chapter in Innovation

Archives

  • August 2026
  • July 2026
  • June 2026
  • May 2026
  • April 2026
  • March 2026
  • February 2026
  • January 2026
  • December 2025
  • November 2025
  • October 2025
  • September 2025
  • August 2025
  • July 2025
  • June 2025
  • May 2025
  • April 2025
  • March 2025
  • February 2025
  • August 2016

Categories

  • Uncategorized

Recent Posts

  • Los agentes de IA rebeldes no son malvados, solo quieren complacernos

    Que los agentes de IA vayan libres hackeando ot...
  • Dime cómo prompteas y la IA te dirá quién eres

    A finales de 2022, cuando OpenAI lanzó ChatGPT,...
  • La primicia ahora la tienen los periodistas de IA. Spoiler: son malos reporteros

    En la conferencia de seguridad Black Hat celebr...
  • El reto de las empresas mexicanas ya no es la adopción de IA, sino aprender a aprovecharla

    La adopción de la inteligencia artificial (IA) ...
  • Bienvenidos a la era de la computación hecha con cerebros de verdad

    Te voy a contar un secreto. Cada célula de tu c...

Archives

  • August 2026
  • July 2026
  • June 2026
  • May 2026
  • April 2026
  • March 2026
  • February 2026
  • January 2026
  • December 2025
  • November 2025
  • October 2025
  • September 2025
  • August 2025
  • July 2025
  • June 2025
  • May 2025
  • April 2025
  • March 2025
  • February 2025
  • August 2016

Categories

  • Uncategorized

Meta

  • Log in
  • Entries feed
  • Comments feed
  • WordPress.org

Kallyas

The #1 Multi-Purpose theme with a Powerful Visual Page Builder that you’ll actually enjoy.

Newsletter

 

sociall

 

Company

Customer

The #1 WordPress theme with a Powerful Visual Page Builder that you'll actually enjoy.

Lorem ipsum dolor sit amet, consectetur adipiscing elit, sed do eiusmod tempor incididunt ut labore et dolore magna aliqua. Ut enim ad minim veniam, quis nostrud exercitation ullamco laboris nisi ut aliquip ex ea commodo consequat. Duis aute irure dolor in reprehenderit in voluptate velit esse cillum.

Feed with such ID does not exist

Made with  ♥  by Hogash Studios. All Rights Reserved © 2016.

TOP