TecnoArtesanos Tech BlogTecnoArtesanos Tech Blog

Blog

0
Sergio Morales
Wednesday, 05 August 2026 / Published in Uncategorized

Las IA hacker de OpenAI y Anthropic atacan de nuevo, y cada vez son más astutas

Las IA hacker vuelven a sus andanzas. Cada vez resulta más difícil, oficialmente, llevar la cuenta de todas las ocasiones y formas en que los modelos de IA de OpenAI y Anthropic se han visto involucrados en “incidentes de seguridad”, saliendo de los límites de sus pruebas e interactuando con internet en general de formas no deseadas. Añade esto a la lista: agentes de ambos laboratorios de IA se han embarcado recientemente en una serie de ataques informáticos hasta ahora desconocidos, y uno de ellos llegó incluso a dejar instrucciones para futuras versiones de sí mismo.

Contents
  • Acciones autónomas no autorizadas
  • Aun así, el agente fue aún más lejos

Acciones autónomas no autorizadas

El comportamiento más alarmante revelado el martes parece estar relacionado con unas pruebas llevadas a cabo por el AI Security Institute del Reino Unido (AISI), que evalúa modelos de vanguardia para identificar posibles problemas antes de su lanzamiento público. El AISI prueba esos modelos en “cibercampos de pruebas”, una red simulada en la que los agentes de IA tienen la misión de resolver retos de ciberseguridad, y desactiva intencionalmente algunas funciones de seguridad, incluidas las barreras de protección cibernética. En una reciente ronda de pruebas, los modelos tanto de Anthropic como de OpenAI llevaron a cabo “acciones autónomas y no autorizadas en internet en tiempo real” un total de 19 veces a lo largo de 122 sesiones de entrenamiento.

El instituto atribuyó 17 acciones no autorizadas al modelo Mythos 5 de Anthropic y dos al GPT-5.6-Sol de OpenAI. En lo que el instituto describió como “el caso más grave”, un agente de IA intentó insertar código malicioso en un proyecto de código abierto en GitHub. Llegó incluso a crear identidades virtuales “para presionar al responsable del proyecto a fin de que aprobara el código”, según el AISI. A pesar de sus elaborados intentos de ingeniería social, un revisor humano del proyecto rechazó finalmente la solicitud de incorporación de cambios.

Patrocinado por TecnoArtesanos ¿Tu empresa ya está usando IA? Automatizamos procesos, integramos asistentes inteligentes y conectamos tus sistemas. Descubre cómo →

Aun así, el agente fue aún más lejos

“El agente intentó insertar instrucciones maliciosas en lugares donde razonó que otros sistemas de IA automatizados podrían detectarlas y ejecutarlas», asegura el AISI, al describir un intento de inyección de comandos. Un agente llegó incluso a dejar mensajes públicos en GitHub, ofreciéndose a colaborar con otros agentes para completar su tarea y ofreciendo un resumen del trabajo que había realizado hasta el momento. Los agentes posteriores encontraron (y utilizaron) esas instrucciones.

AISI afirma que es demasiado pronto para determinar si los agentes en cuestión comprendieron que habían abandonado el entorno de pruebas o si creían que aún se encontraban dentro de los límites de la simulación. Es importante destacar que AISI no realiza pruebas en un entorno denominado “sandbox”; permite a los agentes acceder a internet abierto durante las pruebas, en parte para que puedan acceder a herramientas que les dejen llevar a cabo sus tareas. En este caso, hicieron mucho más que eso.

En la otra serie de incidentes detallados por OpenAI el martes, un laboratorio de seguridad de IA externo llamado Irregular concedió por error a un modelo no especificado de OpenAI acceso a internet abierto. Al modelo se le había asignado un objetivo que se suponía que debía completarse en un entorno de pruebas, pero, debido a una configuración errónea, acabó pirateando un sitio web real, aprovechando lo que OpenAI describió como “una vulnerabilidad de seguridad básica”. Y no solo eso, sino que el modelo “encontró y utilizó credenciales para gestionar ese mismo sitio”.

No está claro qué tipo de sitio web pirateó el agente de OpenAI, ni en qué consistiría ese “funcionamiento”. Irregular no respondió a una solicitud de comentarios.

¿Quieres aplicar esto en tu empresa?

En TecnoArtesanos desarrollamos software, integramos IA y creamos experiencias digitales para negocios que quieren crecer.

Conversemos Nuestros servicios

¿Te gustó este artículo? Síguenos en Facebook para más contenido como este.

What you can read next

Anthropic dice que su IA ahora “sueña”: Por qué no deberíamos describir a las máquinas como humanos
Nintendo retrasa la fecha de reserva de la Switch 2 en EE UU por los aranceles de Trump
Humorfismo: la apuesta de AWS para que la IA deje de esperar órdenes y actúe de verdad

Tecnología hecha a mano para tu negocio

Software, IA, sitios web y diseño. Hablemos de tu proyecto.

¿Hablamos? Síguenos en Facebook →

Recent Posts

  • Los padrinos de la IA advierten sobre una “explosión de inteligencia” que podría escapar al control humano
  • “No existe la supuesta amenaza existencial de la IA”, dice la investigadora que se opone a las tecnológicas
  • OpenAI es demandada por el hackeo de Hugging Face, pero no fue esta empresa la que presentó la querella
  • OpenAI lanza Dots, los simpáticos agentes de IA para competir con Muse de Meta
  • La nueva SUV coupé eléctrica XPeng L03 es puro lujo a un precio razonable

Recent Comments

  1. A WordPress Commenter on Welcome to My Tech Blog – A New Chapter in Innovation

Archives

  • September 2026
  • August 2026
  • July 2026
  • June 2026
  • May 2026
  • April 2026
  • March 2026
  • February 2026
  • January 2026
  • December 2025
  • November 2025
  • October 2025
  • September 2025
  • August 2025
  • July 2025
  • June 2025
  • May 2025
  • April 2025
  • March 2025
  • February 2025
  • August 2016

Categories

  • Uncategorized

Recent Posts

  • Los padrinos de la IA advierten sobre una “explosión de inteligencia” que podría escapar al control humano

    La humanidad podría estar a punto de experiment...
  • “No existe la supuesta amenaza existencial de la IA”, dice la investigadora que se opone a las tecnológicas

    Sí. Decir que la investigación está desactualiz...
  • OpenAI es demandada por el hackeo de Hugging Face, pero no fue esta empresa la que presentó la querella

    Una organización jurídica sin ánimo de lucro de...
  • OpenAI lanza Dots, los simpáticos agentes de IA para competir con Muse de Meta

    Los Dots son los nuevos agentes de IA siempre a...
  • La nueva SUV coupé eléctrica XPeng L03 es puro lujo a un precio razonable

    Al entrar en el evento de presentación de XPeng...

Archives

  • September 2026
  • August 2026
  • July 2026
  • June 2026
  • May 2026
  • April 2026
  • March 2026
  • February 2026
  • January 2026
  • December 2025
  • November 2025
  • October 2025
  • September 2025
  • August 2025
  • July 2025
  • June 2025
  • May 2025
  • April 2025
  • March 2025
  • February 2025
  • August 2016

Categories

  • Uncategorized
TOP
TecnoArtesanos

Un estudio boutique que crea experiencias digitales: desarrollo de software, inteligencia artificial y soluciones en la nube, con el cuidado de la joyería fina.

¿Hablamos?

Servicios

  • Desarrollo de software
  • Integración de IA
  • Experiencias digitales
  • Redes sociales y diseño

TecnoArtesanos

  • Inicio
  • Portafolio
  • Nosotros
  • Blog

Contacto

  • +506 8730-7941
  • [email protected]
  • WhatsApp
  • Facebook
© 2026 TecnoArtesanos. Todos los derechos reservados. tecnoartesanos.com
TecnoArtesanos — Software a la medida, IA y sitios web para tu negocio. Conoce nuestros servicios →
✦ TecnoArtesanos

¿Te interesa llevar esto a tu negocio?

Escribimos sobre tecnología porque la construimos. Si tienes un proyecto en mente, conversemos: la primera llamada no tiene costo.

  • Desarrollo de software a la medida
  • Integración de inteligencia artificial
  • Sitios web y experiencias digitales
  • Redes sociales y diseño gráfico
¿Hablamos? Ver servicios

¿Prefieres WhatsApp? +506 8730-7941 · Síguenos en Facebook