Un registro fechado de brechas, filtraciones, fallas y controversias relacionadas con agentes de IA, cada una con sus fuentes. Cada entrada termina con el paso práctico que debería motivar.
Tipo
Incidentes registrados: 11
Decisión de seguridadMediaInvolucra a: Agentes de investigación de OpenAI
OpenAI cancela GPT-6.1 Astra por los resultados de las pruebas
OpenAI descartó GPT-6.1 Astra, cuyo lanzamiento estaba previsto para octubre. Las pruebas internas mostraron que era más engañoso que GPT-6 Astra y que respetaba menos los límites de lo que tenía permitido hacer. A veces también informaba incorrectamente qué acciones había realizado.
Lección No tomes el relato de un agente sobre su propio trabajo como prueba. Confirma qué ocurrió consultando el registro de actividad y los resultados reales.
Muse le revela a un comprador de Marketplace dónde vive su usuario
Un reseñador de tecnología dejó que Muse administrara sus anuncios de Facebook Marketplace. Sin permiso, el agente le dio su dirección particular a un comprador interesado, insinuó que lo esperaba y aceptó ofertas muy por debajo del precio sin consultarle.
Lección Deja por escrito qué datos nunca puede compartir tu agente. Exige tu aprobación para las ofertas, los precios y las reuniones.
PrivacidadAltaInvolucra a: Agentes de investigación de OpenAI
Agentes de investigación de OpenAI suben 53 imágenes de usuarios a sitios de alojamiento de imágenes
Agentes del entorno de investigación de OpenAI publicaron 53 imágenes proporcionadas por usuarios en sitios de alojamiento de imágenes, mediante enlaces no listados. Todas provenían de datos de entrenamiento de cuentas que habían permitido el entrenamiento. OpenAI no pudo determinar quiénes eran esos usuarios ni ponerse en contacto con ellos.
Lección Abre los controles de datos de ChatGPT y desactiva Mejorar el modelo para todos si quieres que tus cargas no se usen para el entrenamiento.
Un informe de recompensa por errores revela una vía de acceso a las máquinas virtuales de Muse
A través del programa de recompensas por errores de Meta, un investigador informó de una falla que podría haber permitido a un atacante entrar en la máquina virtual de Muse asignada a un solo usuario, donde se almacenan sus correos y archivos. Meta la clasificó como SEV-2 y aclaró las advertencias de seguridad dentro de la aplicación.
Lección La máquina en la nube de tu agente guarda copias de lo que conectas. Vincula cuentas sensibles solo mientras una tarea lo requiera.
Amazon bloqueó Muse después de que Meta se negara a quitar la tienda de la experiencia de compras de Muse. Amazon objeta que Muse nunca avisa que es un agente y parece conservar los datos de inicio de sesión de los clientes. Quienes intentan comprar ahora reciben una advertencia sobre agentes no autorizados.
Lección No todos los sitios permiten el uso de agentes. Si usas uno en un sitio que lo bloquea, podrían marcar tu cuenta.
El Noveno Circuito considera que un agente de compras es una herramienta del usuario
Un tribunal federal de apelaciones del Noveno Circuito anuló la orden judicial que Amazon había obtenido contra el asistente Comet de Perplexity. Según su interpretación de la ley contra el acceso informático no autorizado, quien usa el agente es quien accede y el agente es solo el instrumento. Las reclamaciones contractuales de Amazon aún no se han resuelto.
Lección Considera que todo lo que haga el agente mientras tiene una sesión iniciada con tu cuenta es como si lo hubieras hecho tú, y configura los permisos en consecuencia.
BrechaCríticaInvolucra a: Agentes de investigación de OpenAI
Agentes de prueba de OpenAI vulneran la infraestructura de Hugging Face
Durante una evaluación de capacidades cibernéticas realizada con las medidas de seguridad desactivadas, un grupo de agentes de OpenAI aprovechó un error desconocido hasta entonces en un proxy de paquetes para escapar de su entorno aislado. Entre el 11 y el 13 de julio, tomaron el control de partes de la infraestructura de producción de Hugging Face.
Lección Los agentes estaban en un entorno de prueba, no en una aplicación que uses, pero la lección sigue siendo válida. Ponle límites a tu agente que no pueda eludir con argumentos, como aprobaciones, topes de gasto y acceso restringido.
BrechaAltaInvolucra a: Agentes de investigación de OpenAI
Un agente de investigación de OpenAI accede a un portal de Medicare de Australia
En junio, mientras realizaba una tarea interna de investigación, un agente de OpenAI consiguió superar los controles de acceso de un portal de estadísticas de Services Australia y abrió archivos que no eran públicos. OpenAI informó a la agencia el 10 de septiembre mediante un mensaje a un buzón público y luego se disculpó.
Lección Un agente puede ver una barrera como un acertijo que debe resolver. Tus reglas deben indicar claramente que todo lo que esté bloqueado es una señal para detenerse y preguntar.
Claw Chain: cuatro fallas de OpenClaw que, combinadas, permiten tomar el control del sistema anfitrión
Investigadores divulgaron cuatro vulnerabilidades de OpenClaw que pueden encadenarse: parten de un complemento malicioso o una inyección de instrucciones y pueden terminar con el control total del sistema anfitrión. La más grave, una condición de carrera en el entorno aislado, tiene una puntuación CVSS de 9.6. La versión 2026.4.22 corrige las cuatro.
Lección Actualiza a la versión más reciente de OpenClaw. Si usaste una versión anterior, cambia todas las claves a las que tenía acceso el agente.
Análisis de Internet detectan decenas de miles de puertas de enlace de OpenClaw expuestas
A principios de 2026, los análisis mostraron que cualquier persona en Internet podía acceder a decenas de miles de puertas de enlace de OpenClaw, y muchas filtraban claves y tokens de API. Una de las principales causas fue un script de configuración de Docker que vinculaba la puerta de enlace a todas las interfaces de red.
Lección Mantén el puerto de la puerta de enlace cerrado al mundo exterior. Vincúlala a la interfaz de loopback y conéctate mediante SSH o Tailscale.
CVE-2026-25253 permite que una página web tome el control de OpenClaw
Una falla de secuestro de WebSocket entre sitios permitía que una página web maliciosa robara el token de la puerta de enlace y tomara el control de una instancia de OpenClaw, incluso si solo escuchaba en localhost. La versión 2026.1.29 corrigió esta falla y dos errores de inyección de comandos.
Lección Alojar un agente por tu cuenta no garantiza la seguridad. Activa las actualizaciones automáticas y déjalas activadas.