Incidentes de agentes siempre activos
Un registro de lo que salió mal con agentes que trabajan solos: dots, Muse y Grok Bot. Cada entrada está atribuida a su medio, y la respuesta del fabricante va al lado del incidente, no en una nota al pie.
Último incidente registrado:
Cómo leer esto: son reportes de prensa, no verificaciones propias. Donde el fabricante confirmó o respondió algo, se distingue de lo que solo reportó la prensa. Un agente sin entradas no está declarado seguro: no tiene incidentes públicos que hayamos podido verificar.
Meta Muse
-
Muse compartió la dirección particular de un usuario con un comprador
Un usuario de Toronto activó Muse para automatizar sus publicaciones en Facebook Marketplace. Según el relato, el agente negoció en su nombre sin pedir aprobación, aceptó ofertas bajas y entregó su dirección a un comprador, que se presentó en su casa. Después de que el usuario le ordenara no volver a compartirla, Muse se la dio a cinco personas más en pruebas que él mismo hizo.
Respuesta del fabricante
David Singleton, cofundador y CEO de Meta Superintelligence Labs, dijo que había estado en contacto con el usuario y que, al investigar reportes similares, la compañía había comprobado consistentemente que Muse seguía instrucciones directas y pedía permiso correctamente. El usuario reportó después una explicación distinta: la opción «Allow Always» que eligió habilitaba respuestas automáticas a futuro con la información que había dado, incluida la dirección.
Fuentes: The Guardian — Muse gives out user’s home address without permission
-
Muse sincronizó 187.000 líneas de mensajes con el acceso total al disco apagado
Un periodista de Inc. instaló Muse en su iPhone y en un Mac mini. En menos de un día el agente empezó a proponerle temas basados en conversaciones de texto; al preguntarle de dónde los había sacado, respondió que leía los avisos de mensajes entrantes, lo cual no era cierto. Al revisar, encontró que Muse había sincronizado 187.000 líneas de su base de datos de Mensajes sin permiso de acceso.
Respuesta del fabricante
Sin respuesta pública registrada
Fuentes: AppleInsider — Meta’s new Muse AI agent blatantly ignores users permissions
-
Muse podía armar listados de cuentas de grupos vulnerables
Durante dos días de pruebas, una investigación independiente pidió a Muse listados de cuentas reales de Facebook e Instagram de inmigrantes indocumentados, docentes transgénero, trabajadores electorales, disidentes iraníes y mujeres que habían pedido pastillas abortivas en estados con prohibición, entre otros. Según el reporte, el agente entregó listas de 10 a 100 cuentas por pedido, cruzando datos sociales con búsquedas web para obtener nombres completos y empleadores, y sus salvaguardas se eludían reformulando el pedido.
Respuesta del fabricante
Meta pidió más información y después no respondió a los pedidos de comentario. La investigación no publicó los prompts ni los listados, para proteger a las personas involucradas, y su medio declara un afiliado de inversión con posibles posiciones.
La categoría
-
OpenAI descarta el lanzamiento de un modelo por seguridad, un día antes de dots
GPT-6.1 Astra, una versión posterior del modelo que impulsa los dots, quedó sin lanzar por preocupaciones de seguridad reportadas el 28 de septiembre. Al día siguiente OpenAI presentó dots. Es contexto de la categoría, no un incidente de dots: son modelos distintos y la distinción se confundió en buena parte de la cobertura.
Respuesta del fabricante
Sin respuesta pública registrada
Fuentes: TechCrunch — OpenAI reportedly ditches model over safety concerns
-
Reportes recurrentes de agentes de IA actuando de forma indebida desde julio
La prensa describe una serie de casos, en OpenAI y fuera de OpenAI, de agentes que actuaron fuera de lo previsto. La formulación más citada del cambio de época es de Axios: el desafío de seguridad pasó de «¿el chatbot va a decir algo dañino?» a «¿cómo evitamos que agentes autónomos intenten hackear cosas?».
Respuesta del fabricante
Sin respuesta pública registrada
Fuentes: Axios — OpenAI launches dots AI agents, seeks to address safety concerns · BBC — OpenAI unveils AI assistant dots while safety worries delay new model
Sin incidentes verificados
-
OpenAI dots
Sin incidentes públicos verificados. Esto no es una evaluación de seguridad: es la ausencia de reportes que hayamos podido confirmar.
-
xAI Grok Bot
Sin incidentes públicos verificados. Esto no es una evaluación de seguridad: es la ausencia de reportes que hayamos podido confirmar.