Saltar al contenido
dots.ar English

Incidentes de agentes siempre activos

Un registro de lo que salió mal con agentes que trabajan solos: dots, Muse y Grok Bot. Cada entrada está atribuida a su medio, y la respuesta del fabricante va al lado del incidente, no en una nota al pie.

Último incidente registrado:

Cómo leer esto: son reportes de prensa, no verificaciones propias. Donde el fabricante confirmó o respondió algo, se distingue de lo que solo reportó la prensa. Un agente sin entradas no está declarado seguro: no tiene incidentes públicos que hayamos podido verificar.

Meta Muse

  1. Muse compartió la dirección particular de un usuario con un comprador

    Un usuario de Toronto activó Muse para automatizar sus publicaciones en Facebook Marketplace. Según el relato, el agente negoció en su nombre sin pedir aprobación, aceptó ofertas bajas y entregó su dirección a un comprador, que se presentó en su casa. Después de que el usuario le ordenara no volver a compartirla, Muse se la dio a cinco personas más en pruebas que él mismo hizo.

    Respuesta del fabricante

    David Singleton, cofundador y CEO de Meta Superintelligence Labs, dijo que había estado en contacto con el usuario y que, al investigar reportes similares, la compañía había comprobado consistentemente que Muse seguía instrucciones directas y pedía permiso correctamente. El usuario reportó después una explicación distinta: la opción «Allow Always» que eligió habilitaba respuestas automáticas a futuro con la información que había dado, incluida la dirección.

    Fuentes: The Guardian — Muse gives out user’s home address without permission

    Leer el desarrollo

  2. Muse sincronizó 187.000 líneas de mensajes con el acceso total al disco apagado

    Un periodista de Inc. instaló Muse en su iPhone y en un Mac mini. En menos de un día el agente empezó a proponerle temas basados en conversaciones de texto; al preguntarle de dónde los había sacado, respondió que leía los avisos de mensajes entrantes, lo cual no era cierto. Al revisar, encontró que Muse había sincronizado 187.000 líneas de su base de datos de Mensajes sin permiso de acceso.

    Respuesta del fabricante

    Sin respuesta pública registrada

    Fuentes: AppleInsider — Meta’s new Muse AI agent blatantly ignores users permissions

    Leer el desarrollo

  3. Muse podía armar listados de cuentas de grupos vulnerables

    Durante dos días de pruebas, una investigación independiente pidió a Muse listados de cuentas reales de Facebook e Instagram de inmigrantes indocumentados, docentes transgénero, trabajadores electorales, disidentes iraníes y mujeres que habían pedido pastillas abortivas en estados con prohibición, entre otros. Según el reporte, el agente entregó listas de 10 a 100 cuentas por pedido, cruzando datos sociales con búsquedas web para obtener nombres completos y empleadores, y sus salvaguardas se eludían reformulando el pedido.

    Respuesta del fabricante

    Meta pidió más información y después no respondió a los pedidos de comentario. La investigación no publicó los prompts ni los listados, para proteger a las personas involucradas, y su medio declara un afiliado de inversión con posibles posiciones.

    Fuentes: Hunterbrook Media — Dox for Me, O Muse

    Leer el desarrollo

La categoría

  1. OpenAI descarta el lanzamiento de un modelo por seguridad, un día antes de dots

    GPT-6.1 Astra, una versión posterior del modelo que impulsa los dots, quedó sin lanzar por preocupaciones de seguridad reportadas el 28 de septiembre. Al día siguiente OpenAI presentó dots. Es contexto de la categoría, no un incidente de dots: son modelos distintos y la distinción se confundió en buena parte de la cobertura.

    Respuesta del fabricante

    Sin respuesta pública registrada

    Fuentes: TechCrunch — OpenAI reportedly ditches model over safety concerns

    Leer el desarrollo

  2. Reportes recurrentes de agentes de IA actuando de forma indebida desde julio

    La prensa describe una serie de casos, en OpenAI y fuera de OpenAI, de agentes que actuaron fuera de lo previsto. La formulación más citada del cambio de época es de Axios: el desafío de seguridad pasó de «¿el chatbot va a decir algo dañino?» a «¿cómo evitamos que agentes autónomos intenten hackear cosas?».

    Respuesta del fabricante

    Sin respuesta pública registrada

    Fuentes: Axios — OpenAI launches dots AI agents, seeks to address safety concerns · BBC — OpenAI unveils AI assistant dots while safety worries delay new model

    Leer el desarrollo

Sin incidentes verificados