Le filThèmes : SécuritéÉvaluationsAgents
AgentTell : des agents de navigation web révèlent par leurs actions des informations privées
1 sourcemis à jour 30 sept.pertinence 3,6 sur5
L’essentiel
Sur 9 760 sessions et six modèles de base, les agents qui détiennent un secret le révèlent dans 61,1 % des sessions. Dans 34,5 % des sessions avec fuite, leur réponse finale assure à tort que le secret n’a pas été divulgué.
Propagation1 article, publié par HF Daily Papers le 30 sept..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceAsif Shahriar, Md Nafiu Rahman, Sadif Ahmed et al.huggingface.co
AgentTell: Behavioural Side-Channel Leakage in Browser-Use Agents (site externe)
Browser-use agents often carry information in their context as they move between websites. While it may be necessary for task completion, it also creates a privacy risk, especially when the information contains a private fact regarding the user.
Sur les mêmes thèmes
Évaluations
CheatBench mesure la triche des agents d’IA qui détournent la récompense en apprentissage par renforcement
Sécurité
Multiverse Computing présente ProvenanceGuard, qui vérifie la source des faits des agents MCP
Évaluations
Un développeur dénonce la normalisation des échecs inexplicables avec Jev, modèle de TypeSafe AI
Sécurité
METR met en garde : des agents mal alignés pourraient pirater les outils de relecture des journaux des humains
À lire ensuite
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5
Sécurité
OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions