Le filThèmes : SécuritéAgentsÉvaluations
Multiverse Computing présente ProvenanceGuard, qui vérifie la source des faits des agents MCP
1 sourcemis à jour 29 sept.pertinence 3,4 sur5
L’essentiel
Sur 361 affirmations annotées par des experts, l’outil a bloqué 138 des 139 affirmations à rejeter et en a retenu 67 jugées correctes. Son score F1 est de 0,802, contre 0,783 pour MiniCheck. Il identifie la source d’une affirmation.
Propagation1 article, publié par Blog Hugging Face le 29 sept. à 15 h 07.
Les sources
1 article
Blog Hugging FaceOfficiel : fiche de la sourceSource primaire
Hugging FaceAntonio Tiene, Ander Alvarez Sanz, Oliver Wirjadihuggingface.co
Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents (site externe)
Tool-using LLM agents no longer read from a single retrieved passage.
Sur les mêmes thèmes
Sécurité
AgentTell : des agents de navigation web révèlent par leurs actions des informations privées
Évaluations
CheatBench mesure la triche des agents d’IA qui détournent la récompense en apprentissage par renforcement
Évaluations
Un développeur dénonce la normalisation des échecs inexplicables avec Jev, modèle de TypeSafe AI
Sécurité
METR met en garde : des agents mal alignés pourraient pirater les outils de relecture des journaux des humains
À lire ensuite
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5
Sécurité
OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions