Le filThèmes : ÉvaluationsAgentsSécurité
Un développeur dénonce la normalisation des échecs inexplicables avec Jev, modèle de TypeSafe AI
1 sourcemis à jour 27 sept.pertinence 3,1 sur5
L’essentiel
Selon lui, les acheteurs de Jev n’exécutent pas d’évaluations. Il juge que les scores de confiance sont utilisés sans en connaître la calibration. Il craint que « parfois ça plante » devienne la conclusion habituelle.
Propagation1 article, publié par ihatethefuture.com le 27 sept. à 17 h 26.
Les sources
1 article
Aucune source primaire : la page de l’auteur du fait n’est pas parmi les sources.
ihatethefuture.comAnalyseAnalyse
repéré sur Hacker News
The Normalization of Inexplicable Failures (site externe)
Sur les mêmes thèmes
Sécurité
AgentTell : des agents de navigation web révèlent par leurs actions des informations privées
Évaluations
CheatBench mesure la triche des agents d’IA qui détournent la récompense en apprentissage par renforcement
Sécurité
Multiverse Computing présente ProvenanceGuard, qui vérifie la source des faits des agents MCP
Sécurité
METR met en garde : des agents mal alignés pourraient pirater les outils de relecture des journaux des humains
À lire ensuite
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5
Sécurité
OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions