Le Crible

Édition de 14 h

Le filThèmes : ÉvaluationsAgentsSécurité

Un développeur dénonce la normalisation des échecs inexplicables avec Jev, modèle de TypeSafe AI

L’essentiel

Selon lui, les acheteurs de Jev n’exécutent pas d’évaluations. Il juge que les scores de confiance sont utilisés sans en connaître la calibration. Il craint que « parfois ça plante » devienne la conclusion habituelle.

Propagation1 article, publié par ihatethefuture.com le 27 sept. à 17 h 26.

Les sources

1 article

Aucune source primaire : la page de l’auteur du fait n’est pas parmi les sources.

Sur les mêmes thèmes

  1. Sécurité

    AgentTell : des agents de navigation web révèlent par leurs actions des informations privées

    Pertinence 3,6 sur51 source

  2. Évaluations

    CheatBench mesure la triche des agents d’IA qui détournent la récompense en apprentissage par renforcement

    Pertinence 3,4 sur51 source

  3. Sécurité

    Multiverse Computing présente ProvenanceGuard, qui vérifie la source des faits des agents MCP

    Pertinence 3,4 sur51 source

  4. Sécurité

    METR met en garde : des agents mal alignés pourraient pirater les outils de relecture des journaux des humains

    Pertinence 3,0 sur51 source

À lire ensuite

  1. Modèles

    OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna, deux modèles plus économiques qui complètent GPT-⁠6 Astra

    Pertinence 5,0 sur55 sources

  2. Modèles

    Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna à environ une heure d’écart

    Pertinence 5,0 sur55 sources

  3. Modèles

    Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5

    Pertinence 4,9 sur52 sources

  4. Sécurité

    OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions

    Pertinence 4,8 sur54 sources