Le Crible

Édition de 14 h

Le filThèmes : SécuritéModèlesÉvaluations

L’Anthropic Frontier Red Team constate que GLM-⁠5.3 réalise des détournements de flux de contrôle complets

L’essentiel

Sur 100 tâches tirées au hasard du benchmark interne Binary Exploitation, GLM-⁠5.3 y parvient dans 4 % des essais, contre 6 % pour Claude Mythos Preview. Claude Opus 4.6 et GLM-⁠5.2 ne réussissent aucune tâche.

Couverture

Sources
2
Articles
2
Par type (sources)
Officiel 1Analyse 1
Sites repérés sur
Hacker News 1
Par rôle (articles)
Analyse 1Relais 1
Apports
Cite 1

Propagation2 articles en 4 h 49, d’anthropic.com à Simon Willison.

Les sources

1 article, puis 1 sous « Relayé par »

Aucune source primaire : la page de l’auteur du fait n’est pas parmi les sources.

Relayé par

  • Simon WillisonAnalyse : fiche de la sourceRelais+ 4 h 49

    Simon Willison, développeur indépendant (créateur de Datasette, co-créateur de Django)simonwillison.net

    Quoting Anthropic Frontier Red Team (site externe)

    Cite Anthropic Frontier Red Team :

    We evaluate several models on 100 tasks from the [internal Binary Exploitation benchmark] (selected at random), and find that GLM-5.3 develops full control flow hijacks in 4% of the trials; Claude Mythos Preview did so in 6%.

Sur les mêmes thèmes

  1. Modèles

    Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind

    Pertinence 5,0 sur54 sources

  2. Évaluations

    Cline explique l’avance en cybersécurité surtout par un moindre nombre de refus

    Pertinence 3,0 sur51 source

  3. Modèles

    Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5

    Pertinence 4,9 sur52 sources

  4. Modèles

    Mistral AI présente Mistral Large 4, disponible en préversion via son API

    Pertinence 4,6 sur54 sources

À lire ensuite

  1. Modèles

    OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna, deux modèles plus économiques qui complètent GPT-⁠6 Astra

    Pertinence 5,0 sur55 sources

  2. Modèles

    Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna à environ une heure d’écart

    Pertinence 5,0 sur55 sources

  3. Sécurité

    OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions

    Pertinence 4,8 sur54 sources

  4. Modèles

    Simon Willison couvre en direct la keynote de l’OpenAI DevDay 2026 fort Mason, à San Francisco

    Pertinence 4,7 sur53 sources