Le Crible

Édition de 14 h

Le filThèmes : SécuritéModèles

OpenAI dit avoir perturbé une campagne coordonnée de distillation de modèle

L’essentiel

Selon OpenAI, la campagne visait à extraire le raisonnement protégé des modèles d’OpenAI. L’entreprise indique renforcer ses défenses contre la distillation adverse.

Propagation1 article, publié par OpenAI le 30 sept. à 12 h 30.

Les sources

1 article

Sur les mêmes thèmes

  1. Modèles

    Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind

    Pertinence 5,0 sur54 sources

  2. Sécurité

    L’Anthropic Frontier Red Team constate que GLM-⁠5.3 réalise des détournements de flux de contrôle complets

    Pertinence 4,4 sur52 sources

  3. Sécurité

    Anthropic élargit l’accès à Mythos 5.1, Opus 5.5 et Sonnet 5.5 pour les défenseurs vérifiés

    Pertinence 3,5 sur51 source

  4. Sécurité

    Cline explique l’avance en cybersécurité surtout par un moindre nombre de refus

    Pertinence 3,0 sur51 source

À lire ensuite

  1. Modèles

    OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna, deux modèles plus économiques qui complètent GPT-⁠6 Astra

    Pertinence 5,0 sur55 sources

  2. Modèles

    Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna à environ une heure d’écart

    Pertinence 5,0 sur55 sources

  3. Modèles

    Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5

    Pertinence 4,9 sur52 sources

  4. Sécurité

    OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions

    Pertinence 4,8 sur54 sources