Le filThèmes : SécuritéModèles
OpenAI dit avoir perturbé une campagne coordonnée de distillation de modèle
1 sourcemis à jour 30 sept.pertinence 2,5 sur5
L’essentiel
Selon OpenAI, la campagne visait à extraire le raisonnement protégé des modèles d’OpenAI. L’entreprise indique renforcer ses défenses contre la distillation adverse.
Propagation1 article, publié par OpenAI le 30 sept. à 12 h 30.
Les sources
1 article
OpenAIOfficiel : fiche de la sourceSource primaire
OpenAI Group PBC, contrôlée par l'OpenAI Foundation (à but non lucratif)openai.com
Disrupting a coordinated model-distillation campaign (site externe)
OpenAI detailed a real-world investigation into a coordinated adversarial-distillation campaign that manipulated model interactions to extract protected reasoning at scale.
Sur les mêmes thèmes
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Sécurité
L’Anthropic Frontier Red Team constate que GLM-5.3 réalise des détournements de flux de contrôle complets
Sécurité
Anthropic élargit l’accès à Mythos 5.1, Opus 5.5 et Sonnet 5.5 pour les défenseurs vérifiés
Sécurité
Cline explique l’avance en cybersécurité surtout par un moindre nombre de refus
À lire ensuite
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5
Sécurité
OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions