Le filThèmes : PolitiqueSécuritéOpen source
Nathan Lambert juge le débat sur les risques cyber des modèles ouverts biaisé et conteste l’interdiction
1 sourcemis à jour il y a 21 hpertinence 3,0 sur5
L’essentiel
Il estime que les modèles fermés sont documentés comme cause de la plupart des attaques existantes. Selon lui, interdire les modèles ouverts sans toucher aux API fermées accroîtrait l’écart entre l’attaque et la défense.
Propagation1 article, publié par Interconnects le 6 oct. à 16 h 22.
Les sources
1 article
Aucune source primaire : la page de l’auteur du fait n’est pas parmi les sources.
InterconnectsAnalyse : fiche de la source
Nathan Lambert, chercheur en post-entraînement, parti d'Ai2 le 2 juin 2026 (« doing something new »)interconnects.ai
The Cyber Risk Discourse is Broken (site externe)
I’ve had one too many discussions on the cyber risks of open models — where someone assumes that either banning open models happens in a silo (and bad actors will somehow actually be stopped) or that China is a threat and doesn’t care about AI safety.
Sur les mêmes thèmes
Politique
Débat sur la cybersécurité des modèles ouverts : Arvind Narayanan soutient que des semaines sans incidents liés à GLM 5.3 devraient faire baisser les estimations du cyber-risque. Nathan Lambert soutient de façon similaire que le risque des modèles fermés est sous-pondéré dans le débat.
Sécurité
Des chercheurs testent Jev, entraîné par RL, comme détecteur d’échecs d’alignement des modèles d’IA
Sécurité
NEEDLE retire des portes dérobées des LLM par orthogonalisation des poids, sans entraînement
Sécurité
Les nouveaux contrôles de macOS d’Apple sont la première initiative au niveau du système d’exploitation ciblant spécifiquement les risques liés aux agents d’IA
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5