Le Crible

Édition de 14 h

Le filThèmes : PolitiqueSécuritéOpen source

Nathan Lambert juge le débat sur les risques cyber des modèles ouverts biaisé et conteste l’interdiction

L’essentiel

Il estime que les modèles fermés sont documentés comme cause de la plupart des attaques existantes. Selon lui, interdire les modèles ouverts sans toucher aux API fermées accroîtrait l’écart entre l’attaque et la défense.

Propagation1 article, publié par Interconnects le 6 oct. à 16 h 22.

Les sources

1 article

Aucune source primaire : la page de l’auteur du fait n’est pas parmi les sources.

  1. InterconnectsAnalyse : fiche de la source

    Nathan Lambert, chercheur en post-entraînement, parti d'Ai2 le 2 juin 2026 (« doing something new »)interconnects.ai

    The Cyber Risk Discourse is Broken (site externe)

    I’ve had one too many discussions on the cyber risks of open models — where someone assumes that either banning open models happens in a silo (and bad actors will somehow actually be stopped) or that China is a threat and doesn’t care about AI safety.

Sur les mêmes thèmes

  1. Politique

    Débat sur la cybersécurité des modèles ouverts : Arvind Narayanan soutient que des semaines sans incidents liés à GLM 5.3 devraient faire baisser les estimations du cyber-risque. Nathan Lambert soutient de façon similaire que le risque des modèles fermés est sous-pondéré dans le débat.

    Pertinence 2,5 sur51 source

  2. Sécurité

    Des chercheurs testent Jev, entraîné par RL, comme détecteur d’échecs d’alignement des modèles d’IA

    Pertinence 3,5 sur51 source

  3. Sécurité

    NEEDLE retire des portes dérobées des LLM par orthogonalisation des poids, sans entraînement

    Pertinence 3,4 sur51 source

  4. Sécurité

    Les nouveaux contrôles de macOS d’Apple sont la première initiative au niveau du système d’exploitation ciblant spécifiquement les risques liés aux agents d’IA

    Pertinence 3,3 sur51 source

À lire ensuite

  1. Modèles

    Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind

    Pertinence 5,0 sur54 sources

  2. Modèles

    OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna, deux modèles plus économiques qui complètent GPT-⁠6 Astra

    Pertinence 5,0 sur55 sources

  3. Modèles

    Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna à environ une heure d’écart

    Pertinence 5,0 sur55 sources

  4. Modèles

    Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5

    Pertinence 4,9 sur52 sources