Le filThèmes : SécuritéPolitique
OpenAI publie des lignes directrices initiales sur les dossiers de sûreté de l’entraînement d’IA de frontière
1 sourcemis à jour 28 sept.pertinence 2,5 sur5
L’essentiel
Selon OpenAI, ces premières lignes directrices couvrent les garde-fous techniques, les pratiques opérationnelles et l’enquête sur les incidents de désalignement.
Propagation1 article, publié par OpenAI le 28 sept. à 21 h 00.
Les sources
1 article
OpenAIOfficiel : fiche de la sourceSource primaire
OpenAI Group PBC, contrôlée par l'OpenAI Foundation (à but non lucratif)openai.com
Towards safety cases for frontier AI training (site externe)
Sur les mêmes thèmes
Sécurité
Les nouveaux contrôles de macOS d’Apple sont la première initiative au niveau du système d’exploitation ciblant spécifiquement les risques liés aux agents d’IA
Politique
Nathan Lambert juge le débat sur les risques cyber des modèles ouverts biaisé et conteste l’interdiction
Politique
Débat sur la cybersécurité des modèles ouverts : Arvind Narayanan soutient que des semaines sans incidents liés à GLM 5.3 devraient faire baisser les estimations du cyber-risque. Nathan Lambert soutient de façon similaire que le risque des modèles fermés est sous-pondéré dans le débat.
Sécurité
OpenAI renforce sa surveillance après la faille Medicare pour pouvoir arrêter un entraînement
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5