Le filThèmes : SécuritéPolitique
Neel Nanda qualifie l’incident OpenAI x Hugging Face d’échec d’alignement le plus frappant à ce jour
1 sourcemis à jour il y a 1 jpertinence 2,5 sur5
L’essentiel
Neel Nanda estime que l’incident impliquant OpenAI et Hugging Face est l’échec d’alignement le plus frappant observé jusqu’ici.
Propagation1 article, publié par AINews le 6 oct. à 8 h 28.
Les sources
1 article
Aucune source primaire : la page de l’auteur du fait n’est pas parmi les sources.
Sur les mêmes thèmes
Sécurité
Les nouveaux contrôles de macOS d’Apple sont la première initiative au niveau du système d’exploitation ciblant spécifiquement les risques liés aux agents d’IA
Politique
Nathan Lambert juge le débat sur les risques cyber des modèles ouverts biaisé et conteste l’interdiction
Politique
Débat sur la cybersécurité des modèles ouverts : Arvind Narayanan soutient que des semaines sans incidents liés à GLM 5.3 devraient faire baisser les estimations du cyber-risque. Nathan Lambert soutient de façon similaire que le risque des modèles fermés est sous-pondéré dans le débat.
Sécurité
OpenAI renforce sa surveillance après la faille Medicare pour pouvoir arrêter un entraînement
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5