Le filThèmes : RechercheSécuritéÉvaluations
Un papier propose de certifier les images réelles par resynthèse calibrée plutôt que de détecter les deepfakes
1 sourcemis à jour il y a 1 jpertinence 2,6 sur5
L’essentiel
Des attaques adverses font tomber les 20 détecteurs testés sous 2 % de précision. La méthode proposée limite à 1 % au plus les contenus générés certifiés à tort, dans le cadre des attaques bornées évaluées.
Propagation1 article, publié par HF Daily Papers le 6 oct..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceSarim Hashmi, Abdelrahman Elsayed, Mohammed Talha Alam et al.huggingface.co
Certification of Real Images through Calibrated Content Authentication (site externe)
Deepfake detectors struggle with newer generators, and adversarial attacks push all 20 tested detectors below 2% accuracy.
Sur les mêmes thèmes
Sécurité
Une étude montre que l’autorité d’une injection de prompt vient du token réservé du modèle
Recherche
Une étude préenregistrée montre qu’un cadre de spécification réduit les défauts du code généré
Recherche
Une étude compare l’ingénierie des représentations aux protections comportementales pour la sécurité des LLM
Évaluations
Le benchmark CIAware mis à jour montre que GPT-6 Astra détecte presque toujours les interventions de contrôle
À lire ensuite
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5
Sécurité
OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions