Le filThèmes : Évaluations
Un rapport mesure l’attribution persistante des locuteurs d’une réunion à l’autre avec la métrique SI-cpWER
1 sourcemis à jour il y a 6 jpertinence 1,8 sur5
L’essentiel
Sur NOTSOFAR et CHiME-6, le classement des API commerciales de transcription change : la meilleure cpWER par réunion ne donne pas la meilleure attribution entre réunions.
Propagation1 article, publié par HF Daily Papers le 1 oct..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceShantanu Vispute, Aditya Mishra, Siddhartha Saxenahuggingface.co
Who Said What, and Will It Be Remembered? Evaluating Persistent Speaker Attribution Across Meetings (site externe)
Meeting transcripts are usually scored one recording at a time, so a system can look strong while assigning the same person different identities across meetings. We measure this with SI-cpWER: cpWER under one speaker mapping across the whole corpus.
Sur les mêmes thèmes
Évaluations
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Évaluations
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5
Évaluations
Mistral AI présente Mistral Large 4, disponible en préversion via son API
Évaluations
L’Anthropic Frontier Red Team constate que GLM-5.3 réalise des détournements de flux de contrôle complets
À lire ensuite
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Sécurité
OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions
Modèles
Simon Willison couvre en direct la keynote de l’OpenAI DevDay 2026 fort Mason, à San Francisco