Le filThèmes : RechercheModèlesÉvaluations
DN-MOPD normalise le retour de chaque domaine pour fusionner plusieurs spécialistes dans un seul modèle
1 sourcemis à jour 29 sept.pertinence 3,3 sur5
L’essentiel
Sur des modèles Qwen3.5 de trois tailles, le retour sur les instructions domine les mises à jour de l’élève dans MOPD. DN-MOPD le rééchelonne et améliore le score moyen sur six benchmarks publics, à chaque taille.
Propagation1 article, publié par HF Daily Papers le 29 sept..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceXin Li, Hao Jiang, Xin Gao et al.huggingface.co
Beyond Teacher Assignment: Domain-Normalized Multi-Teacher On-Policy Distillation (site externe)
Sur les mêmes thèmes
Évaluations
Des salariés de la tech à San Francisco font conduire une Toyota Corolla par des modèles d’IA sur un parking
Recherche
LoHi associe une vidéo dense basse résolution et des images fixes haute résolution pour les vidéos longues
Recherche
Google Research présente Diffusion Controller, un réseau léger pour guider la génération d’images
Recherche
Une étude montre que les grands modèles de langage favorisent l’anglais américain comme norme par défaut
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5