Le filThèmes : RechercheAgents
AI Night-Scientist apprend à des modèles à proposer des idées scientifiques plus créatives
1 sourcemis à jour 29 sept.pertinence 3,0 sur5
L’essentiel
Ce framework agentique entraîne les modèles avec le GRPO. Il élargit les directions de recherche de 27,8 % et les types de contribution de 14,9 % par rapport au modèle de base. Monter la température de décodage ne suffit pas.
Propagation1 article, publié par HF Daily Papers le 29 sept..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FacePriyanka Kargupta, Silviu Cucerzan, Shweti Mahajan et al.huggingface.co
Reinforcing Agentic Creativity in Scientific Ideation with Night Science (site externe)
Large language models (LLMs) excel at structured, verifiable tasks, but their low-entropy bias can produce homogeneous and predictable outputs, limiting their utility for open-ended scientific ideation.
Sur les mêmes thèmes
Agents
SkillSeek montre que BM25 rivalise avec la recherche agentique de skills pour les agents
Agents
PUBG Ally, un agent incarné vocal, joue comme coéquipier d’IA dans PUBG : BATTLEGROUNDS
Agents
DAEDALUS construit une mémoire d’agent à partir de tâches que des agents génèrent eux-mêmes
Agents
VeriHarness transforme le LLM d’un générateur en agent vérificateur pour les tâches longues
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5