Le filThèmes : AgentsRecherche
EVISKILL fait évoluer les compétences des agents LLM à partir de preuves rejouables
1 sourcemis à jour il y a 13 hpertinence 3,2 sur5
L’essentiel
Le framework organise les observations d’exécution en cartes de preuves rejouables et vérifie les modifications par un nouveau rejeu. Les expériences portent sur trois benchmarks interactifs et six modèles de base.
Propagation1 article, publié par HF Daily Papers le 7 oct..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceYan Zhou, Yili Wang, Yiwei Dai et al.huggingface.co
EVISKILL: Grounding Skill Evolution in Replayable Evidence (site externe)
Continual skill evolution enables LLM agents to accumulate and refine reusable procedural knowledge from interaction experience without updating model parameters.
Sur les mêmes thèmes
Agents
SkillSeek montre que BM25 rivalise avec la recherche agentique de skills pour les agents
Agents
PUBG Ally, un agent incarné vocal, joue comme coéquipier d’IA dans PUBG : BATTLEGROUNDS
Agents
DAEDALUS construit une mémoire d’agent à partir de tâches que des agents génèrent eux-mêmes
Agents
VeriHarness transforme le LLM d’un générateur en agent vérificateur pour les tâches longues
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5