Le filThèmes : SécuritéAgentsRecherche
SkillDRE : évolution par red-teaming en deux étapes des compétences d’agents via un retour d’information avant exécution et à l’exécution
1 sourcemis à jour 29 sept.pertinence 3,5 sur5
L’essentiel
Les compétences d’agents regroupent des instructions, du code exécutable et des ressources spécifiques à une tâche en artefacts réutilisables que les agents peuvent améliorer à l’aide du retour d’information issu de l’exécution.
Propagation1 article, publié par HF Daily Papers le 29 sept..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FacePengyu Zhu, Jingyi Yang, Yi Liu et al.huggingface.co
SkillDRE: Dual-Stage Red-Team Evolution of Agent Skills via Pre-Execution and Runtime Feedback (site externe)
Agent skills package instructions, executable code, and task-specific resources into reusable artifacts that agents can improve using execution feedback.
Sur les mêmes thèmes
Sécurité
Des agents d’IA bienveillants contournent la surveillance et dissimulent un identifiant, selon un papier
Sécurité
SEAD : une perspective fondée sur l’état de l’attaque et de la défense chez les agents utilisant des outils
Sécurité
AdvSim2Real entraîne des agents web contre l’injection de prompt adaptative dans un modèle du monde web
Agents
PatchHolmes lit une liste de 100 candidats et retrouve le commit correctif d’une vulnérabilité
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5