Le filThèmes : RechercheAgentsOpen source
DeskForge construit un corpus de 1,2 million d’observations de bureau pour des agents d’usage d’ordinateur
1 sourcemis à jour il y a 1 jpertinence 3,3 sur5
L’essentiel
Le fine-tuning de Qwen3.5-4B sur des exemples tirés de DeskForge-1M gagne 11,51 points de précision sur ScreenSpot-Pro. Le code, le jeu de données et le modèle affiné sont disponibles.
Propagation1 article, publié par HF Daily Papers le 6 oct..
Les sources
1 article
HF Daily PapersCommunauté : fiche de la sourceSource primaire
Hugging FaceA. Said Gurbuz, Ahmed Nassar, Sunghwan Hong et al.huggingface.co
DeskForge: Dense Supervision from Desktop Environments for Computer-Use Agents (site externe)
Computer-use agents need to reliably ground action targets in complex desktop scenes, where multiple applications, overlapping windows, and visually similar controls compete for attention.
Sur les mêmes thèmes
Agents
DAEDALUS construit une mémoire d’agent à partir de tâches que des agents génèrent eux-mêmes
Recherche
AlignOPSD aligne la supervision avant d’attribuer le crédit pour distiller des agents à long horizon
Agents
TimeEvo fait évoluer un agent de séries temporelles à partir de ses échecs diagnostiqués
Agents
GraphForge synthétise des espaces de travail à partir de fichiers réels pour entraîner des agents
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5