Le Crible

Édition de 14 h

Le filThèmes : RechercheAgentsOpen source

DeskForge construit un corpus de 1,2 million d’observations de bureau pour des agents d’usage d’ordinateur

L’essentiel

Le fine-tuning de Qwen3.5-⁠4B sur des exemples tirés de DeskForge-⁠1M gagne 11,51 points de précision sur ScreenSpot-⁠Pro. Le code, le jeu de données et le modèle affiné sont disponibles.

Propagation1 article, publié par HF Daily Papers le 6 oct..

Les sources

1 article

Sur les mêmes thèmes

  1. Agents

    DAEDALUS construit une mémoire d’agent à partir de tâches que des agents génèrent eux-mêmes

    Pertinence 3,8 sur51 source

  2. Recherche

    AlignOPSD aligne la supervision avant d’attribuer le crédit pour distiller des agents à long horizon

    Pertinence 3,5 sur51 source

  3. Agents

    TimeEvo fait évoluer un agent de séries temporelles à partir de ses échecs diagnostiqués

    Pertinence 3,5 sur51 source

  4. Agents

    GraphForge synthétise des espaces de travail à partir de fichiers réels pour entraîner des agents

    Pertinence 3,4 sur51 source

À lire ensuite

  1. Modèles

    Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind

    Pertinence 5,0 sur54 sources

  2. Modèles

    OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna, deux modèles plus économiques qui complètent GPT-⁠6 Astra

    Pertinence 5,0 sur55 sources

  3. Modèles

    Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna à environ une heure d’écart

    Pertinence 5,0 sur55 sources

  4. Modèles

    Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5

    Pertinence 4,9 sur52 sources