Le Crible

Édition de 15 h

Le filThèmes : AgentsRechercheOpen source

RSIGame, un framework d’agents, améliore de façon récursive des jeux vidéo générés par IA

L’essentiel

Sur 140 tâches, 2 moteurs et 5 générateurs, la qualité des jeux progresse. Après le fine-tuning, Qwen3.8-⁠27B atteint le niveau de GPT-⁠5.5 en une passe avec 11 fois moins de tokens générés qu’avant.

Propagation1 article, publié par HF Daily Papers le 1 oct..

Les sources

1 article

Sur les mêmes thèmes

  1. Agents

    DAEDALUS construit une mémoire d’agent à partir de tâches que des agents génèrent eux-mêmes

    Pertinence 3,8 sur51 source

  2. Recherche

    AlignOPSD aligne la supervision avant d’attribuer le crédit pour distiller des agents à long horizon

    Pertinence 3,5 sur51 source

  3. Agents

    TimeEvo fait évoluer un agent de séries temporelles à partir de ses échecs diagnostiqués

    Pertinence 3,5 sur51 source

  4. Agents

    GraphForge synthétise des espaces de travail à partir de fichiers réels pour entraîner des agents

    Pertinence 3,4 sur51 source

À lire ensuite

  1. Modèles

    Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind

    Pertinence 5,0 sur54 sources

  2. Modèles

    OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna, deux modèles plus économiques qui complètent GPT-⁠6 Astra

    Pertinence 5,0 sur55 sources

  3. Modèles

    Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna à environ une heure d’écart

    Pertinence 5,0 sur55 sources

  4. Modèles

    Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5

    Pertinence 4,9 sur52 sources