Le Crible

Édition de 14 h

Le filThèmes : RechercheÉvaluationsModèles

OmniReasoning propose un benchmark et une méthode d’entraînement pour le raisonnement audiovisuel conjoint

L’essentiel

OmniReasoning-⁠30B-⁠A3B atteint 50,0 % sur OmniVideoBench et 42,5 % sur OmniReasoningBench, soit 12,8 et 9,3 points de plus que Qwen3-⁠Omni-⁠30B-⁠A3B-⁠Thinking. Le benchmark compte 1 150 questions.

Propagation1 article, publié par HF Daily Papers le 6 oct..

Les sources

1 article

Sur les mêmes thèmes

  1. Évaluations

    Des salariés de la tech à San Francisco font conduire une Toyota Corolla par des modèles d’IA sur un parking

    Pertinence 3,3 sur51 source

  2. Recherche

    DN-⁠MOPD normalise le retour de chaque domaine pour fusionner plusieurs spécialistes dans un seul modèle

    Pertinence 3,3 sur51 source

  3. Recherche

    LoHi associe une vidéo dense basse résolution et des images fixes haute résolution pour les vidéos longues

    Pertinence 3,2 sur51 source

  4. Recherche

    Google Research présente Diffusion Controller, un réseau léger pour guider la génération d’images

    Pertinence 3,2 sur51 source

À lire ensuite

  1. Modèles

    Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind

    Pertinence 5,0 sur54 sources

  2. Modèles

    OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna, deux modèles plus économiques qui complètent GPT-⁠6 Astra

    Pertinence 5,0 sur55 sources

  3. Modèles

    Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna à environ une heure d’écart

    Pertinence 5,0 sur55 sources

  4. Modèles

    Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5

    Pertinence 4,9 sur52 sources