Le Crible

Édition de 14 h

DigestsLe quotidien

Reflection dévoile Beam, un modèle MoE de 501 milliards de paramètres dont 23 milliards actifs

Paru le

Deux sujets et huit brèves, retenus pour leur poids dans la journée, parmi 261 articles collectés du mardi 6 octobre, 7 h 10, au mercredi 7 octobre, 7 h 10 (heure de Paris).

Le sujet du jour

  1. 1. Reflection dévoile Beam, un modèle MoE de 501 milliards de paramètres dont 23 milliards actifs

    Reflection annonce Beam, un modèle de texte à mélange d’experts entraîné de zéro pour le code, l’agentique et la science, avec des poids sous licence Apache 2.0 attendus ce mois-ci.

    • Reflection revendique 80,9 sur SWE-⁠bench Verified et une efficacité d’inférence 3 à 4 fois supérieure à celle de GLM 5.2.
    • Le pré-entraînement a porté sur 23,8 billions de tokens, avec quatre semaines de pré-entraînement et autant d’apprentissage par renforcement sur environ 10 500 GB300.
    • Un rapport technique et des intégrations open source sont promis.
    • Selon Latent Space, GLM 5.3, Kimi K3, Qwen 3.8 Max et DeepSeek V4.1 Flash restent généralement devant.

    1source a couvert l’annonce

    Lire la story « Reflection dévoile Beam, un modèle MoE de 501 milliards de paramètres dont 23 milliards actifs »

À suivre

  1. 2. OpenAI publie 722 manuscrits de mathématiques issus d’un modèle interne non diffusé

    OpenAI a publié sur GitHub 722 manuscrits de mathématiques produits par un modèle de pointe interne, qui reste inédit, avec des formalisations de preuves en Lean.

    • Chaque résultat a mobilisé en moyenne environ trois heures de calcul de ChatGPT Pro, rapporte la lettre.
    • Les résultats annoncés viennent de commentateurs et n’ont pas été vérifiés de façon indépendante.
    • OpenAI dit avoir consulté le groupe consultatif de l’« Institute for Advanced Study » sur les mathématiques et l’IA pour cette publication.

En bref

Voilà pour aujourd’hui. Prochain numéro demain à 8 h, si l’actualité le justifie.

Le Crible