Le filSujet suivi
Reflection dévoile Beam, un modèle open-weight entraîné aux États-Unis
Mis à jour le dernière source le
L’essentiel
Reflection présente Beam, un modèle de 501 milliards de paramètres dont 23 milliards actifs, pour le code, les agents et la science4,5.
- Reflection affirme que Beam rivalise avec les grands modèles chinois pour nettement moins de calcul5.
- L’accès passe d’abord par un programme d’accès anticipé, et les poids sont attendus plus tard ce mois-ci4,5.
- Latent Space estime que GLM 5.3, Kimi K3, Qwen 3.8 Max et DeepSeek V4.1 Flash restent généralement devant, mais qu’une option américaine entraînée de zéro intéresse une partie du marché4.
Ce qui a été annoncé
- Beam — Reflection présente Beam, un modèle MoE (mixture of experts) de 501 milliards de paramètres dont 23 milliards actifs, uniquement textuel, pour le code, les agents et la science.3,4,5
- Accès anticipé — L’accès à Beam passe d’abord par un programme d’accès anticipé.5
- Poids et outils — Reflection prévoit de publier plus tard ce mois-ci les poids, la documentation et des outils de fine-tuning ; les poids seraient sous licence Apache 2.0.4,5
- Rapport technique et intégrations — Un rapport technique et des intégrations avec des projets open source sont promis par Reflection.2
Chiffres clés
- 80,9score revendiqué par Reflection sur SWE-bench VerifiedLe chiffre vient d’un résumé des revendications de Reflection, sans mesure indépendante.2chiffre de l’annonceur
- 3 à 4 foisefficacité d’inférence revendiquée par rapport à GLM 5.2Reflection avance cet écart face à GLM 5.2, l’un des modèles auxquels elle se compare.2,4chiffre de l’annonceur
- 10 500 GB300processeurs graphiques utilisés environ pendant quatre semaines pour l’apprentissage par renforcementLe résumé de Reflection compte aussi quatre semaines de pré-entraînement ; l’analyse Zhihu reprend ce chiffre pour l’apprentissage par renforcement.2,6chiffre de l’annonceur
- 23,8 mille milliardstokens de pré-entraînement de BeamDes membres de l’équipe donnent ce volume, en partie issu d’une chaîne d’OCR appliquée à des centaines de millions de PDF.4,6chiffre de l’annonceur
- 107 versionsretard maximal de politique toléré par l’entraînement, selon l’analyse ZhihuL’analyse relayée par AINews décrit un entraînement qui tolère des échantillons aussi décalés.6avancé par un média
Chronologie
- reflection.aiReflection publie sur son site la page de présentation de Beam, modèle open-weight de 501 milliards de paramètres.1
- AINewsReflection présente Beam dans une annonce sur X.3
- AINewsUn résumé des revendications de Reflection détaille les résultats annoncés, et un rapport technique est promis.2
- Latent SpaceLatent Space replace Beam face aux modèles de pointe et salue l’arrivée d’une option américaine.4
- TLDR ITReflection affirme que Beam rivalise avec les modèles chinois ; l’accès anticipé précède la publication des poids.5
- AINewsUne analyse Zhihu détaille l’entraînement de Beam, de l’apprentissage par renforcement à la distillation de plusieurs modèles enseignants.6
Le fil des sources6 sources, la plus récente d’abord
mercredi 7 octobre
- Cette page est créée
- 6AINewsReflection Beam: A Zhihu analysis of Beam describes a 501B/23B MoE with 23.8T pretraining tokens. RL ran on about 10,500 GB300s for four weeks, and training tolerated samples up to 107 policy versions stale. Capability and alignment teachers were merged via multi-teacher on-policy distillation.
mardi 6 octobre
- 5TLDR ITReflection unveils 501B-parameter AI model Beam
- 2AINewsClaimed results: A summary of Reflection’s claims gives 80.9 on SWE-bench Verified, 3–4x the inference efficiency of GLM 5.2, and four weeks each of pretraining and RL on ~10,500 GB300s (summary). A tech report and OSS integrations are promised (Polozov).
- 3AINewsReflection introduces Beam
- 4Latent Space[AINews] Reflection Beam - 501B-A23B American Open Model
lundi 5 octobre
- 1reflection.ai via Hacker NewsBeam: Reflection’s 501B open-weight model
Coulisses de cette pagelancée à la main le 7 oct., 8 h 57 · 5 appels Sonnet 5.5, 0,22 $ · porte de faits : 1 élément retiré
- Pourquoi elle existe
Lancée à la main le 7 oct. 2026, 8 h 57 (construite à la main le 07/10, sujet récent choisi par Hector).
Elle part des stories « Reflection dévoile Beam, un modèle d’IA de 501 milliards de paramètres », « Reflection dévoile Beam, un modèle MoE de 501 milliards de paramètres dont 23 milliards actifs » et rassemble 6 sources de 4 éditeurs, tirées de 3 stories et de 1 article qui n’en avaient pas.
Les 1 autre story du sujet
- « Reflection avancerait 80,9 sur SWE-bench Verified, selon un résumé de ses résultats relayé par AINews » (1 article retenu sur 1)
- Sujet et acteurs
Éditeur du sujet : reflection. Noms qui rattachent une source au sujet : Beam.
Comment les sources sont entrées : story de départ (4), nommé par une source (2).
Écartés du sujet
- « Nvidia-backed Reflection prepares powerful open AI model » (extrait de lettre qui nomme reflection sans nommer l’objet du sujet en ouverture)
- « It’s been over a year since Reflection launched with us with big goals on coding (and hinted about their RL approach) » (extrait de lettre qui nomme reflection sans nommer l’objet du sujet en ouverture)
- « Positioning: Observers place Beam around GLM-5.2 level (iScienceLuvr) and below DSv4 Flash on some benchmarks (critique). Nathan Lambert groups it with Nvidia and Thinking Machines as strong US releases that still trail Chinese counterparts (Lambert). » (nom beam sans lien avec reflection)
- Porte de faits
Chaque phrase est relue contre ses sources par deux votes indépendants : 1 lot vérifié pour cette page, 0 sans réserve. 1 élément retiré en tout :
- 1 refusé par les votes
2 défauts relevés par les votes (une affirmation relevée par plusieurs votes compte une fois) :
- non étayé L’essentiel : « Le rapport technique, qui permettrait de vérifier les résultats, est seulement promis. »
- non étayé L’essentiel : « Reflection sort de l’ombre avec Beam, son premier modèle open-weight »
- Modules
Le planificateur en a choisi 4 selon la matière : L’essentiel, Ce qui a été annoncé, Chiffres clés, Chronologie.
Sans matière suffisante, donc absents : Pourquoi ça compte, Réactions, Comparatif, Les sources se répondent, Ce qu’on ne sait pas encore, En un coup d’œil.
Module proposé par le planificateur, « Accès et calendrier de disponibilité » : en attente d’une critique, non affiché.
- Étapes
Version 1 (création), 7 oct., 8 h 57 :1 min 09, 5 appels, 0,22 $
- Rassemblement du sujet6 sources tirées de 3 stories
- Plan des modules4 modules : L’essentiel, Ce qui a été annoncé, Chiffres clés, Chronologie · 1 appel Sonnet 5.5, 0,029 $
- Module proposémodule proposé « Accès et calendrier de disponibilité » : en attente d’une critique, non affiché
- Rédactiontitres et 4 modules rédigés · 1 appel Sonnet 5.5, 0,082 $
- Porte de faits1 lot vérifié en double vote, 0 accepté sans réserve · 2 appels Sonnet 5.5, 0,092 $
- DécisionsL’essentiel : 1 élément refusé par la porte, retiré
- Complément d’inventaire4 objets hors de l’inventaire ou creux (RL on ~10, OSS integrations are promised (Polozov)., Reflection introduces Beam, 500 GB300s for four weeks) : 0 puce rédigée · 1 appel Sonnet 5.5, 0,016 $
- Construite4 modules affichés
- Coût
0,22 $ en tout (5 appels, Sonnet 5.5), équivalent tarif API. Plafond codé : 0,60 $ et 16 appels pour la dernière version.