Pendant que tout le monde regarde les modèles fermés comme GPT ou Claude, la vraie bataille pour l'avenir de l'IA se joue dans un autre coin du ring : les modèles à poids ouverts, que n'importe qui peut télécharger et exécuter. Depuis près de deux ans, la Chine domine ce terrain : DeepSeek, Qwen d'Alibaba et Kimi K3 de Moonshot devancent systématiquement leurs rivaux occidentaux en qualité open source. Le 5 octobre, la start-up new-yorkaise Reflection AI a tenté d'inverser la tendance avec un nouveau modèle baptisé Beam.
Reflection AI a été fondée en 2024 par Misha Laskin et Ioannis Antonoglou, deux anciens chercheurs de Google DeepMind. En un peu plus d'un an, l'entreprise a levé environ 4,7 milliards de dollars et a été valorisée à 25 milliards en avril. Parmi ses investisseurs figurent Nvidia, Sequoia et Lightspeed — un soutien qui n'a rien d'un hasard, Nvidia ayant tout intérêt à ce que les modèles ouverts performants ne naissent pas uniquement à Pékin.
Beam est un modèle à mélange d'experts (MoE) de 501 milliards de paramètres au total, dont seulement 23 milliards s'activent à la fois, entraîné sur 23 800 milliards de tokens avec une fenêtre de contexte d'un million de tokens. Selon les propres tests de Reflection, Beam égale GLM-5.2 de la chinoise Z.ai — l'un des modèles ouverts les plus puissants du marché — tout en utilisant trois à quatre fois moins de calcul. L'entreprise affirme aussi surpasser le modèle multimodal Inkling de Thinking Machines Lab sur plusieurs benchmarks de code.
Une réserve de taille s'impose : aucun de ces chiffres n'a encore été vérifié de façon indépendante. Reflection prévoit de publier les poids et la documentation technique plus tard en octobre, ce qui permettra à des développeurs extérieurs de tester ces affirmations sur leurs propres charges de travail.
Pourquoi cela compte au-delà des chiffres : les entreprises et les gouvernements privilégient de plus en plus les modèles ouverts, car ils peuvent les faire tourner sur leur propre infrastructure plutôt que d'envoyer des données sensibles à un tiers. Mais tant que les laboratoires chinois produiront les modèles ouverts les plus puissants, ce sont eux qui fixeront la norme que le reste du monde devra suivre — y compris les banques et administrations réticentes à envoyer leurs données en Chine. Beam est un pari : que les États-Unis puissent aligner un concurrent sérieux sur les poids ouverts, et pas seulement gagner la course aux modèles fermés.
Reflection a déjà de la puissance de calcul réservée pour la suite : un accord avec SpaceX pour l'accès aux puces Nvidia GB300, évalué à plus de 6 milliards de dollars, et un contrat d'environ 1 milliard avec le fournisseur cloud Nebius. L'entreprise affirme entraîner déjà un modèle plus grand pour sa prochaine sortie.



