Reflection AI lance Beam, le modèle ouvert qui défie les géants chinois à moindre coût

Reflection AI, la start‑up new‑yorkaise fondée en 2024 par deux anciens chercheurs de Google DeepMind, a présenté son premier modèle ouvert, baptisé Beam. Selon la société, ce modèle de 501 milliards de paramètres offrirait des performances similaires aux meilleurs modèles chinois tout en consommant beaucoup moins de ressources de calcul. Cette annonce intervient alors que la course aux alternatives occidentales aux modèles fermés d’Anthropic et d’OpenAI s’intensifie.

Un modèle ambitieux aux performances prometteuses

Beam se décrit comme un modèle « text‑only » de type mixture‑of‑experts, entraîné grâce à un apprentissage par renforcement à haute intensité de calcul. Avec 23 milliards de paramètres actifs, il aurait été pré‑entraîné sur 23,8 trillions de tokens et dispose d’une fenêtre contextuelle de 1 million de tokens. La société affirme que, sur des benchmarks avancés de raisonnement, Beam atteint des scores comparables à ceux du modèle GLM‑5.2 de Z.ai, qui possède 744 milliards de paramètres au total et 40 milliards de paramètres actifs.

Bien que ces performances n’aient pas encore été vérifiées de façon indépendante, Reflection AI indique que Beam surpasse les modèles ouverts occidentaux actuels tout en nécessitant « 3 à 4 fois moins de calcul d’inférence ». Le modèle serait ainsi particulièrement adapté aux tâches de raisonnement, de programmation et d’exécution d’agents autonomes.

Une architecture mixte et des coûts réduits

Le choix d’une architecture mixture‑of‑experts permet à Beam d’activer uniquement une fraction des paramètres lors de chaque requête, ce qui explique la réduction du coût d’inférence. Cette approche contraste avec les modèles monolithiques où l’ensemble des paramètres est mobilisé à chaque exécution. En pratique, cela se traduit par une consommation énergétique moindre et des temps de réponse plus courts, deux critères essentiels pour les entreprises cherchant à déployer l’IA à grande échelle.

Pour soutenir cette ambition, Reflection AI a conclu cet été des accords d’une valeur supérieure à 7 milliards de dollars avec SpaceX et Nebius, garantissant l’accès aux puces Nvidia GB300 jusqu’en 2029. Ces investissements en matériel de calcul visent à sécuriser la capacité de formation de modèles de nouvelle génération, tout en offrant aux clients la possibilité de créer leurs propres « usines d’IA » locales.

Le positionnement de Reflection AI sur le marché

Reflection AI se place à la fois face aux modèles fermés d’Anthropic et d’OpenAI et aux solutions ouvertes provenant de Chine, comme DeepSeek, Qwen ou Z.ai. Son concurrent le plus proche aux États‑Unis serait Inkling, le modèle multimodal lancé en juillet par le Thinking Machines Lab de Mira Murati. Selon les benchmarks internes de Reflection, Beam dépasse Inkling sur quatre tests de codage, bien que ce dernier propose également des capacités multimodales que Beam ne possède pas.

En termes de financement, la société a levé environ 4,7 milliards de dollars auprès d’investisseurs tels que Nvidia, Sequoia Capital et Lightspeed Venture Partners, portant sa valorisation pré‑money à 25 milliards de dollars. Cette enveloppe financière permet à Reflection de poursuivre son objectif de créer une alternative occidentale robuste aux modèles chinois, tout en restant compétitive sur le plan des coûts.

Enjeux et perspectives pour les entreprises et les nations

Reflection AI mise sur le concept d’« usine d’IA » : un produit permettant aux institutions publiques ou privées de former des modèles sur leurs propres données, garantissant ainsi souveraineté et confidentialité. Un partenariat pilote a déjà été lancé avec le groupe sud‑coréen Shinsegae, illustrant l’intérêt des acteurs souverains pour ce type de solution.

Les poids et les spécifications techniques de Beam seront rendus publics dans le courant du mois, avec une distribution prévue via les hyperscalers, les néoclouds et les bibliothèques open source. Cette ouverture vise à stimuler l’écosystème open‑weight, à la fois pour les développeurs et les entreprises souhaitant intégrer l’IA sans dépendre d’un fournisseur unique.

Si les performances annoncées se confirment, Beam pourrait devenir un « workhorse » pour les secteurs public, les grandes entreprises et les développeurs, offrant une alternative à la fois puissante et économique aux solutions propriétaires. La capacité à réduire le coût d’inférence tout en maintenant un haut niveau de performance représente un atout majeur dans un contexte où les dépenses en IA continuent de croître rapidement.

Perspectives à moyen terme

À mesure que les gouvernements et les fonds d’investissement recherchent des solutions d’IA souveraines, le modèle ouvert de Reflection AI pourrait bénéficier d’une adoption accélérée, notamment dans les domaines de la finance, de la santé et de la défense. La combinaison d’un financement solide, d’un accès privilégié aux dernières puces Nvidia et d’une stratégie de distribution large positionne l’entreprise comme un acteur clé de la prochaine génération de modèles d’intelligence artificielle.

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *