HyperAIHyperAI

Command Palette

Search for a command to run...

LLM
IA Générative

Reflection lance Beam, modèle IA open-source de 501 Md

Reflection AI, société basée à Brooklyn fondée en 2024 par d’anciens chercheurs de DeepMind, a officiellement lancé Beam, son premier modèle d’intelligence artificielle ouvert de grande envergure. D’une taille de 501 milliards de paramètres avec 23 milliards d’unités actives grâce à une architecture de mélange d’experts, le modèle textuel intègre une fenêtre de contexte d’un million de jetons. Son développement repose sur un préentraînement sur 23,8 billions de jetons de haute qualité, suivi d’une phase majeure d’apprentissage par renforcement à haute capacité de calcul. Cette dernière a mobilisé 10 500 puces NVIDIA GB300 pendant quatre semaines, générant plus de 100 millions de simulations pour affiner ses capacités de raisonnement, de programmation et de tâches agentes. L’entreprise affirme que Beam délivre des performances équivalentes aux modèles ouverts chinois leaders comme GLM-5.2 et Qwen 3.8-Max, tout en consommant trois à quatre fois moins de ressources inférentielles. Cette optimisation vise à réduire significativement le coût par jeton, positionnant Beam comme une solution industrielle robuste pour les entreprises et les développeurs. Le processus d’entraînement a également intégré des mécanismes avancés d’alignement et de sécurité, combinant distillation multi-professeurs et données adversariales pour limiter les hallucinations et garantir une interaction transparente. Ce lancement s’inscrit dans une stratégie de croissance ambitieuse. Reflection a levé environ 4,7 milliards de dollars auprès d’investisseurs institutionnels majeurs, dont Nvidia et Sequoia Capital, et a récemment sécurisé des contrats d’une valeur supérieure à 7 milliards de dollars pour accéder aux puces NVIDIA GB300 jusqu’en 2029. La firme entend concurrencer à la fois les laboratoires propriétaires et les modèles ouverts asiatiques, en visant spécifiquement le marché des usines d’intelligence artificielle. Ce concept permettra aux institutions et aux États de former des systèmes personnalisés sur leurs propres données confidentielles. Un accès anticipé est actuellement disponible via une liste d’attente. Les poids du modèle, le rapport technique complet et les outils de développement seront publiés courant du mois sous licence Apache 2.0, avec une distribution via des partenaires cloud et des intégrations natives dans des bibliothèques open source. Cette initiative marque une étape significative dans la compétition des modèles ouverts, en privilégiant l’efficacité du calcul et la viabilité commerciale face aux géants du secteur.

Liens associés