Strata exécute Qwen3.8-Flash-Next sur PC grand public
Strata est un nouveau moteur d'inférence open source conçu pour exécuter des modèles d'intelligence artificielle de grande envergure directement sur des ordinateurs grand public. Développé par la communauté GitHub, il permet de faire tourner Qwen3.8-Flash-Next, un modèle de 125 milliards de paramètres, sans dépendre de serveurs cloud. Cette architecture locale garantit une confidentialité totale des données tout en démocratisant l'accès à des capacités computationnelles précédemment réservées aux entreprises. Pour fonctionner, le projet exige une carte graphique NVIDIA série 20 à 50 ou AMD Radeon série 7000 à 9000, avec au moins 12 Go de mémoire vidéo, ainsi que 32 Go de RAM et 80 Go d'espace de stockage sur SSD. Strata optimise les ressources en répartissant intelligemment les calculs entre la mémoire vive et le GPU, un processus qui peut ralentir brièvement le système lors du premier lancement. Des tests sur RTX 5070 et RX 9070 XT indiquent des vitesses de génération comprises entre 40 et 94 tokens par seconde, selon la compression du modèle, tandis que la lecture des invites peut dépasser 2 600 tokens par seconde. Une carte dotée de 24 Go de VRAM devrait offrir des performances proches de 100 à 140 tokens par seconde. L'outil se distingue par sa compatibilité avec les interfaces API standards d'OpenAI et d'Anthropic, facilitant son intégration dans des écosystèmes existants. Il prend en charge l'analyse d'images et se connecte aux assistants de développement via un serveur MCP. L'installation automatisée pour Windows et Linux détecte le matériel, sélectionne la version du modèle adaptée à la RAM disponible et télécharge les fichiers nécessaires. Les développeurs peuvent même déléguer cette configuration à des assistants de codage. Sous licence MIT et s'appuyant sur des bibliothèques éprouvées, Strata représente une avancée pragmatique vers une IA décentralisée. En offrant une alternative gratuite, rapide et sécurisée aux solutions hébergées, il répond aux besoins croissants des professionnels et des particuliers souhaitant déployer des agents intelligents en toute autonomie. Les mises à jour et les retours d'expérience continuent d'enrichir le projet grâce à l'active participation de la communauté.
