يشغل ستاراتا نماذج الذكاء الاصطناعي محلياً على الحواسيب الشخصية
طرح مطورو مجتمع مفتوح المصدر محرك الاستدلال ستراتا الجديد، الذي يمكّن من تشغيل نموذج ذكاء اصطناعي ضخم يتكون من 125 مليار معلمة، وهو Qwen3.8-Flash-Next، مباشرة على أجهزة الحوسبة الاستهلاكية. يعتمد المشروع على تقنيات ضغط متقدمة طورتها مختبرات ISTA-DASLab وUkisAI وUnsloth، مع استغلال أجزاء من مكتبة llama.cpp، مما يسمح بتشغيل النموذج على بطاقات رسومية من فئات NVIDIA وAMD بسعة ذاكرة وصول عشوائي مرئية تبدأ من 12 جيجابايت، مع الحد الأدنى من 32 جيجابايت من ذاكرة النظام. يتميز المحرك بقدرته على توزيع الحمل الحراري والحسابي بذكاء عبر مكونات الجهاز، حيث تُحمل الأجزاء الأكثر نشاطا إلى الذاكرة المرئية، بينما تُخزن الباقي في ذاكرة النظام، مما يحاكي آلية عمل الخوادم المتخصصة ويحافظ على سرعة توليد النصوص بما يتراوح بين 44 إلى 94 رمزا في الثانية حسب حجم النموذج المضغوط وقوة العتاد المستخدم. تدعم النسخة الحالية أنظمة تشغيل ويندوز ولينكس، مع واجهة تحكم مدمجة تدعم إدخال الصور، وتتوافق مع معيار واجهة برمجة التطبيقات الخاص بشركتي OpenAI وAnthropic، مما يسهل دمج النموذج في تطبيقات الذكاء الاصطناعي ومساعدات البرمجة عبر خادم البرمجة النصية MCP. تتيح العملية تثبيتا أحادي النقر يدعم التثبيت التلقائي وكشف مواصفات العتاد واختيار النموذج الأنسب، مع إمكانية مشاركة النموذج عبر عدة بطاقات رسومية أو التحديث عبر سطر الأوامر دون إعادة التحميل. يعتمد المشروع على رخصة MIT وهو مجاني بالكامل، مع توفير وثائق مفصلة حول متطلبات التخزين بحوالي 80 جيجابايت من محركات الحالة الصلبة، وإعدادات الذاكرة، وحل الأعطال الشائعة. يمثل إطلاق ستراتا نقلة نوعية في مجال الحوسبة اللامركزية للذكاء الاصطناعي، حيث يزيل الحواجز التقنية والمالية التي كانت تمنع المستخدمين العاديين من الاستفادة من النماذج الضخمة محلياً. يضمن هذا الحل خصوصية تامة للبيانات نظرا لعدم مغادرة أي معلومات للخوادم الخارجية، ويدعم مجتمع المطورين توسيع نطاق الدعم التجريبي عبر أجهزة متنوعة. يحفز المشروع اتجاه الصناعة نحو تمكين الأجهزة الشخصية من استضافة نماذج إنتاجية عالية الكفاءة، مما يوسع آفاق التطبيقات المدمجة والبرمجيات المستقلة محليا.
