سيريباس تنشر كتالوج نماذج الذكاء الاصطناعي
أعلنت منصة سيرابس عن تحديث كتالوج نماذج الاستدلال الخاص بها، متيحةً إمكانية الوصول إلى مجموعة مختارة من النماذج مفتوحة المصدر عبر نقاط النهاية العامة. وتتراوح الخيارات المتاحة حالياً بين نموذج OpenAI GPT OSS بـ120 مليار معامل، والذي يدعم سياقاً يصل إلى 131 ألف رمز بسرعة استدلال تقارب 3000 رمز في الثانية، ونموذج Qwen 3.8 بـ27 مليار معامل، ويدعم سياقاً يصل إلى 128 ألف رمز بسرعة تقارب 1500 رمز في الثانية. تأتي هذه الخيارات ضمن اشتراكات التجربة المجانية وخطط الدفع عند الاستخدام، مع وجود حدود على معدل الطلبات. وتوفر المنصة خيارات نقاط النهاية المخصصة للشركات التي تتطلب سعة محجوزة، وإنتاجية أعلى، وضمانات مستوى خدمة للإنتاج. وفي إطار سياسات كفاءة النماذج، أكدت سيرابس أنها لا تستضيف حالياً أي نماذج مُقتلعة على نقاط النهاية العامة، بل تلتزم بتقديم النسخة الأصلية غير المعدلة للحفاظ على أعلى معايير الجودة. وتستخدم التقنية ضغطاً انتقائياً للأوزان فقط لأغراض التخزين بمتغيرات 16 و8 و4 بت بما يتوافق مع معايير الصناعة، مع إجراء العمليات الحسابية للدقة الكاملة للأوزان الحساسة، بينما تظل التفعيلات، وآليات الانتباه، والذاكرة المؤقتة غير مضغوطة وبالدقة الكاملة. كما ألقت المنصة الضوء على جهودها البحثية في تقنيات التقليم مثل REAP، مؤكدةً أن النماذج الخاضعة لهذا البحث متاحة للأكاديميين على منصة Hugging Face فقط، ولن يتم دمجها في واجهات برمجة التطبيقات الإنتاجية الحالية دون إشعار مسبق. وتؤكد سيرابس التزامها بعدم تغيير بنية النماذج المُخدمة دون إعلام واضح، موضحةً أن أي تحديثات مستقبلية تتعلق بتقنيات الضغط ستُطلق كنقاط نهاية مستقلة تحمل أسماء تعكس طبيعة النموذج المعتمد، مما يمنح المطورين والباحثين حرية اختيار الإصدار الأنسب لمتطلبات عملهم. ويأتي هذا الإصدار في إطار سعي المنصة لتوفير بنية تحتية مرنة وعالية الأداء لتطبيقات الذكاء الاصطناعي، مع الحفاظ على الشفافية الكاملة بشأن أداء النماذج ومعالجتها للبيانات، ما يعزز ثقة المطورين في بيئة الحوسبة المتقدمة ويدعم التكامل السلس مع أنظمة الإنتاج التجاري.
