حوسبة NVIDIA السرية تمكن استنتاج AI آمن وعالي الأداء
كشف فريق هندسة الأداء لدى إنفيديا عن نتائج عملية لدمج الحوسبة الموثوقة في عمليات الاستدلال الإنتاجي للنماذج اللغوية الكبيرة، بهدف حماية السياقات الخاصة والبيانات الحساسة داخل آلات افتراضية مشفرة ومعالجات رسوميات مأمونة. تثير هذه البيئة الأمنية تحديات أداء جوهرية تتعلق بحركة الذاكرة، وتوقيت تنفيذ الخوارزميات، واستراتيجيات الاتصال متعدد المعالجات، مما يستلزم تكيفاً دقيقاً لأطر العمل مثل تينسور آر تي إل إل. لتقييم الأثر الفعلي للحوسبة الموثوقة بدقة، نفذت الاختبارات تحت ظروف محكومة على نظام دي جي إكس بّي200 المزود بثمانية معالجات بّي200، مع ثبات متغيرات النموذج والبنية التحتية وإعدادات التسلسل. أظهرت النتائج أن تمكين الحماية حافظ على ما بين 96.1% و98.2% من إنتاجية الرموز الإنتاجية مقارنة بالخط الأساسي، مع بقاء متوسط زمن كل رمز ضمن هامش ضيق يتراوح بين 1.2% و4.3% فقط. وقد تحقق هذا التوازن من خلال تعديلات معمارية مخصصة داخل الإطار البرمجي لمواكبة قيود التنفيذ الآمن. ركزت هذه التعديلات على ثلاثة مسارات تقنية. تم تعديل نقل البيانات من المضيف إلى الجهاز ليعمل عبر مخزن مؤقت مشفر برمجياً، نظراً لعدم قدرة البطاقة على الوصول المباشر إلى ذاكرة الآلة السرية، مما استبعد مزايا الذاكرة المثبتة التقليدية. كما تم استقرار مؤقت مكيّف النواة التلقائي الذي كان يتأثر بإشارات توقيت غير متسقة ناتجة عن أحداث سيودا في البيئات المحمية، مما منع اختيار استراتيجيات تنفيذ غير مثلى. بالإضافة إلى ذلك، تم إعادة هيكلة اتصال البيانات متعدد المعالجات للتكيف مع توقف ميزة النفي إل إس، مع الحفاظ على كفاءة التجميع عبر مسارات بديلة وتقليل تكاليف التسجيل والمزامنة. تؤكد إنفيديا أن اعتماد الحوسبة الموثوقة لا يلغي الحاجة إلى هندسة الأداء، بل يرفع من أهمية وعي الإطار البرمجي بالبيئات الآمنة. ينصح المهندسون بمعالجة تكوين الأمن وتحسين الاستدلال كمشروع هندسي متكامل، مع تشجيع الفرق على معايرة أحمال العمل الفعلية ومقارنة الأداء بين الوضعين قبل النشر. يفتح هذا التقدم آفاقاً أوسع لاعتماد عمليات الاستدلال الخاصة في القطاعات التنظيمية والمؤسسية، مع ضمان حماية الملكية الفكرية دون المساس بالكفاءة التشغيلية المطلوبة في البيئات الإنتاجية.
