إطلاق FLUX 3 كنموذج متعدد الوسائط للذكاء الاصطناعي
أعلنت جهة التطوير عن إطلاق نموذج FLUX 3 في المرحلة التجريبية المبكرة، في خطوة تمهد لجيل جديد من النماذج الأساسية متعددة الوسائط. يعتمد النموذج على معمارية Self-Flow الموحدة التي تدمج تعلم الصور والفيديو والصوت في إطار واحد، بهدف استخلاص تمثيل حقيقي للعالم المادي بدلاً من معالجة كل قناة حسية على حدة. يوضح فريق التطوير أن هذا النهج يسمح للنموذج بفهم العلاقات السببية، وقوانين الفيزياء، والديناميكيات الزمنية بدقة أعلى، حيث تعمل الوسائط المختلفة كملحات مكملة لواقع واحد. يمتاز FLUX 3 بقدرات توليد متقدمة تشمل إنشاء مقاطع فيديو بدقة 720 بكسل مدتها حتى عشرين ثانية مع صوت متزامن منطقي، إضافة إلى توليد الصور وتعديلها عبر مجموعة واسعة من الأنماط والنسب والدقة، مع تحسينات ملحوظة في دقة النصوص المتعددة اللغات. كما يمتد النموذج إلى مجال الذكاء الاصطناعي الفيزيائي والتحكم الحركي، حيث يُستخدم كعمود فقري للتنبؤ بالإجراءات الدقيقة، وهو ما يُطبق حاليًا عبر شراكة مع Mimic Robotics لتطوير نموذج FLUX-mimic، بالإضافة إلى اختبارات عملية في بيئات إنتاجية شراكة مع شركة Audi. أظهرت التقييمات الأولية تفوق النموذج بشكل ملحوظ على منافسيه في صناعة الفيديو، لا سيما في دقة تعبيرات الوجوه، ومزامنة الأصوات مع الأحداث البصرية، والانتقال السلس بين المشاهد. تتبع الشركة خطة إطلاق تدريجي على مدار الأسابيع والأشهر المقبلة، تتضمن فتح وصول مبكر مرحلي لكل قدرة مع التركيز على السلامة وجمع الملاحظات التقنية. يواصل الفريق تطوير الأبحاث الأساسية في ألمانيا والولايات المتحدة، مع السعي نحو دمج التنبؤ الإدراكي والحركي واللغوي في نموذج موحد واحد، مما يوسع آفاق التطبيقات من تحرير المحتوى التفاعلي إلى المحاكاة الروبوتية والأتمتة المتقدمة.
