الملخص

نقدّم نموذج Skywork UniPic، وهو نموذج تلقائي ارتباطي بحجم 1.5 مليار معلمة، يُوحّد قدرات فهم الصور، وإنشاء الصور من النصوص، وتحرير الصور ضمن معمارية واحدة، مما يُلغِي الحاجة إلى مُتّصِلات مخصصة للمهام أو وصلات بين الوحدات، ونُظهر أن الأنظمة متعددة الوسائط الصغيرة يمكنها تحقيق أداءً يُعدّ من أفضل الأداءات في المجال على الأجهزة التجارية. يحقق Skywork UniPic درجة GenEval قدرها 0.86، متفوّقًا على معظم النماذج الموحّدة الحالية؛ ويُحدث رقماً قياسياً جديداً في اختبار DPG-Bench للإGenerating المعقد، بدرجة 85.5؛ ويُسجّل 5.83 في GEditBench-EN و3.49 في ImgEdit-Bench بالنسبة لتحرير الصور؛ كما يمكنه إنشاء صور بحجم 1024 × 1024 باستخدام ذاكرة GPU أقل من 15 جيجابايت (مثلاً: RTX 4090). وتتميّز النموذج بثلاثة عناصر رئيسية: (1) استراتيجية ترميز منفصلة تعتمد على مشغل ترميز تلقائي ارتباطي مُقنّع لغرض التوليد، ومشغل SigLIP2 لغرض الفهم، مع تغذية كليهما إلى مشغل ترميز تلقائي ارتباطي مشترك؛ (2) جدول تدريب تدريجي وعَلَمِي بالدقة (resolution-aware)، يُدرّب النموذج من 256 × 256 إلى 1024 × 1024، مع إلغاء تجميد المعلمات ديناميكياً لموازنة القابلية والثبات؛ (3) مجموعات بيانات مُختارة بدقة بحجم 100 مليون، مُحسّنة بنموذج مكافأة مخصص لكل مهمة لتحسين أهداف التوليد والتحرير. وبإثبات أن التكامل متعدد الوسائط عالي الدقة لا يتطلب تكاليف موارد باهظة، يُشكّل Skywork UniPic نموذجاً عملياً لذكاء اصطناعي متعدد الوسائط عالي الجودة يمكن نشره وتطبيقه. يُتاح الكود والمعاملات للجميع عبر الرابط: https://huggingface.co/Skywork/Skywork-UniPic-1.5B.

ملف PDF المصدر عرض الكود

بناء الذكاء الاصطناعي بالذكاء الاصطناعي

من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.

البرمجة التعاونية باستخدام الذكاء الاصطناعي

وحدات GPU جاهزة للعمل

أفضل الأسعار

ابدأ عرض الأسعار

HyperAI Newsletters

اشترك في آخر تحديثاتنا

سنرسل لك أحدث التحديثات الأسبوعية إلى بريدك الإلكتروني في الساعة التاسعة من صباح كل يوم اثنين

مدعوم بواسطة MailChimp

الملخص

Command Palette

Skywork UniPic: نموذج موحّد تلقائيًا للفهم البصري وإنشاء الصور

Peiyu Wang Yi Peng Yimeng Gan Liang Hu Tianyidan Xie Xiaokun Wang Yichen Wei Chuanxin Tang Bo Zhu Changshi Li5 more

الملخص

بناء الذكاء الاصطناعي بالذكاء الاصطناعي

HyperAI Newsletters

Command Palette

Skywork UniPic: نموذج موحّد تلقائيًا للفهم البصري وإنشاء الصور

Peiyu Wang Yi Peng Yimeng Gan Liang Hu Tianyidan Xie Xiaokun Wang Yichen Wei Chuanxin Tang Bo Zhu Changshi Li5 more

الملخص

بناء الذكاء الاصطناعي بالذكاء الاصطناعي

HyperAI Newsletters

Command Palette

Skywork UniPic: نموذج موحّد تلقائيًا للفهم البصري وإنشاء الصور

Peiyu Wang Yi Peng Yimeng Gan Liang Hu Tianyidan Xie Xiaokun Wang Yichen Wei Chuanxin Tang Bo Zhu Changshi Li5 more

الملخص

بناء الذكاء الاصطناعي بالذكاء الاصطناعي

HyperAI Newsletters

Peiyu Wang Yi Peng Yimeng Gan Liang Hu Tianyidan Xie Xiaokun Wang Yichen Wei Chuanxin Tang Bo Zhu Changshi Li

Peiyu Wang Yi Peng Yimeng Gan Liang Hu Tianyidan Xie Xiaokun Wang Yichen Wei Chuanxin Tang Bo Zhu Changshi Li

Peiyu Wang Yi Peng Yimeng Gan Liang Hu Tianyidan Xie Xiaokun Wang Yichen Wei Chuanxin Tang Bo Zhu Changshi Li