Command Palette
Search for a command to run...
الأوراق البحثية
أوراق بحثية متطورة في مجال الذكاء الاصطناعي يتم تحديثها يوميًا لمساعدتك على مواكبة أحدث اتجاهات الذكاء الاصطناعي
أوراق بحثية

K2-V2: نموذج لغوي ضخم مفتوح بالكامل بزاوية 360 درجة، مُعزز بالاستنتاج

VenusBench-GD: معيار رسومي متعدد المنصات شامِل للمهام المختلفة للتثبيت






























MCIF: معيار متابعة التعليمات متعدد الوسائط عبر اللغات من خلال المحاضرات العلمية
NitroGen: نموذج أساسي مفتوح للوكالات اللعبية الشاملة
خلايا H: حول الوجود، التأثير، والأصل للخلايا المرتبطة بالهلوسات في النماذج اللغوية الكبيرة
العالم هو لوحتك: رسم أحداث قابلة للترميز باستخدام صور مرجعية، ومدارات، ونصوص
الكيميائي: فتح الكفاءة في تدريب نماذج التوليد النصي-الصوري من خلال اختيار بيانات الميتا-مُشتق
العمق في أي مناظر دائرية: نموذج أساسي لتقدير العمق في المناظر الدائرية
إعادة التركيز التوليدية: التحكم المرن في التركيز غير المثالي من صورة واحدة
StereoPilot: تعلّم التحويل المُوحَّد والكَفِيِّ للصورة الثلاثية عبر الاحتمالات التوليدية
تنبؤ التضمين التالي يُحدث مُتعلّمين بصرية قويين
الذكاء الاصطناعي الوكيل: استكشاف آفاق التفاعل متعدد الوسائط
الرياضياتي الذكي كشريك في دفع التقدم في الاكتشاف الرياضي – دراسة حالة في نظرية التماثل
GenEval 2: معالجة الانزلاق المعياري في تقييم النص إلى الصورة
PrivateXR: حماية الهجمات على الخصوصية في الواقع المُوسَّع من خلال الخصوصية التفاضلية المُرشَدة بالذكاء الاصطناعي القابل للتفسير
التمايز الزمني والنتائج القضائية: تحليل تأثير التأخيرات الزمنية على عقوبات الجرائم في مقاطعة كوك (2020-2024)
يُحفِّز التعلُّم التكراري الميتا (Meta-RL) الاستكشاف في الوكلاء اللغويين
LLMCache: استراتيجيات تخزين مؤقت طبقية لتعزيز إعادة الاستخدام المُسرّع في استدلال النموذج التحويلي
OPENTOUCH: جلب اللمس الكامل لليد إلى التفاعل في العالم الحقيقي
VideoRewardBench: تقييم شامل للنماذج المتميزة متعددة الوسائط لفهم الفيديو
الروح: إ breathe الحياة في الإنسان الرقمي لرسوم متحركة متعددة الوسائط عالية الدقة على المدى الطويل
IF-Bench: تقييم وتحسين النماذج الكبيرة للغة والرؤية لصور الأشعة تحت الحمراء باستخدام الرؤية التوليدية
تقرير فني عن RecGPT-V2
بريزم المتجهات: تنشيط الرسوم المتجهة من خلال تجزئة البنية الدلالية
OpenDataArena: ميدان عادل ومحفوف بالشفافية لتقييم قيمة مجموعة بيانات ما بعد التدريب
اختبار الواقع المرئي: هل يمكن لفيديوهات ASMR المُولَّدة بواسطة الذكاء الاصطناعي خداع نماذج الرؤية واللغة (VLMs) والبشر؟
WorldPlay: نحو الاتساق الهندسي الطويل الأمد للنمذجة التفاعلية الزمنية الفعلية للعالم
MMGR: التفكير التوليدي متعدد الوسائط
العلوم الحدودية: تقييم قدرة الذكاء الاصطناعي على أداء المهام العلمية على مستوى الخبير
لوحة تحكم FACTS: معيار شامل لموثوقية النماذج اللغوية الكبيرة
نيمومترين-كاسكاد: التوسع في التعلم المُعزَّز المتسلسل لنموذج الاستدلال العام
تقرير فني عن KlingAvatar 2.0