Command Palette
Search for a command to run...
الأوراق البحثية
أوراق بحثية متطورة في مجال الذكاء الاصطناعي يتم تحديثها يوميًا لمساعدتك على مواكبة أحدث اتجاهات الذكاء الاصطناعي
أوراق بحثية

Nemotron 3 Nano: نموذج هجين ممبَا-ترانسفورمر مزيج الخبراء المفتوح والفعال للتفكير الوظيفي

ما وراء التذكّر: معيار ترتيب تعددية الوسائط للكشف عن التحيز في الشعبية في نماذج الرؤية واللغة






























DreaMontage: توليد فيديو واحد بالاعتماد على إطار محدد بشكل عشوائي
T2AV-Compass: نحو تقييم موحد لتحويل النص إلى الصوت والفيديو
TongSIM: منصة عامة لمحاكاة الآلات الذكية
Qwen-Image-Layered: نحو القابلية للتعديل التلقائية من خلال تحليل الطبقات
روبو سيف: حماية الوكلاء الماديّين من خلال منطق السلامة القابل للتنفيذ
تقييم واقعي لمراجعات سلامة الأدوية بواسطة النماذج اللغوية الكبيرة في الرعاية الأولية بخدمة الصحة الوطنية
تحليل موضوعي متعدد LLM باستخدام مقاييس موثوقية مزدوجة: دمج كوفا وشبه التشابه الدلالي لتأكيد البحث النوعي
الذكاء النشط في الأفاتار المرئية من خلال نمذجة العالم الدائرية المغلقة
FaithLens: اكتشاف وتفسير التضليل المتعلق بالولاء
SAM الصوتي: التجزئة بأي شيء في الصوت
تقرير تقني حول Step-DeepResearch
SpatialTree: كيف تتشعب القدرات المكانية في MLLMs
SemanticGen: توليد الفيديو في الفضاء المعنوي
التخطيط التلقائي للجراحة الإشعاعية الاستوائية باستخدام وكيل نموذج لغوي كبير يستند إلى التفكير مع مشاركة الإنسان
LongVideoAgent: الاستنتاج متعدد الوكلاء مع مقاطع الفيديو الطويلة
GenEnv: تطوير تآزري مُتَنَاسِقٌ مع صعوبة بين وكلاء LLM ومحاكيات البيئة
WorldWarp: انتشار الهندسة ثلاثية الأبعاد باستخدام تفتيت الفيديو غير المتزامن
LoGoPlanner: سياسة توجيه مبنية على التموضع مع هندسة بصرية واعية بالقياس
هل يمكن لـ LLMs تقدير صعوبات الطلاب؟ مواءمة الصعوبة بين الإنسان والذكاء الاصطناعي باستخدام محاكاة الكفاءة لتوقع صعوبة البنود
QuCo-RAG: قياس عدم اليقين من مجموعة التدريب المسبق لتوليد التوليد المدعوم بالاسترجاع الديناميكي
فرضية Prism: تحقيق التكامل بين التمثيلات الدلالية والتمثيلات البكسلية من خلال التشفير التلقائي الموحّد
Med-Banana-50K: مجموعة بيانات كبيرة متعددة الوسائط للتعديل الصوري الطبي الموجه بالنص
كاسكاد: طريقة عملية للانتباه النادر لاستدلال نماذج لغة كبيرة ذات سياق طويل
GLM-4.5: نماذج أساسية عاملة، وتحليلية، وبرمجة (ARC)
GroundingME: كشف الفجوة المرتبطة بالربط البصري في MLLMs من خلال التقييم متعدد الأبعاد
كلا من الدلالة وإعادة البناء مهمان: جعل مشفرات التمثيل جاهزة لإنشاء الصور من النص وتحريرها
4D-RGPT: نحو فهم مستوى المنطقة في الأبعاد الأربعة من خلال التقطيع الحسي
Seed-Prover 1.5: إتقان إثبات النظريات على مستوى البكالوريوس من خلال التعلم من الخبرة
عندما يلتقي التفكير بقوانينه
استكشاف الذكاء العام العلمي لـ LLMs باستخدام سير عمل متماشية مع العلماء