Command Palette
Search for a command to run...
الأوراق البحثية
أوراق بحثية متطورة في مجال الذكاء الاصطناعي يتم تحديثها يوميًا لمساعدتك على مواكبة أحدث اتجاهات الذكاء الاصطناعي
أوراق بحثية

التعلم من أخطائك الخاصة: بناء مسارات تأملية مصغرة قابلة للتعلم للتقطير الذاتي

نماذج فعل العالم: مراجعة






























KaLM-Reranker-V1: سريع ولكن ليس تفاعلاً متأخراً لإعادة ترتيب المستندات المضغوطة
إعادة النظر في انحياز الانكماش أثناء التدريب المسبق لنماذج اللغات الكبيرة FP4: الأصل الهندسي، التأثير الجهازي، ووصفة UFP4
HydraHead: من اللامتماثلة الوظيفية على مستوى الرأس إلى التهجين المتخصص للانتباه
RadImageNet-VQA: مجموعة بيانات ضخمة للأشعة المقطعية والرنين المغناطيسي للإجابة على الأسئلة البصرية في الأشعة الطبية
تدريب وكلاء هندسة البرمجيات والمحققين باستخدام SWE-Gym
MAKIEVAL: إطار عمل تلقائي متعدد اللغات يعتمد على ويكي بيانات لتقييم الوعي الثقافي في نماذج اللغة الكبيرة
GeneralVLA-2: إعادة بناء واعٍ بالهندسة وذاكرة مُوجَّهة لتخطيط الروبوت
الحجب التأملي متعدد الجولات يُحفز الاستدلال في نماذج الانتشار القناعية
BrainG3N: أداة ترميز ثنائية الغرض لتوليد صور الرنين المغناطيسي للدماغ ثلاثي الأبعاد القابلة للتحكم
GateMem: تقييم حوكمة الذاكرة في agents متعددي الممثلين للذاكرة المشتركة
MemSlides: إطار عمل Agent المدفوع بالذاكرة الهرمية لتوليد الشرائح المخصصة مع المراجعة المحلية متعددة الجولات
PerceptionDLM: الإدراك المتوازي للمناطق باستخدام نماذج الانتشار اللغوي متعددة الوسائط
نماذج العالم الشيفرية للعب الألعاب العام
ما وراء لوحات المتصدرين الثابتة: الصدق التنبؤي لتقييم LLM Agents
S-Agent: الاستخدام المكاني للأدوات يُحفز الاستدلال للذكاء المكاني
Multi-LCB: توسيع LiveCodeBench إلى لغات برمجة متعددة
التعلم الروبوتي الوكيل المرحي
DragMesh-2: تفاعل يد ماهر مع الأجسام المفصلية واقعي فيزيائياً
مويبيوس: إطار عمل خفيف الوزن 0.2 مليار لاستكمال الصور بأداء على مستوى 10 مليار
التنفيذ الفعال: فك التشفير التخميني الذاتي الواعي بالنظام لعمليات تنفيذ التعلم المعزز
ثق بالمعلّم الصحيح: التلخيص الذاتي الواعي بالجودة لتأريض واجهة المستخدم الرسومية
تعزيز الاستدلال ثنائي المسار في النماذج اللغوية البصرية المكانية
تدخلات SAE غير موثوقة: استعادة السلوك المكبوت بعد التدخل
كايروس: حزمة نموذج العالم الأصلية للذكاء الاصطناعي الفيزيائي
غوافة: إطار عمل فعال وعالمي للتلاعب الجسدي
ما وراء الملاحظة الحالية: تقييم النماذج اللغوية الكبيرة متعددة الوسائط في ألعاب غير ماركوفية قابلة للتحكم
LifeSciBench: تقييم نماذج اللغات (LLMs) على مهام واقعية ومستوى خبراء في علوم الحياة
TRIAGE: الاستدلال الجدلي للتنبؤ القابل للتفسير بالمخاطر على السلاسل الزمنية الطبية ذات العينات غير المنتظمة باستخدام النماذج اللغوية الكبيرة
LectūraAgents: إطار عمل متعدد الـ Agent للتعلم التكيفي الشخصي المدعوم بالذكاء الاصطناعي والتعليم المتجسد
GameCraft-Bench: هل يمكن Agents بناء ألعاب قابلة للعب من البداية إلى النهاية في محرك ألعاب حقيقي؟