Command Palette
Search for a command to run...
الأوراق البحثية
أوراق بحثية متطورة في مجال الذكاء الاصطناعي يتم تحديثها يوميًا لمساعدتك على مواكبة أحدث اتجاهات الذكاء الاصطناعي
أوراق بحثية

فكّر بصريًا، وتفنّن نصيًا: التآزر بين الرؤية واللغة في ARC

هارموني: مزج إنشاء الصوت والفيديو من خلال التآزر بين المهام المختلفة






























إنفيريكس: محرك استنتاج من الجيل التالي مبني على التمايز الكتلي للنماذج العالمية للمحاكاة
التعاون الضمني في الأنظمة متعددة الوكلاء
التقييم متعدد الوسائط للهياكل اللغوية الروسية
جذر: مُحسِّن مُتَوَزَّنٌ مُتَمَيِّزٌ لتدريب الشبكات العصبية
يُنتج التراكب مقياسًا عصبيًا قويًا
أفضل حدود الأخطاء المثلى لتعلم آليات التحويل التتابعي
هل يشجع التعلم المعزز بالفعل على قدرة التفكير في نماذج لغة كبيرة أبعد من النموذج الأساسي؟
لماذا لا تتذكّر نماذج الانتشار؟ الدور الذي تلعبه الت régularization الديناميكية الضمنية في التدريب
شبكات بعمق 1000 طبقة للتعلم الانتقائي الذاتي: يمكن أن يمكّن التوسع في العمق من إمكانات جديدة في تحقيق الأهداف
الانتباه المُرَقَّب لنماذج اللغة الكبيرة: غير الخطية، والشِّبَكَة، وخلوّ الانتباه من "الحفرة"
العقل الجماعي الاصطناعي: التجانس غير المحدود للنماذج اللغوية (وغيرها)
استراتيجيات التطور على نطاق الفائق
هل يُسهم الفهم في التوليد داخل النماذج المتعددة الوسائط الموحّدة؟ من التحليل إلى المسار المستقبلي
iMontage: توليد صور متعدد إلى متعدد موحد، متعدد الاستخدامات، وعالي الديناميكية
Agent0-VL: استكشاف الوكيل الذاتي المُتَطَوِّر للتفكير البصري-اللغوي المُدمَج بالأدوات
MedSAM3: التعمق في التجزئة بأي شيء مع المفاهيم الطبية
SteadyDancer: توليد حركة صورة إنسان متماسكة وموحدة مع الحفاظ على الإطار الأول
GigaEvo: إطار عمل مفتوح المصدر مُشَغَّل بمحركات LLMs وخوارزميات التطور
تفسيرات التوصية المراعية للدقة عبر تكامل المسار العشوائي
استخراج مفاهيم أحادية الدلالة مدركة للتفاعل في أنظمة التوصية
MSRNet: شبكة تكرارية متعددة المقاييس لكشف الكائنات المموهة
استخدام الأدوات الواعي بالميزانية يُمكن من التوسع الفعال لـ Agent
التعليمات داخل الفيديو: الإشارات البصرية كتحكم توليدي
DR Tulu: التعلم المعزز باستخدام قواعد التقييم المتطورة للبحث العميق
AICC: تحليل أدق لـ HTML لتحسين النماذج -- مدونة جاهزة للذكاء الاصطناعي بحجم 7.3T مبنية باستخدام محلل HTML قائم على النماذج.
UltraFlux: التصميم المشترك للبيانات والنموذج لتوليد الصور من النصوص بجودة عالية ودقة 4K أصلية عبر نسب أبعاد متنوعة
DeCo: انتشار البكسل منفصل التردد لتوليد الصور من الطرف إلى الطرف
AutoEnv: بيئات مؤتمتة لقياس تعلّم Agent عبر البيئات
الذاكرة الوكيلية العامة عبر البحث العميق
VIRAL: رؤية من المحاكاة إلى الواقع على نطاق واسع للحركة والتحكم البشري في الروبوتات البشرية