Command Palette
Search for a command to run...
تقدير العمق
تقدير العمق هو تقنية في مجال رؤية الحاسوب تُستخدم لاستنتاج المعلومات الهيكلية ثلاثية الأبعاد لمشهد ما من صور أو مقاطع فيديو ثنائية الأبعاد. يهدف هذا الأسلوب إلى التنبؤ بقيمة العمق المقابلة لكل بكسل في الصورة، أي المسافة بين سطح الجسم والكاميرا. تُساعد معلومات العمق الآلات على فهم العلاقات المكانية داخل المشهد، وهي تقنية أساسية بالغة الأهمية في مجالات مثل إعادة البناء ثلاثي الأبعاد، وإدراك الروبوتات، والقيادة الذاتية، والواقع المعزز.
تطورت تقنيات تقدير العمق من الأساليب الهندسية التقليدية إلى أساليب التعلم العميق. اعتمدت الأساليب المبكرة بشكل أساسي على أجهزة استشعار مثل الرؤية المجسمة، والضوء المنظم، وتقنية الليدار للحصول على معلومات العمق من خلال حساب التباين أو تحديد المدى النشط، ولكن هذه الأساليب كانت تتطلب عادةً دعمًا إضافيًا من الأجهزة. مع تطور التعلم العميق، بدأ الباحثون باستكشاف أساليب تقدير العمق أحادية الرؤية التي تتنبأ بالعمق مباشرةً باستخدام صورة واحدة. في عام 2014، نشر الباحثون ديفيد إيجن وآخرون من جامعة نيويورك ورقة بحثية...التنبؤ بخريطة العمق من صورة واحدة باستخدام شبكة عميقة متعددة المقاييس تقترح هذه الورقة البحثية طريقةً للتنبؤ بالعمق أحادي الرؤية تعتمد على الشبكات العصبية الالتفافية متعددة المقاييس. ومن خلال دمج معلومات المشهد العامة مع خصائص التفاصيل المحلية، يمكنها التنبؤ بخرائط العمق من صورة واحدة، مما يوفر أساسًا هامًا للبحوث اللاحقة حول تقدير العمق باستخدام التعلم العميق.
تُعالج تقنيات تقدير العمق بشكل أساسي نقص البُعد المكاني في المعلومات المرئية ثنائية الأبعاد. وبحسب طريقة الإدخال، يُمكن تصنيف هذه المهمة عمومًا إلى تقدير العمق أحادي الرؤية، وتقدير العمق ثنائي الرؤية، وتقدير العمق متعدد المشاهد. تعتمد الطرق أحادية الرؤية كليًا على إدخال الصور العادية، حيث تستنتج العمق من خلال تعلم المؤشرات المرئية مثل حجم الجسم، والملمس، وعلاقات الحجب، وبنية المشهد. أما الطرق ثنائية الرؤية، فتستخدم علاقات اختلاف المنظر بين كاميرات متعددة لحساب المسافة المكانية.
في السنوات الأخيرة، وبفضل تطوير نماذج التدريب على مجموعات البيانات المختلطة واسعة النطاق ونماذج الأساس البصري، تحسّنت قدرة نماذج تقدير العمق أحادية الرؤية على التعميم دون الحاجة إلى تدريب مسبق بشكل ملحوظ، حتى أنها تستطيع تقديم تنبؤات عمق موثوقة نسبيًا عند مواجهة مشاهد لم يسبق لها مثيل أثناء التدريب. وقد طُبّقت التقنيات ذات الصلة على نطاق واسع في مجالات مثل القيادة الذاتية، وإدراك البيئة، وتوجيه الروبوتات، وإعادة بناء الأبعاد الثلاثية، والواقع الافتراضي، والواقع المعزز، مما يوفر دعمًا بالغ الأهمية للآلات لاكتساب وفهم العالم ثلاثي الأبعاد.
بناء الذكاء الاصطناعي بالذكاء الاصطناعي
من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.