الأبحاث في مجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)
-
استبيان حول طرق تعزيز البيانات الاصطناعية في رؤية الآلة
2024 | المؤلف: Alhassan Mumuni وآخرون | المجلة: Machine Intelligence Research | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تقدم الورقة مراجعة شاملة لتقنيات زيادة البيانات الاصطناعية التي تهدف إلى معالجة تحدي ندرة البيانات في مهام رؤية الكمبيوتر. تعتمد الطرق التقليدية على تدريب الشبكات العصبية التلافيفية العميقة (CNNs) باستخدام مجموعات بيانات صور تمثيلية على نطاق واسع؛ ومع ذلك، يمكن أن يكون الحصول على بيانات كافية لمهام معينة مشكلة. للتخفيف من ذلك، يتم استخدام تقنيات…
-
تخطيط المسار الأمثل بأقل مسافة وأقل وقت باستخدام خوارزميات التعلم الآلي المستوحاة من الطبيعة للطائرات بدون طيار المعطلة
2024 | المؤلف: Önder Tutsoy وآخرون | المجلة: IEEE Transactions on Intelligent Transportation Systems | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تقدم هذه القسم نظرة عامة على تطوير خوارزميات تخطيط المسار التكيفية للطائرات بدون طيار (UAVs)، وبشكل خاص الطائرات الرباعية، التي تعمل في بيئات ديناميكية مع احتمال حدوث أعطال في المحركات. يؤكد البحث على ضرورة وجود خوارزميات خالية من النموذج يمكنها استيعاب تشبع المحركات وقيود حركية وديناميكية متنوعة لضمان تطبيقات فعالة في الوقت الحقيقي. لمعالجة هذه…
-
مخطط تشفير الصور القائم على الفوضى باستخدام تشفير المنحنيات البيضاوية والخوارزمية الجينية
2024 | المؤلف: Sanjay Kumar وآخرون | المجلة: Artificial Intelligence Review | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)في سياق الاتصال الرقمي وأمان البيانات، يقدم هذا البحث طريقة جديدة لتشفير الصور تدمج خريطة فوضوية، وتحديداً خريطة قطة أرنولد، مع تشفير المنحنيات البيضاوية (ECC) وخوارزمية جينية (GA). تعزز الطريقة المقترحة التشفير من خلال أولاً خلط مواقع البكسلات باستخدام خريطة قطة أرنولد لإدخال الفوضى والعشوائية، تليها تشفير قيم البكسلات باستخدام ECC مع الاستفادة من المفاتيح…
-
مطابقة الميزات المحلية باستخدام التعلم العميق: استعراض
2024 | المؤلف: Shibiao Xu وآخرون | المجلة: Information Fusion | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تقدم هذه القسم نظرة شاملة على مطابقة الميزات المحلية في رؤية الكمبيوتر، مع تسليط الضوء على تطبيقاتها في استرجاع الصور، وإعادة بناء ثلاثية الأبعاد، والتعرف على الكائنات. تحدد فئتين رئيسيتين من طرق مطابقة الميزات المحلية: المعتمدة على الكاشف وغير المعتمدة على الكاشف. تشمل فئة المعتمدة على الكاشف أساليب مثل اكتشاف ثم وصف، والاكتشاف والوصف المشترك،…
-
إنقاذ الإنسان بمساعدة الطائرات المسيرة المعتمدة على الذكاء الاصطناعي في بيئات الكوارث: التحديات والفرص
2024 | المؤلف: Narek Papyan وآخرون | المجلة: Pattern Recognition and Image Analysis | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تستعرض هذه الدراسة تطبيق أنظمة الطائرات بدون طيار للكشف عن الأفراد، وخاصة من خلال تحديد صرخات البشر وإشارات الاستغاثة في سيناريوهات ما بعد الكوارث، مثل الزلازل وحرائق الغابات. تعتبر الطائرات بدون طيار، أو المركبات الجوية غير المأهولة (UAVs)، مفيدة في مهام البحث والإنقاذ نظرًا لقدرتها على تغطية مساحات واسعة بسرعة والوصول إلى مواقع قد تكون…
-
MINet: شبكة تفاعلية متعددة المقاييس للكشف عن الكائنات البارزة في الوقت الحقيقي لعيوب سطح الفولاذ المدلفن
2024 | المؤلف: Kunye Shen وآخرون | المجلة: IEEE Transactions on Industrial Informatics | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تقدم ورقة البحث نهجًا جديدًا للكشف الآلي عن عيوب السطح في الإنتاج الصناعي، مع معالجة قيود الطرق الحالية المعتمدة على البروز، والتي غالبًا ما تتضمن أحجام معلمات كبيرة وتكاليف حسابية عالية. لتعزيز كفاءة الكشف، يقدم المؤلفون وحدة تفاعلية متعددة المقاييس (MI) تستخدم الالتفاف العمقي (DWConv) والالتفاف النقطي (PWConv) لاستخراج الميزات المستقلة والدمج التفاعلي عبر مقاييس…
-
دراسة شاملة لأنظمة مراقبة سلوك السائقين باستخدام تقنيات الرؤية الحاسوبية وتعلم الآلة
2024 | المؤلف: Fangming Qu وآخرون | المجلة: Journal Of Big Data | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تقدم هذه القسم نظرة عامة على التقدم في أنظمة مساعدة السائق المتقدمة (ADAS) والمركبات المستقلة (AVs)، مع التأكيد على الدور الحاسم لمراقبة سلوك السائق من خلال مؤشرات فسيولوجية مثل تعبيرات الوجه، موضع اليد، ووضع الجسم. يناقش البحث نظام ذكاء اصطناعي (AI) مصمم لتنبيه السائقين إلى السلوكيات غير الآمنة عبر إشعارات صوتية في الوقت الحقيقي، مما…
-
الصور المزيفة: الاتجاهات الحالية والمستقبلية
2024 | المؤلف: Ángel Fernández Gambı́n وآخرون | المجلة: Artificial Intelligence Review | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تقدم الورقة نظرة شاملة على ظاهرة الديب فيك، مع التأكيد على التهديدات الكبيرة التي ت posed by advancements in Deep Learning (DL), Big Data, and image processing. هذه التقنيات قد مكنت من انتشار الديب فيك، التي يمكن أن تؤثر على الرأي العام، وتفاقم التوترات الجيوسياسية، وتعطل الأسواق المالية، وتساعد في الاحتيال، والتشهير، وسرقة الهوية. لمكافحة…
-
طريقة جديدة للكشف عن التزييف العميق تعتمد على البلوكشين باستخدام نماذج التعلم الفيدرالي والعميق
2024 | المؤلف: Arash Heidari وآخرون | المجلة: Cognitive Computation | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تتناول البحث التحدي المتزايد لملفات الفيديو المزيفة، التي تهدد مصداقية المحتوى الإعلامي بسبب التقدم في تقنيات التعلم العميق (DL). يقترح المؤلفون حلاً جديدًا يدمج التعلم الفيدرالي القائم على البلوكشين (FL) مع طرق معالجة الصور المتقدمة، باستخدام شبكات الكبسولة (CN) والشبكات العصبية التلافيفية (CNN) لاستخراج الميزات وتحسين التعميم. الابتكار الرئيسي هو تقديم تقنية تطبيع البيانات لإدارة…
-
تقييم معيار التعرف على الحركة الدقيقة: مجموعة بيانات، طرق، وتطبيقات
2024 | المؤلف: Dan Guo وآخرون | المجلة: IEEE Transactions on Circuits and Systems for Video Technology | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)في هذا البحث، يركز المؤلفون على التعرف على الميكرو-أكشن البشري القائم على الفيديو، مقدمين مجموعة بيانات Micro-Action-52 (MA-52)، التي تتميز بتنوع فئاتها الواسع وتمثيلها للجسم بالكامل. يقومون بتقييم تقنيات التعرف على الأفعال العامة الموجودة بشكل نقدي ويقترحون بنية جديدة لشبكة عصبية تلافيفية، تُسمى MANet. تعزز هذه البنية إطار عمل ResNet القائم من خلال دمج مكونات…
