الأبحاث في مجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)
-
دمج التمثيلات المعتمدة على الهيكل العظمي لتصنيف أوضاع اليوغا بشكل موثوق باستخدام نماذج التعلم العميق
2026 | المؤلف: Mohammed Mohi-Ud-Din وآخرون | المجلة: Scientific Reports | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تقدم ورقة البحث دراسة شاملة حول تصنيف أوضاع اليوغا الآلي، مع تسليط الضوء على أهمية التعرف الدقيق على الأوضاع لمنع الإصابات المرتبطة بالوضعيات غير الصحيحة. يقدم المؤلفون مجموعة بيانات جديدة، “Yoga-16″، التي تعالج قيود مجموعات البيانات الحالية وتقييم منهجي لثلاثة هياكل تعلم عميق—VGG16 و ResNet50 و Xception—باستخدام ثلاثة أوضاع إدخال مختلفة: الصور الخام، وصور هيكل…
-
ترميز المصدر-القناة العميق متعدد القفزات مع تقطير التجزئة العميقة لاستعادة الصور المتوافقة دلاليًا
2026 | المؤلف: D. E. BERGSTROM وآخرون | المجلة: ICASSP 2026 – 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)في هذا البحث، يحقق المؤلفون في نقل الصور باستخدام إطار عمل الترميز المشترك العميق للمصدر والقناة (DeepJSCC) عبر قنوات الضوضاء البيضاء الغاوسية المضافة متعددة القفزات (AWGN). يقومون بتحسين زوج الترميز-فك الترميز DeepJSCC من خلال دمج وحدة تقطير الهاش العميق المدرب مسبقًا (DHD)، والتي تساعد في تجميع الصور بشكل دلالي. لا يحسن هذا النهج فقط جودة…
-
ما بعد تبديل الوجه: معيار إنساني رقمي قائم على الانتشار لاكتشاف التزييف العميق متعدد الوسائط
2026 | المؤلف: Jiaxin Liu وآخرون | المجلة: ICASSP 2026 – 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)يقدم هذا القسم نظرة عامة على التحديات التي تطرحها التطورات الأخيرة في تقنيات الديب فيك، لا سيما في مجال توليد البشر الرقميين. يقدم المؤلفون DigiFakeAV، وهو مجموعة بيانات شاملة للتزوير متعددة الوسائط تتكون من 60,000 فيديو تم إنتاجها بواسطة خمسة نماذج رائدة للبشر الرقميين. تتميز هذه المجموعة بتنوعها في الجنسية، لون البشرة، الجنس، والسيناريوهات، مما…
-
تعزيز تحديد المواقع الجغرافية لصور الفيضانات المستندة إلى الحشود عبر الانتباه الموجه بواسطة LLM
2026 | المؤلف: Fujun Xu وآخرون | المجلة: Computers Environment and Urban Systems | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تقدم البحث VPR-AttLLM، وهو إطار عمل غير مرتبط بنموذج مصمم لتعزيز التعرف على الأماكن البصرية (VPR) في صور الشوارع المجمعة من الجمهور، خاصة خلال الأحداث الطارئة مثل الفيضانات الحضرية. تكافح نماذج VPR التقليدية مع التشوهات البصرية والتحولات في المجال الموجودة في مثل هذه الصور، وغالبًا ما تفتقر إلى بيانات جغرافية موثوقة للاستجابة الفعالة للطوارئ. يدمج…
-
الكشف عن أهداف خطوط الأنابيب البحرية والكابلات بناءً على ميزات العمق لصورة السونار عالية الدقة
2026 | المؤلف: Zhenyun Du وآخرون | المجلة: PLoS ONE | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تتناول هذه الدراسة التحديات المتعلقة بكشف أهداف خطوط الأنابيب والكابلات تحت الماء في صور السونار الجانبي (SSS)، مع التركيز بشكل خاص على قضايا مثل الأداء الضعيف في الوقت الحقيقي، ومعدلات الكشف الخاطئ العالية، وصعوبات النشر. لتعزيز قدرات الكشف، تحسن الدراسة نموذج YOLO11n-seg من خلال دمج وحدات A2C2f و DSConv، التي تستفيد من ميزات صورة الهدف.…
-
StegaFFD: كشف تزوير الوجه مع الحفاظ على الخصوصية عبر رفع المجال الستيجانوغرافي الدقيق
2026 | المؤلف: Guoqing Ma وآخرون | المجلة: Machine Intelligence Research | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)في مجال كشف تزوير الوجه (FFD)، تعمل معظم النماذج الحالية على افتراض أن لديها وصولاً إلى صور الوجه الخام. ومع ذلك، في التطبيقات العملية، وخاصة ضمن أطر عمل العميل-الخادم، هناك خطر كبير من أن يتم اعتراض أو تسريب بيانات الوجه الخاصة بواسطة خوادم غير موثوقة. توفر طرق حماية الخصوصية التقليدية، مثل إخفاء الهوية، والتشفير، أو…
-
OOD-SEG: استغلال تقنيات الكشف عن خارج التوزيع لتعلم تقسيم الصور من تعليقات إيجابية متعددة الفئات نادرة
2026 | المؤلف: Zhenyun Du وآخرون | المجلة: Medical Image Analysis | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)في هذا البحث، يتناول المؤلفون تحديين كبيرين في تقسيم الصور الطبية باستخدام الشبكات العصبية العميقة: العملية الشاقة للحصول على تسميات تقسيم كاملة على مستوى البكسل وعدم قدرة خطوط تقسيم الصور التقليدية على اكتشاف بكسلات خارج التوزيع (OOD). يقترحون إطار عمل جديد للتقسيم، يسمى OOD-SEG، والذي يعمل ضمن نموذج التعلم الإيجابي غير المسمى (PU). يستخدم هذا…
-
ACT-R: مسارات الكاميرا التكيفية لإعادة بناء ثلاثية الأبعاد من منظور واحد
2026 | المؤلف: Yizhi Wang وآخرون | المجلة: 2026 International Conference on 3D Vision (3DV) | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تقدم البحث نهجًا جديدًا لتوليف المشاهد المتعددة من خلال التخطيط التكيفي للمشاهد، بهدف تعزيز كشف التداخل والاتساق ثلاثي الأبعاد في إعادة بناء ثلاثية الأبعاد من منظور واحد. تنتج الطريقة تسلسلًا من المشاهد بناءً على مسار كاميرا تكيفي (ACT) يقوم بتحسين رؤية المناطق المحجوبة، بدلاً من الاعتماد على إعداد كاميرا ثابت. من خلال استخدام نموذج انتشار…
-
Reflect3r: إعادة بناء ثلاثي الأبعاد من منظور واحد مدعوم بانعكاسات المرايا
2026 | المؤلف: Jing Wu وآخرون | المجلة: 2026 International Conference on 3D Vision (3DV) | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)في هذا القسم، يقدم المؤلفون نهجًا جديدًا لإعادة بناء ثلاثي الأبعاد من عرض واحد يتضمن بشكل فعال انعكاسات المرايا لتعزيز الدقة الهندسية. تعاني الطرق التقليدية من صعوبة التعامل مع الأسطح العاكسة، مما يؤدي غالبًا إلى تمثيلات غير دقيقة للمشهد. يقترح المؤلفون إعادة تفسير انعكاسات المرايا كوجهات افتراضية تم التقاطها بواسطة كاميرا محاكاة، مما يسمح بإطار…
-
نحو تعزيز الذاكرة المسؤول: استقصاء الاستخدامات المقصودة للواقع المعزز اليومي والذكاء الاصطناعي لعمليات الذاكرة
2026 | المؤلف: G. Wilson وآخرون | المجلة: Proceedings of the Augmented Humans International Conference 2026 | المجال: الرؤية الحاسوبية والتعرف على الأنماط (Computer Vision and Pattern Recognition)تبحث الدراسة في آثار دمج الواقع المعزز (AR) مع الذكاء الاصطناعي (AI) في الأجهزة اليومية، مع التركيز بشكل خاص على آثارها المحتملة على الذاكرة البشرية. مع تزايد انتشار نظارات الواقع المعزز، تؤكد الدراسة على ضرورة فهم تأثيرها على عمليات الذاكرة لتعزيز تحسين الذاكرة بشكل مسؤول. تم إجراء استبيان شمل 120 مشاركًا لتقييم احتمال استخدامهم لـ…
