طريقة تمويه الخلفية باستخدام شبكة CycleGAN موجهة بإدراك الصورة

YE Wu-jian ,  

LIN Zhen-yi ,  

LIU Yi-jun ,  

LIU Cheng-min ,  

摘要

في عمليات التمويه الخلفي باستخدام شبكات التوليد التنافسية الحالية، غالبًا ما يتم استخراج ميزات الصورة المدخلة بالكامل بلا تمييز، مما يجعل الشبكة غير قادرة على التمييز بين المقدمة والخلفية، وبالتالي يؤدي إلى تشوه الصورة. يقترح هذا البحث طريقة تمويه الخلفية باستخدام شبكة CycleGAN موجهة بإدراك الصورة، من خلال إدخال معلومات إدراك الصورة لتحسين أداء النموذج. تشمل معلومات إدراك الصورة معلومات الانتباه وعمق المجال، حيث تُستخدم الأولى لتوجيه الشبكة للتركيز على مناطق المقدمة والخلفية المختلفة، وبالتالي التمييز بينهما، بينما تُستخدم الثانية لتعزيز إدراك الهدف في المقدمة، مما يحقق تركيزًا ذكيًا فعالًا ويقلل من ظاهرة تشوه الصورة، مما يحسن تأثير تمويه الخلفية. من خلال تقليل خسارة التوليد التنافسية وخسارة الاتساق الدوري، يمكن تجنب فقدان الكثير من معلومات عمق المجال وتحسين جودة الصورة المولدة. تُظهر النتائج والبيانات التجريبية أن الطريقة المقترحة تستطيع التمييز بشكل فعال بين المقدمة والخلفية أثناء التمويه الخلفي وتحسن من تشوه الصورة، مما يجعل النتيجة أكثر واقعية. علاوة على ذلك، تم تقييمها بالمقارنة مع نتائج الطرق الحالية عبر استبيان. مقارنة بأفضل الممارسات الحالية، تتميز طريقة تمويه الخلفية باستخدام شبكة CycleGAN موجهة بإدراك الصورة بجودة أعلى للصور المولدة، وحجم نموذج أصغر، وسرعة توليد أفضل تصل إلى 56.10 ميجابايت و47 مللي ثانية على التوالي.

关键词

تمويه الخلفية;إدراك الصورة;شبكة CycleGAN;تركيز ذكي

阅读全文

以上内容由讯飞翻译自动生成,翻译内容仅供参考。对于因使用本网站翻译内容产生的相关后果,本网站不承担任何商业和法律责任。

The above content is generated by Large Model Translation. The translated content is for reference only. We do not assume any commercial or legal responsibilty for any consequences arising from the use of our website