Transformers in image super-resolution: a brief review
Вантажиться...
Файли
Дата
Назва журналу
Номер ISSN
Назва тому
DOI
Анотація
З моменту появи глибокого навчання понад десять років тому, згорткові нейронні мережі стали домінуючим підходом до виконання завдань комп`ютерного зору. Однак модель Transformer, яка досягла значних успіхів у сфері обробки природної мови, все частіше застосовується до задач комп`ютерного зору, демонструючи співставну або навіть кращу ефективність. У статті розглянуто застосування моделі Transformer до задачі суперрезолюції. Пряме використання оригінальної моделі Transformer досягає результатів, які можна порівняти з сучасними згортковими нейронними мережами. Проте механізм самоуваги, що є основою моделі Transformer, має квадратичну обчислювальну складність щодо розміру вхідного зображення, що створює суттєві проблеми при обробці зображень високої роздільної здатності. Подальші дослідження значно покращили продуктивність, але ці покращення ще не є вичерпними. У статті наведено огляд та порівняльний аналіз цих досліджень.
Опис
Ключові слова
УДК
Тип документа
Мова
ISSN
Бібліографічний опис
Kozlov S., Kolesnytskyi O., Korolenko O., Zhukov A., Bondarenko D., Smetaniuk O., Kalizhanova A., Komada P. Transformers in image super-resolution: a brief review // Proc. of SPIE 13400 «Photonics Applications in Astronomy, Communications, Industry, and High Energy Physics Experiments 2024», 16 December 2024. 2024. 134000J–1-8. DOI: https://doi.org/10.1117/12.3054855.