<link rel="stylesheet" href="styles.f3b1fba60ec7970c.css">

Transformers in image super-resolution: a brief review

Анотація

З моменту появи глибокого навчання понад десять років тому, згорткові нейронні мережі стали домінуючим підходом до виконання завдань комп`ютерного зору. Однак модель Transformer, яка досягла значних успіхів у сфері обробки природної мови, все частіше застосовується до задач комп`ютерного зору, демонструючи співставну або навіть кращу ефективність. У статті розглянуто застосування моделі Transformer до задачі суперрезолюції. Пряме використання оригінальної моделі Transformer досягає результатів, які можна порівняти з сучасними згортковими нейронними мережами. Проте механізм самоуваги, що є основою моделі Transformer, має квадратичну обчислювальну складність щодо розміру вхідного зображення, що створює суттєві проблеми при обробці зображень високої роздільної здатності. Подальші дослідження значно покращили продуктивність, але ці покращення ще не є вичерпними. У статті наведено огляд та порівняльний аналіз цих досліджень.

Опис

УДК

Тип документа

Мова

ISSN

Бібліографічний опис

Kozlov S., Kolesnytskyi O., Korolenko O., Zhukov A., Bondarenko D., Smetaniuk O., Kalizhanova A., Komada P. Transformers in image super-resolution: a brief review // Proc. of SPIE 13400 «Photonics Applications in Astronomy, Communications, Industry, and High Energy Physics Experiments 2024», 16 December 2024. 2024. 134000J–1-8. DOI: https://doi.org/10.1117/12.3054855.

Схвалення

Рецензія

Доповнено

Цитується в