• українська
    • English
  • українська 
    • українська
    • English
  • Увійти
Дивитися документ 
  • Головна
  • Матеріали конференцій ВНТУ
  • Науково-технічні конференції підрозділів Вінницького національного технічного університету (НТКП ВНТУ)
  • LV НТКП ВНТУ (2026)
  • НТКП ВНТУ. Факультет інформаційних технологій та комп'ютерної інженерії (2026)
  • Дивитися документ
  • Головна
  • Матеріали конференцій ВНТУ
  • Науково-технічні конференції підрозділів Вінницького національного технічного університету (НТКП ВНТУ)
  • LV НТКП ВНТУ (2026)
  • НТКП ВНТУ. Факультет інформаційних технологій та комп'ютерної інженерії (2026)
  • Дивитися документ
Сайт інституційного репозитарію ВНТУ містить роботи, матеріали та файли, які були розміщені докторантами, аспірантами та студентами Вінницького Національного Технічного Університету. Для розширення функцій сайту рекомендується увімкнути JavaScript.

Виявлення промо-елементів у відеорекламі соціальних мереж на основі OCR та LLM

Автор
Куліш, С. П.
Kulish, S. P.
Дата
2026
Metadata
Показати повну інформацію
Collections
  • НТКП ВНТУ. Факультет інформаційних технологій та комп'ютерної інженерії (2026) [253]
Анотації
Рекламні відео в соціальних мережах часто містять промо-елементи у вигляді накладеного тексту (знижки, ціни, дедлайни акцій, умови пропозиції), які є критичними для аналітики кампаній та коректного маркування контенту. Автоматичне вилучення таких даних ускладнюється короткочасністю появи тексту, різноманіттям шрифтів і мов, а також артефактами стиснення відео. Запропоновано підхід до структурованого маркування промо-атрибутів на основі поєднання OCR для вилучення текстових фрагментів з кадрів [1] та великих мовних моделей (LLM) для семантичної інтерпретації й нормалізації значень у контрольовану схему з інструкційним форматом відповіді [3], [4]. Описано компоненти конвеєра обробки, модель даних промо-сутностей і механізми валідації, що підвищують відтворюваність результатів.
 
Social media video ads frequently include promotional overlays (discounts, prices, deadlines, and offer conditions) that are essential for campaign analytics and reliable content labeling. Automated extraction is challenged by short on-screen durations, multilingual typography, and compression artifacts. This paper proposes a structured labeling approach that combines OCR for frame-level text extraction [1] with LLM-based semantic interpretation and normalization into a controlled schema via instruction-following inference [3], [4]. The processing pipeline, promo-entity data model, and validation mechanisms are described to improve reproducibility.
 
URI:
https://ir.lib.vntu.edu.ua/handle/123456789/54324
Відкрити
27964.pdf (181.9Kb)

Інституційний репозиторій

ГоловнаПошукДовідкаКонтактиПро нас

Ресурси

JetIQСайт бібліотекиСайт університетаЕлектронний каталог ВНТУ

Перегляд

Всі архівиСпільноти та колекціїЗа датою публікаціїАвторамиНазвамиТемамиТипВидавництвоМоваУДКISSNВидання, що міститьDOIЦя колекціяЗа датою публікаціїАвторамиНазвамиТемамиТипВидавництвоМоваУДКISSNВидання, що міститьDOI

Мій обліковий запис

Вхід

ISSN 2413-6360 | Головна | Відправити відгук | Довідка | Контакти | Про нас
© 2016 Vinnytsia National Technical University | Extra plugins code by VNTU Linuxoids | Powered by DSpace
Працює за підтримки 
НТБ ВНТУ