| |
Ivanov, A. Text extraction from supermarket price tags in english and cyrillicwith open-source OCR [Текст] / A. Ivanov, V. Onyshchenko // Телекомунікаційні та інформаційні технології. – 2025. – № 4. – Р. 5-12. – DOI: https://doi.org/10.31673/2412-4338.2025.048901.
Цінники в супермаркетах часто містять дрібний, щільно форматований текст,представлений у складних візуальних умовах – з відблисками, низьким контрастом, нерівномірним освітленням.Такі фактори істотно ускладнюють читання тексту, особливо для людей із порушеннями зору, і знижуютьефективність загальновживаних OCR-систем, які зазвичай застосовуються в допоміжних технологіях. У ційстатті досліджується можливість використання легковагових, відкритих OCR моделей для отриманняточного та читабельного тексту зі щільно обрізаних зображень цінників на двох мова: англійській (латиниці)та українській (кирилиці).У дослідженні оцінюються три публічно доступні OCR-фреймворки — Tesseract, EasyOCR таPaddleOCR — відібрані завдяки їх широкій доступності, підтримці багатьох мов і сумісності з пристроями, щомають обмежені обчислювальні ресурси, включно зі смартфонами та вбудованими системами. Для забезпечення репрезентативної та різноманітної вибірки був сформований уніфікований датасет, зібраний із кількохвідкритих джерел і організований у підмножини з латинським текстом, кириличним текстом та змішаниммовним наповненням. Кожну з OCR-моделей було протестовано як у «чистих» умовах, так і за різноманітнихсинтетичних спотворень, що імітують реальні роздрібні сценарії, зокрема розмиття, погіршення контрастута перспективні деформації.Дана робота містить опис процесу побудови датасету, методів попередньої обробки, застосованих дляпідвищення якості зображень, методології оцінювання та метрик, використаних для вимірювання надійностірозпізнавання. |