Номенклатура: чому зіставлення позицій — найскладніша частина автоматизації
Коли компанія вперше пробує автоматизувати введення документів, очікування зазвичай таке: сервіс прочитає накладну — і в обліковій системі зʼявиться готовий документ. Реальність трохи інша. Прочитати текст у файлі — найпростіша частина роботи. Найскладніше починається на позиціях.
У чому власне проблема
Постачальник пише назви товарів так, як йому зручно. У його накладній позиція виглядає, наприклад, так:
Папір А4 80г/м2 500арк Navigator
У вашому довіднику та сама позиція записана інакше:
Папір офісний А4, 500 аркушів
Людина бачить, що це одне й те саме, за секунду. Для програми це два різні рядки тексту. І таких розбіжностей у кожній накладній — половина позицій: скорочення, різний порядок слів, латиниця замість кирилиці, артикул всередині назви, одиниці виміру то «шт», то «штук», то «уп».
Додайте до цього, що один і той самий товар різні постачальники називають по-різному, а ваш власний довідник за роки роботи вже містить дублі — і стає зрозуміло, чому саме тут ламається більшість спроб «просто автоматизувати введення».
Як це працює технічно
Зіставлення позицій — це не пошук однакових рядків. Назва з документа і назва з довідника зводяться до порівнюваного вигляду: прибирається зайва пунктуація, уніфікуються одиниці виміру, розкриваються типові скорочення. Далі рахується схожість — наскільки два записи близькі за змістом, а не за написанням.
Результат — не «так» або «ні», а число. І далі все залежить від того, як із цим числом поводиться сервіс. Розумна логіка виглядає так:
- висока схожість — позиція підставляється автоматично, людина її не бачить;
- середня схожість — сервіс пропонує варіант, але позначає його як такий, що потребує підтвердження;
- низька схожість — позиція йде людині як нова, з можливістю створити її в довіднику або вручну вказати відповідник.
Ключове тут — саме середня зона. Сервіс, який мовчки підставляє все підряд, рано чи пізно занесе вам у документ не той товар, і знайдете ви це вже під час інвентаризації. Сервіс, який навпаки перепитує щодо кожної позиції, не економить нічого: ви так само сидите й клікаєте.
Чому це працює краще з часом
Кожне ваше підтвердження — це інформація. Якщо сервіс запамʼятовує, що «Папір А4 80г/м2 500арк Navigator» від цього постачальника — це саме ваш «Папір офісний А4», наступного разу питання вже не виникне. Через два-три місяці роботи з постійними постачальниками більшість позицій зіставляється без жодної участі людини — просто тому, що всі їхні варіанти написання вже відомі.
Тому оцінювати автоматизацію за першим тижнем не варто. Перший тиждень — найгірший з можливих: довідник відповідностей порожній, і підтверджувати доводиться багато. Показовий результат — це другий-третій місяць.
Що варто зробити зі свого боку
Автоматизація не лікує безлад у довідниках — вона його підсвічує. Кілька речей, які помітно покращують результат:
- Приберіть очевидні дублі. Якщо один товар записаний у довіднику тричі, сервіс щоразу вагатиметься, який із трьох варіантів обрати — і правильної відповіді тут просто немає.
- Тримайте одиниці виміру в порядку. «шт» і «штук» як дві різні одиниці для одного товару — типове джерело розбіжностей у кількостях.
- Не бійтеся зони підтвердження. Спокуса виставити поріг так, щоб «підставлялося все автоматично», зрозуміла — але саме вона перетворює економію часу на пошук помилок постфактум.
- Почніть з одного постачальника. Найбільший обсяг документів зазвичай дають два-три контрагенти. Налагодивши зіставлення для них, ви закриєте більшу частину рутини.
І головне питання при виборі сервісу
Коли вибираєте рішення для розпізнавання документів, найважливіше питання — не «який у вас відсоток точності». Відсоток можна порахувати як завгодно, і на ваших документах він усе одно буде іншим. Питати варто про інше:
- що сервіс робить із позицією, яку не вдалося впевнено зіставити;
- чи запамʼятовує він ваші підтвердження — і чи діють вони для всіх наступних документів;
- як розпізнані дані потрапляють в облікову систему: файлом, який ще треба завантажити руками, чи через API, тобто автоматично.
Останнє важливіше, ніж здається. Ідеально розпізнаний документ, який потім усе одно доводиться переносити в облік руками, економить рівно нічого.
DocaAI розпізнає первинні документи, зіставляє позиції з вашим довідником номенклатури і передає готові дані в облікову систему через API. Питання щодо інтеграції — support@docaai.com, технічна документація доступна на docaai.com/api-docs без реєстрації.
