Sofpact field note

Документно AI или генеративно AI? Изберете архитектурата, не рекламата

Редакционна схема на документен процес от изходен файл през извличане и валидация до действие

„Ще пуснем AI върху документите“ звучи като едно решение. То всъщност е поне пет отделни решения, всяко от които има различна цена на грешката. Организациите, които обединяват петте в едно, обикновено откриват това чак когато трябва да обяснят пред одитор откъде е дошло едно число.

Изборът не е между „стар“ и „нов“ подход. Той е между архитектури с различна степен на несигурност, приложени към стъпки с различна степен на последици. Един и същ документен процес често има нужда и от двете.

Разложете документната задача, преди да изберете модел

1. Приемане и контрол на файла

Откъде идва документът, как се проверява целостта му, кой има достъп до него и къде се съхранява. Тази стъпка е изцяло детерминистична и не изисква никакъв модел. Тя обаче определя дали по-късно ще можете да докажете, че анализираният документ е същият, който е бил получен.

2. OCR и разчитане на оформлението

Превръщане на изображение в текст със запазена позиция. Тук качеството е измеримо и грешките са от познат тип: сливане на колони, объркани таблици, слаб резултат при ръкопис или при сканиране с ниска разделителна способност. Кирилицата заслужава отделна проверка — резултат, отчетен върху латиница, не се пренася автоматично.

3. Извличане по схема

Изваждане на определени полета: номер на договор, дата, страна, сума, валута. Схемата е ограничението, което прави изхода проверим. Ако полето трябва да е дата, то може да бъде валидирано като дата. Това е стъпката, която повечето организации подценяват и която дава най-голяма част от практическата стойност.

4. Интерпретация

Сравняване на клаузи, обобщаване на контекст, класифициране на нееднородна кореспонденция, предлагане на отговор. Тук генеративният модел е на място, защото езикът и оформлението варират. Тук е и цялата несигурност: моделът може да пропусне уговорка, да свърже несвързани пасажи или да формулира твърдение, което документът не подкрепя.

5. Работен процес и действие

Какво се случва с резултата: одобрение, плащане, отказ, ескалация. Последиците от грешка се определят тук, а не в модела. Една и съща грешка при извличане е незначителна, ако води до преглед, и съществена, ако води до автоматично плащане.

Използвайте хибриден път за работата с последици

Практическото правило е просто: там, където изходът има правни или финансови последици, използвайте схема и валидация за стойностите и генеративен модел само за интерпретация, която човек ще прегледа. Не позволявайте на генеративния модел да произвежда числа, които влизат директно в изчисление, без да са проверени срещу извлечено поле.

Този хибриден подход обикновено е и по-евтин. Генеративната обработка на цял документ струва повече от целево извличане, а точността на извличането по схема при структурирани полета остава по-висока при значително по-нисък разход.

Документите са данни със задължения

Ако документите съдържат лични данни — а договорите, кореспонденцията и досиетата почти винаги съдържат — приложим е Общият регламент относно защитата на данните в пълен обем: основание за обработване, минимизиране, срокове за съхранение, права на субектите. Насоките на Комисията за защита на личните данни и на Европейския комитет по защита на данните са отправната точка при оценка на въздействието.

Отделен въпрос е трансграничното изпращане. Ако документите се обработват от външен доставчик, местоположението на обработката, подизпълнителите и това дали вашето съдържание се използва за обучение на модели са договорни въпроси, които трябва да бъдат уредени преди първия качен файл, а не след него.

Когато документът има удостоверителна стойност, Регламент (ЕС) № 910/2014 определя рамката за електронен подпис и електронни удостоверителни услуги. Генериран текст, поставен върху подписан документ, не наследява неговата доказателствена сила.

Двуезичните документи са норма, а не изключение

В повечето организации, работещи в региона, документният поток не е на един език. Договорът е на български с приложения на английски, кореспонденцията сменя езика по средата, имената на контрагенти се изписват ту на кирилица, ту на латиница, а сумите следват различни конвенции за десетичен знак и разделител на хилядите. Това не е граничен случай — това е обичайният случай.

Последиците са конкретни. Транслитерацията на едно и също име може да породи два записа, които системата третира като различни лица. Дата, записана като 03/04/2026, означава различно нещо според конвенцията. Модел, който е бил оценен само върху документи на един език, ще изглежда точен и ще греши систематично точно там, където документът смесва двата.

Практическото решение е да се третира езикът като поле, а не като фон. Определете езика на ниво документ и на ниво раздел, нормализирайте имената и датите на изричен етап преди интерпретацията, и включете смесените документи в оценъчния набор в дела, в който се срещат реално. Ако петнадесет процента от входящия поток е смесен, а оценъчният набор не съдържа нито един такъв документ, отчетената точност описва система, различна от тази, която ще работи.

Изградете оценъчния набор преди интерфейса

Оценъчният набор е активът, който остава, когато доставчикът се смени. Той се състои от реални документи от вашия поток, включително трудните: лошо сканирани, на два езика, с нестандартно оформление, с ръкописни добавки, с попълнени на ръка полета. Към всеки от тях трябва да има верен отговор, определен от човек, който познава материята.

Сто добре подбрани документа дават повече информация от десет хиляди типични. Целта не е да се измери средното представяне, а да се открие къде системата се проваля и дали проваленията са от вид, който процесът може да поеме.

Разделяйте източник, извод и решение

Всеки съществен изход трябва да сочи към мястото в изходния документ, от което произлиза — страница, ред, поле. Това не е удобство за потребителя; това е разликата между система, която може да бъде одитирана, и система, която може само да бъде вярвана.

Законодателният акт за изкуствения интелект въвежда и задължения за прозрачност при взаимодействие с AI система и при генерирано съдържание. Ако генериран текст напуска организацията, въпросът кой и как обозначава произхода му трябва да има отговор преди пускането.

Проектирайте прегледа според последиците

Пълен преглед на всичко не е контрол — той е разход, който с времето се превръща във формалност. Полезната схема е степенувана: автоматично приемане при висока увереност и ниска последица, задължителен преглед при висока последица независимо от увереността, и извадков контрол върху автоматично приетите, изпълняван от някой, който не е участвал в първоначалната обработка.

Функциите Measure и Manage на NIST AI Risk Management Framework дават използваема структура за това как се следи и как се реагира, дори когато самата рамка не е задължителна.

Планирайте промяната и провала

Моделите се променят без предизвестие, а промяната рядко е обявена като промяна в поведението. Затова оценъчният набор трябва да се пуска периодично, а не еднократно при внедряването. Определете предварително какъв спад в резултата води до връщане към ръчна обработка и кой има право да вземе това решение.

Подгответе и обратния път. Ако системата спре, документите продължават да пристигат. Организация без работеща ръчна алтернатива не е автоматизирала процес, а е поела зависимост. Указанията на Службата на ЕС по въпросите на изкуствения интелект се развиват и това също е промяна, която трябва да бъде следена.

Какво този подход не може да направи

Никаква архитектура не прави документа по-верен, отколкото е. Ако изходният договор е двусмислен или сканът е нечетим, най-добрата система ще произведе уверено формулирана несигурност. Хибридният подход също не премахва нуждата от хора с познание по материята — той намалява обема на работата им, но увеличава изискването към преценката им.

Ако избирате архитектура за документен процес с реални последици, започнете с доказване на подхода върху вашите документи.

Тази публикация е адаптирана от английския оригинал. При различие английската версия е меродавна.