— В этом проекте нам надо хорошо распознавать документы. — А что значит «хорошо»? — Сейчас же везде ИИ. Я загружаю документ в чат, и он мне всё правильно отвечает. Нам надо так же для всех документов. Такие диалоги я всё чаще слышу при обсу...
— В этом проекте нам надо хорошо распознавать документы.
— А что значит «хорошо»?
— Сейчас же везде ИИ. Я загружаю документ в чат, и он мне всё правильно отвечает. Нам надо так же для всех документов.
Такие диалоги я всё чаще слышу при обсуждении новых проектов.
А значит, ситуация, когда со стороны бизнеса звучит вопрос «почему сложно сделать так же, как в чате — только на все документы», — уже обыденность.
Я много лет занимаюсь промышленными системами обработки и распознавания документов. Когда система «смогла» на одном документе, я стараюсь не очароваться этим и не смотреть как на магию. Я стараюсь думать, как это сделать потоком.
Современные модели ИИ действительно почти стирают грань между вопросом к текстовому документу и вопросом к изображению. Выглядит как магия.
Но надо разобраться, что делать с документами, когда магии не случилось. Попробую обобщить подходы к организации обработки потока документов и поразмышлять, о чем лучше не забывать, проектируя такой поток.
