Распознавание PDF8 мин чтенияОбновлено: 20 августа 2026

Распознавание сканированных ТЗ и смет в PDF с помощью компьютерного зрения (OCR)

Как извлекать таблицы, маркоразмеры и ГОСТы из сканов с перекосами, печатями и рукописными пометками.

TL
Экспертная редакция TenderLexМатериал проверен юристами и экспертами по закупкам 44-ФЗ / 223-ФЗ

Как извлекать таблицы, маркоразмеры и ГОСТы из сканов с перекосами, печатями и рукописными пометками.

1Нечитаемые сканы в ЕИС: намеренное усложнение или небрежность

Многие заказчики прикрепляют ТЗ в виде многостраничных сканов плохого качества, что затрудняет ручной просчет сметы.

2Нейросетевые модели LayoutLM для реконструкции таблиц

Современные зрительно-языковые модели восстанавливают геометрию строк и колонок даже при сильном наклоне листа.

3Обработка объединенных ячеек и переносов строк

Алгоритм связывает разорванные фразы описания технических характеристик в единое поле.

4Встроенный OCR в TenderLex

TenderLex распознает любые файлы до 100 Мб и отдает готовую таблицу Excel с вычлененными позициями.

Автоматизация поиска и аудита

Найдите надежных поставщиков по вашему ТЗ за 3 минуты

Загрузите техническое задание или спецификацию. ИИ TenderLex сопоставит номенклатуру, найдет прямые контакты отделов сбыта заводов и официальных дилеров по всей России и сформирует готовый запрос КП.

✓ Бесплатный тестовый доступ

Бесплатный пробный доступ при регистрации

Начните работу с TenderLex прямо сейчас

Загрузите спецификацию в веб-кабинет или запустите Telegram-бота TenderLex для мгновенного сбора прямых контактов поставщиков и анализа рисков.