Если в PDF можно выделить текст, для начала подойдёт бесплатный BentoPDF: он извлекает таблицы в книгу XLSX прямо в браузере. Если страница — фотография или скан, понадобится распознавание текста — OCR. А после любого переноса откройте книгу и сверьте строки: надпись «готово» сама по себе ничего не говорит о полноте таблицы.

Мы столкнулись с этим на вымышленной смете. Из одного PDF BentoPDF перенёс только заголовки, а из варианта с линиями между ячейками — все суммы. Ниже покажем оба файла и объясним, когда стоит выбрать другой способ.

Сначала посмотрите, что находится в PDF

Откройте файл в привычном просмотрщике и попробуйте выделить название одной строки, затем скопировать его в заметку. Если получились буквы, в этом месте есть текст. Если выделяется целая картинка, а отдельные слова скопировать не удаётся, вероятно, перед вами скан. В одном документе могут встречаться оба вида страниц.

Следом посмотрите на устройство таблицы. Есть ли линии между ячейками? Одинаково ли расположены столбцы? Не разрывается ли одна строка на две страницы? Эти особенности влияют на перенос сильнее, чем расширение .pdf.

Четыре варианта для разных задач

В таблице приведены возможности из официальных источников на 3 октября 2026 года. Собственный пример ниже выполнен в BentoPDF; качество остальных программ на той же смете мы не сравнивали.

Вариант Когда его рассмотреть Что учесть
BentoPDF Текстовый PDF с понятной таблицей; нужен XLSX без установки редактора Обработка в браузере. Найденные таблицы расходятся по листам; оформление не переносится, числа могут остаться текстом
PDF24 Tools Нужен бесплатный веб-конвертер без регистрации, и файл допустимо передать внешнему сервису По сведениям PDF24, конвертация проходит на серверах в Германии; файлы удаляются через час. Это серверный способ
iLovePDF Нужен выбор одного или нескольких листов; для скана нужен режим OCR На странице сервиса распознавание сканов относится к Premium. Наличие бесплатного режима для текстового PDF не делает OCR бесплатным
Tabula Нужно вручную выделить область текстовой таблицы Требуется Java; результат — CSV, который затем открывают в табличном редакторе. Скан сначала нужно распознать

Для первого обычного текстового PDF начните с браузерного способа. Установка локального конвертера ради одной таблицы редко бывает самым коротким путём. Если уже пользуетесь Tabula и она работает на вашем компьютере, ручное выделение области может оказаться удобнее автоматического поиска всех таблиц.

Перед загрузкой рабочего файла в серверный сервис уточните, можно ли его туда передавать. Для знакомства с конвертером ниже есть вымышленные данные. Подготовить настоящий документ поможет разбор данных перед работой с ИИ.

Пример в BentoPDF: PDF → два листа XLSX

Для примера возьмите учебную смету с линиями между ячейками. В ней три статьи расходов, записанный итог и отдельная таблица времени. Названия и суммы вымышлены.

  1. Откройте PDF to Excel в BentoPDF.
  2. Нажмите область выбора файла или кнопку Choose File и выберите PDF.
  3. Проверьте имя выбранного файла. Нажмите Convert to Excel.
  4. После сообщения об извлечении таблиц найдите полученный .xlsx в загрузках браузера. Откройте его в Excel или LibreOffice Calc.
  5. Проверьте вкладки листов внизу книги, затем заголовки, первую и последнюю строки каждой таблицы.

Редакция прошла этот путь в локальной копии официального BentoPDF 2.8.8 и открыла скачанный XLSX в LibreOffice Calc. Получились два листа: Table 1 (Page 1) со сметой и Table 2 (Page 1) со временем. Публичный сайт даёт тот же инструмент; наш результат относится к указанной версии и учебному файлу.

Что должно остаться в книге Значение в исходном PDF
Аренда зала 2 × 3000; сумма 6000
Печать материалов 25 × 100; сумма 2500
Вода и расходники 1 × 1500; сумма 1500
Итого по документу 11000
Первая версия времени 19:00
Уточнённая версия времени 19:30

Все эти значения сохранились. Сумма трёх расходов — 10 000 рублей, а в строке итога записано 11 000. Конвертер перенёс расхождение, исправлять смету он не должен. После переноса вы решаете отдельно, какие исходные данные требуют уточнения.

При этом числовые значения в полученном файле были записаны как текст. Прежде чем строить расчёт, проверьте, участвуют ли они в суммировании. В Excel для такого случая предусмотрена команда «Преобразовать в число»; не применяйте её ко всем столбцам подряд: код товара с ведущими нулями должен сохранить свой вид.

Почему часть строк может пропасть

В варианте сметы без линий названия и цифры расположены столбцами, но границы ячеек не нарисованы. BentoPDF сообщил, что извлёк две таблицы. Полученная книга открылась, однако оба листа содержали только заголовки. Строк с расходами и временем в них не было.

Это не значит, что любая таблица без линий обязательно потеряется. Но такой результат показывает, зачем сверять строки скачанной книги, даже когда программа сообщила об успехе.

Если строк не хватает, вернитесь к исходнику. Возможно, проще попросить автора документа прислать исходную таблицу, выбрать инструмент с ручным выделением области или перенести небольшую таблицу вручную. Повторная конвертация тем же способом не вернёт отсутствующие строки сама по себе.

Если программа сообщает No Tables Found, она вообще не нашла табличную структуру. На обычном текстовом плане мастер-класса мы получили именно этот ответ. Для скана сначала нужен OCR; качество распознавания и расположение столбцов после него тоже придётся сверить.

Как выбрать без перебора десятка программ

Для небольшой текстовой таблицы начните с BentoPDF и проверки строк. Если нужен серверный веб-сервис, сопоставьте PDF24 и iLovePDF с допустимостью загрузки и нужным режимом; для скана отдельно проверьте условия OCR. Tabula имеет смысл, когда требуется ручной выбор области и установка уже не мешает работе.

Перед дальнейшим использованием книги сверяйте число строк, названия, числа, десятичные разделители и итог. Красивое оформление PDF не доказывает правильность расчёта, а файл XLSX не гарантирует, что цифры стали числовыми ячейками.

Когда таблица перенесена и сверена, можно попросить ИИ разобрать её содержимое. В практике работы с документами можно продолжить такие задачи последовательно: подготовить вход, получить результат и проверить его по исходнику.