форматни.рфПроверить файл
7 минут чтенияредакция форматни.рф

Как перевести PDF в Word

PDF с текстом переводится в Word за минуту, скан — только через распознавание, и оно ошибается в цифрах. Как отличить одно от другого, чем переводить и что проверять после, по справкам Microsoft и Google и нашему замеру.

СКАН И ФАЙЛPDF в WordPDFформатни.рф05.10.2026

Перевести PDF в Word можно тремя способами: открыть файл в самом Word, в Google Документах или в конвертере. Но сначала нужно понять, какой у вас PDF. Если в нём есть текст, перевод займёт минуту и потеряет в основном оформление. Если это скан, букв в файле нет вовсе — только картинка страницы, и текст из неё достаёт распознавание. Оно ошибается, и чаще всего в цифрах.

Сначала: текст у вас или картинка#

PDF бывает двух видов. С текстовым слоем — файл сохранили из Word или другой программы: в нём лежат буквы и их координаты. Скан — сфотографированная или отсканированная страница: в файле лежит изображение, похожее на текст.

Проверить можно за десять секунд:

  • откройте PDF и попробуйте выделить мышью одно слово. Выделяется слово — текст есть. Выделяется вся страница прямоугольником или ничего — это картинка;
  • нажмите Ctrl+F и найдите слово, которое видите на странице. Скан поиск не найдёт;
  • загрузите файл в образ или документ — он скажет, есть ли в PDF текстовый слой, и файл не уйдёт с устройства.

Бывает смесь: часть страниц из программы, часть — сканы. Текст переведётся только с первых.

PDF с текстом: три способа#

Word#

По справке Microsoft «Открытие PDF-файлов в Word» (Word для Microsoft 365 и Word 2016–2024): Файл → Открыть, выбрать PDF. Word создаёт копию, «преобразуя его в документ Word и пытаясь воссоздать макет исходного PDF-файла». Исходник не меняется.

Почему макет «пытаются воссоздать», там же объяснено: PDF хранит расположение текста и рисунков, но «большинство PDF-файлов не включают сведения о таких структурных элементах содержимого, как абзацы, таблицы и столбцы». Word угадывает их по расположению. Хуже всего, по списку Microsoft, переносятся таблицы с интервалами между ячейками, рамки и цвета страниц, длинные и концевые сноски.

Google Документы#

На Google Диске: правой кнопкой по PDF → Открыть с помощью → Google Документы, затем Файл → Скачать → Microsoft Word. Справка Google Диска описывает этот путь как преобразование PDF и изображений в текст. После преобразования, по той же справке, «тип, начертание (полужирный, курсив) и размер шрифта, а также переносы строк обычно сохраняются», а «списки, таблицы, столбцы, обычные и концевые сноски, скорее всего, не будут распознаны».

Файл при этом загружается в ваш Google-аккаунт — с паспортом или договором об этом помните.

Наш конвертер#

Пдф в ворд работает в браузере: файл не отправляется на сервер. Переносит абзацы, заголовки, списки, полужирный, курсив и выравнивание. Чего он не переносит, сказано до перевода, а не после:

  • таблицы станут обычными абзацами;
  • картинки, печати и подписи в документ не попадут;
  • колонки пойдут сплошным текстом;
  • колонтитулы и номера страниц окажутся в тексте обычными строками.

Если PDF окажется сканом, конвертер так и скажет, а не выдаст пустой документ.

Почему скан не превращается в текст#

В скане нет букв — только пиксели. Человек складывает из них слова, программа нет. Чтобы получить текст, нужно распознавание (OCR): программа ищет на картинке очертания букв и угадывает их.

Угадывание зависит от качества картинки. Google для распознавания на Диске ставит условия прямо в справке:

  • размер файла — не больше 2 МБ;
  • высота строки — не меньше 10 пикселей;
  • текст повёрнут правильно, иначе он не распознаётся;
  • изображение «четким, равномерно освещенным и контрастным»;
  • шрифты распространённые, «такие как Arial и Times New Roman».

Microsoft в справке о вставке отсканированного текста пишет: «точность распознавания текста зависит от качества сканирования и четкости отсканированного текста. Рукописный текст редко распознается».

Что мы намерили#

Мы собрали одну страницу искового заявления шрифтом Times New Roman 12 пт: ФИО, паспорт, СНИЛС, суммы, номера платёжек — 186 слов и 68 чисел. Сделали из неё сканы разного разрешения и распознали бесплатной программой Tesseract с русским языком. Замер 26.09.2026, один документ, одна программа — это пример, а не рейтинг распознавателей.

3 графы
СканЧисел без ошибкиСлов без ошибки
ровный, 300 dpi68 из 68185 из 186
ровный, 150 dpi68 из 68185 из 186
ровный, 100 dpi68 из 68185 из 186
ровный, 75 dpi64 из 68172 из 186
как с телефона, 200 dpi68 из 68183 из 186
как с телефона, 150 dpi40 из 6897 из 186

«Как с телефона» — та же страница с наклоном 1,8°, неровным светом, шумом и сжатием JPEG.

Что стоит за строками таблицы:

  • 75 dpi. Номер договора «07/25» стал «0725», «возвратил» — «позвратил», предлог «об» — цифрами «06». Программа ничего не отметила: ошибка выглядит как обычный текст;
  • телефон, 150 dpi. Потерялась правая часть страницы, где свет был темнее: от шапки с паспортом и СНИЛС не осталось ни строки, а всего без ошибки распознано 40 чисел из 68.

Выводов два. Ровный скан от 100 dpi распознаётся почти без ошибок. Ошибки распознавания не видны: «0725» вместо «07/25» глазами при беглом чтении не заметить.

Чем распознать скан#

  • Word. Microsoft в справке о вставке отсканированного текста предлагает открыть такой PDF в Word: «Word откроет диалоговое окно, подтверждающее попытку импорта текста PDF-файла». Но в справке об открытии PDF сказано и другое: если файл в основном из изображений, «вся страница может отображаться как изображение» — без текста. Что получится у вас, зависит от файла.
  • Google Документы — тот же путь, что для текстового PDF. С ограничениями выше: 2 МБ и 10 пикселей на строку. Годится и скан, сохранённый картинкой: по справке Google Диска, распознать можно «файлы PDF (многостраничные документы) и изображения (JPEG, PNG и GIF)». Нажмите на файл на Диске правой кнопкой, выберите «Открыть с помощью» → «Google Документы», а готовый текст сохраните в Word через «Файл» → «Скачать» → «Microsoft Word».
  • Программа сканера. Microsoft пишет, что со сканером «может поставляться приложение для распознавания текста (OCR)».

Про Microsoft Lens. Та же справка Microsoft до сих пор называет его лучшим способом отсканировать документ в Word. Но по отдельной странице Microsoft, Lens удалён из магазинов приложений 9 февраля 2026 года, а создавать новые сканы в нём можно было до 9 марта 2026 года. Вместо него Microsoft советует сканирование в приложении OneDrive.

Мы сканы не распознаём. Документы с сайта уходят на подачу, и ошибка в номере паспорта или сумме там обходится дороже, чем набор текста вручную.

Что проверить после перевода#

  1. Цифры. Суммы, даты, номера документов, паспортные данные — сверьте каждую с оригиналом. После распознавания это обязательно, после текстового PDF — желательно.
  2. Таблицы. Если в PDF была таблица, в Word её, скорее всего, нет: строки ячеек идут подряд. Соберите таблицу заново.
  3. Порядок текста. Шапка справа, колонки, сноски могут встать не на своё место.
  4. Для подачи — обратно в PDF. В нашем реестре подач, по разбору 22.09.2026, docx принимает одна подача из одиннадцати. Как сохранить его с текстовым слоем, — в статье как перевести Word в PDF.

Если нужно не перевести PDF, а положить его внутрь документа, — это другая задача, она разобрана в статье как вставить PDF в Ворд.

Частые вопросы

Почему PDF открылся в Word картинкой?

Скорее всего, это скан: в файле нет текста, только изображение страницы. Проверьте выделением или поиском по Ctrl+F. Для скана нужно распознавание, и после него — сверка цифр с оригиналом.

Можно ли перевести PDF в Word без потери форматирования?

Полностью — нет. PDF не хранит абзацы, таблицы и колонки, и любая программа восстанавливает их по расположению текста. Шрифт, полужирный и курсив обычно сохраняются, таблицы и колонки — нет.

Какое разрешение скана нужно для распознавания?

В нашем замере ровный скан от 100 dpi распознался почти без ошибок, на 75 dpi появились ошибки в числах. Google требует, чтобы высота строки была не меньше 10 пикселей. Для документа шрифтом 12 пт надёжнее сканировать в 150–300 dpi.

Распознаётся ли рукописный текст?

Плохо. Microsoft пишет, что рукописный текст «редко распознается». Заявление от руки проще набрать заново.

Статья опубликована . Материал подготовила и поддерживает редакция форматни.рф.