Самый простой способ получить PDF из любого файла, который открывается на компьютере, - воспользоваться встроенной в Windows функцией "Печать в PDF". Она работает как обычный принтер, только вместо бумаги сохраняет документ в файл. Подходит для текста, таблиц, веб-страниц и почти любого документа, который можно открыть и вывести на печать. Для готовых офисных файлов есть способ проще - "Сохранить как" прямо в программе, где создан документ. Ниже разберём оба варианта, а также перевод фото и сканов в PDF, объединение нескольких файлов в один и обратную конвертацию PDF в редактируемый текст.
Как сохранить документ в формате PDF через "Печать в PDF"
В Windows есть виртуальный принтер "Microsoft Print to PDF" - он появляется в списке принтеров сразу после установки системы, ничего дополнительно ставить не нужно. Чтобы им воспользоваться:
- Откройте нужный файл в любой программе, которая умеет его печатать - текстовый редактор, браузер, просмотрщик изображений.
- Нажмите сочетание клавиш для печати или найдите пункт "Печать" в меню программы.
- В списке принтеров выберите "Microsoft Print to PDF" вместо обычного принтера.
- Нажмите "Печать" - система предложит указать имя файла и папку для сохранения.
- Дождитесь, пока появится готовый PDF-файл в выбранной папке.
Этот способ универсален: если файл вообще можно открыть на компьютере и в программе есть команда печати, из него получится PDF. Разметка, шрифты и картинки при этом сохраняются такими же, как на экране, но сам PDF становится "картинкой" страницы - текст в нём выделяется и копируется, если исходный документ был текстовым, но перестроить структуру документа после такой печати уже нельзя.
Как перевести текстовый документ в PDF
Если документ создан в текстовом редакторе (например, в формате, который открывается программами вроде Word), сохранить его в PDF проще всего через встроенную команду "Сохранить как" или "Экспорт":
- Откройте документ в текстовом редакторе.
- Выберите в меню "Файл" пункт "Сохранить как" (или "Экспорт" - название зависит от программы).
- В списке форматов выберите PDF.
- Укажите папку и нажмите "Сохранить".
В отличие от печати через виртуальный принтер, этот способ сохраняет структуру документа лучше: оглавление может остаться кликабельным, а текст - точно распознаваемым и копируемым, без потерь на преобразование в изображение. Если у вас нет платного офисного пакета, для этой задачи подойдут и бесплатные программы для документов - какие именно, мы рассказывали в статье бесплатные программы для документов и таблиц. Там же есть встроенный экспорт в PDF, работающий точно так же.
Как перевести таблицу в PDF
Таблицы (файлы формата, который открывается программами вроде Excel) переводятся в PDF тем же способом - через "Сохранить как" или "Экспорт" с выбором формата PDF. Здесь есть важная особенность: таблица может не поместиться на одну печатную страницу по ширине, и часть столбцов "обрежется" при сохранении.
Перед экспортом стоит проверить область печати:
- откройте предварительный просмотр печати и посмотрите, все ли столбцы попадают на страницу;
- при необходимости уменьшите масштаб печати или смените ориентацию страницы на альбомную;
- если таблица длинная, проверьте, что нужные строки не обрезаются по высоте.
Только после этого выполняйте "Сохранить как PDF" - так вы получите документ, где видна вся таблица, а не её часть.
Как перевести фотографию или скан в PDF
Фотографию или картинку тоже можно превратить в PDF-файл, и здесь работает тот же принцип виртуальной печати:
- Откройте изображение в стандартной программе просмотра фото.
- Откройте меню печати.
- Выберите принтер "Microsoft Print to PDF".
- Сохраните файл.
Если нужно объединить в один PDF сразу несколько фотографий или страниц скана, удобнее выделить все нужные файлы в проводнике, кликнуть по выделению правой кнопкой мыши и выбрать пункт печати - тогда все изображения уйдут на виртуальный принтер как один многостраничный документ, и порядок страниц в PDF будет соответствовать порядку выделения файлов.
Если исходное фото весит много и итоговый PDF получается слишком большим для пересылки, сначала уменьшите размер картинки - как это сделать, описано в статье как сжать фото.
Как объединить несколько файлов в один PDF
Есть два рабочих способа собрать несколько файлов в один PDF-документ.
Первый - через печать, как описано выше: выделить несколько изображений в проводнике и отправить их на виртуальный принтер одним заданием. Способ подходит, когда исходники - это фотографии или сканы одного типа.
Второй способ нужен, если объединить требуется уже готовые PDF-файлы между собой (например, несколько отдельных сканов документов, которые уже сохранены как PDF). Стандартные средства Windows такой функции не имеют, поэтому здесь нужна отдельная программа для работы с PDF - бесплатных вариантов достаточно, они умеют перетаскивать страницы между файлами и менять их порядок простым перетаскиванием мышью. Прежде чем ставить такую программу, проверьте расширение исходных файлов - если не уверены, что перед вами именно PDF, а не похожий по значку формат, посмотрите статью чем открыть файл.
Какие программы конвертируют в PDF бесплатно
Для конвертации в PDF не обязательно ничего покупать или устанавливать:
- Встроенная печать в PDF - есть в самой Windows, ничего ставить не нужно, подходит для любого файла, который можно открыть на экране.
- Функция "Сохранить как PDF" - встроена в большинство современных текстовых и табличных редакторов, включая бесплатные аналоги офисных пакетов.
- Отдельные бесплатные программы для работы с PDF - нужны, если требуется не просто создать PDF, а редактировать уже готовый файл: объединять страницы, вырезать лишние, менять их порядок.
Мы не рекомендуем конкретные названия таких программ и не советуем гнаться за сервисами, которые обещают "ускорить" или "оптимизировать" работу с PDF за деньги - для базовых задач вроде создания и объединения файлов хватает встроенных средств системы и бесплатных редакторов PDF, которых в интернете достаточно.
Как перевести PDF обратно в редактируемый текст
Если нужно не создать PDF, а наоборот - вытащить текст из готового PDF-файла для редактирования, способ зависит от того, как этот PDF был создан.
Если PDF получен из текстового документа (например, экспортом из редактора, а не печатью скана), текст в нём уже "живой": его можно выделить мышью, скопировать и вставить в любой текстовый редактор. Часто этого достаточно - специальная конвертация не нужна.
Если же PDF - это скан или фотография, превращённая в PDF, текста в нём как такового нет: это картинка. Выделить и скопировать буквы не получится, пока не применить распознавание текста.
На что обратить внимание при распознавании текста со скана
Распознавание текста (OCR) - это отдельная функция, которая "читает" буквы на изображении и превращает их в редактируемый текст. Такая функция часто встроена в бесплатные программы для работы с PDF и в некоторые текстовые редакторы. Несколько моментов, на которые стоит обратить внимание перед распознаванием:
- Качество скана. Чем чётче и контрастнее изображение, тем точнее распознавание. Смазанный или тёмный скан программа прочитает с ошибками, а часть текста может пропустить целиком.
- Язык распознавания. В настройках нужно указать правильный язык текста - иначе программа будет пытаться подобрать буквы из чужого алфавита и результат окажется бессмысленным набором символов.
- Проверка результата. Распознанный текст почти всегда нужно перечитать и поправить вручную - особенно цифры, знаки препинания и слова с необычным написанием, где OCR ошибается чаще всего.
- Сложное форматирование. Таблицы, колонки и многоуровневые списки на сканах распознаются хуже сплошного текста - структуру документа после распознавания обычно приходится собирать заново.
Мы не привязываем этот способ к конкретному платному сервису: функция распознавания текста бесплатно встроена во многие программы для просмотра и редактирования PDF, и для разовой задачи - перевести один скан в текст - её обычно достаточно. Если распознавание регулярно даёт плохой результат из-за качества самих сканов, дело чаще в сканере или настройках печати, а не в программе распознавания, и стоит проверить их отдельно.
Если после всех проверок текст всё равно распознаётся с большим числом ошибок на разных документах, а не на одном конкретном скане, вероятно, дело не в самой функции OCR, а в том, что и как вы сканируете - неправильное разрешение, неровно положенный лист или загрязнённое стекло сканера искажают изображение ещё до того, как программа начинает его читать. В этом случае имеет смысл сначала пересканировать документ заново с более высоким качеством и только потом повторить распознавание - результат почти всегда становится заметно лучше.