Только нужные страницы
Диапазоны позволяют исключить ненужные части документа и снизить расход памяти при работе с большим PDF.
Инструменты PDF
PDF в JPGСохранить страницы PDF картинкамиPDF в PNGСохранить выбранные страницы PDF в PNGСжать PDFУменьшить размер PDF без загрузкиОбъединить PDFСобрать несколько PDF-документовРазделить PDFРазделить документ на страницы или извлечь выбранныеУдалить страницы PDFУдалить лишние страницы и сохранить новый PDFПовернуть PDFПовернуть страницы и сохранить ориентациюПорядок страниц PDFПереставить страницы по миниатюрамPDF в текстИзвлечь текстовый слой в TXTОбрезать PDFОбрезать видимые поля страницыНумерация страницДобавить номера на страницы PDFОбъединить JPG и PDFСоединить PDF и изображения JPGИзображения в PDF
JPG в PDFСоздать PDF из фотографий JPGPNG в PDFПреобразовать PNG с прозрачностьюWebP в PDFСоздать PDF из изображений WebPBMP в PDFПреобразовать изображения BMP в браузереJFIF в PDFСоздать PDF из изображений JFIFTIFF в PDFКонвертировать одно- и многостраничные TIFFИзображения в PDFОбъединить JPG, PNG и WebPБесплатный инструмент PDF
Извлеките существующий текстовый слой PDF, просмотрите результат и скачайте TXT в UTF-8. Можно выбрать отдельные страницы и диапазоны; документ остаётся на вашем устройстве.
4 простых шага
PDF в текст помогает перенести выделяемый текст из отчётов, статей, инструкций и документов, сохранённых из офисных программ. Инструмент читает текстовый слой, а не распознаёт буквы на изображении скана.
Откройте один документ до 50 МБ и 500 страниц. Защищённые паролем файлы этим инструментом не обрабатываются.
По умолчанию выбраны все страницы. Для отдельной части документа введите номера или диапазоны, например 1-3, 8.
Запустите извлечение и прочитайте предпросмотр. Он показывает до 20 000 символов, а скачанный TXT содержит весь извлечённый результат.
Сохраните TXT в UTF-8 или скопируйте текст. Между страницами добавляются пустые строки; исходное оформление страницы в TXT не переносится.
DocFlip
Текстовый файл удобен для поиска, цитирования, заметок и дальнейшего редактирования. Он не сохраняет расположение элементов, изображения и оформление таблиц.
Диапазоны позволяют исключить ненужные части документа и снизить расход памяти при работе с большим PDF.
Извлекается реально сохранённый текст. Для страницы без пригодного текстового слоя показывается сообщение, а не обещание успешного OCR.
Результат можно открыть в текстовом редакторе и использовать в других программах. Шрифты, рисунки и фотографии не экспортируются.
Документ и текст остаются на устройстве. Если браузер запрещает доступ к буферу обмена, можно скачать TXT.
FAQ
Только если скан уже содержит пригодный текстовый слой. Для PDF, состоящего из изображений, нужен отдельный OCR-инструмент. Здесь распознавание не выполняется.
Нет. Текст извлекается в порядке, заданном PDF. Колонки, таблицы, нестандартные кодировки и сложная вёрстка могут потребовать ручного исправления.
Это может быть изображение скана, буквы в виде векторных контуров или текст без пригодной кодировки. Видимые символы не всегда означают наличие читаемого текстового слоя.
Да. Введите список или диапазоны через запятую, например 2, 5-7. Повторяющиеся номера учитываются один раз, страницы обрабатываются в порядке документа.
Один PDF до 50 МБ и 500 страниц. Извлечение останавливается при превышении 5 миллионов символов; в таком случае выберите меньший диапазон.
Продолжите работу с документом в подходящем инструменте.