Извлечь изображения из PDF
Извлекайте встроенные растровые изображения из PDF отдельными файлами. Выберите страницы и формат, скачайте результат по одному файлу или ZIP-архивом.
Файл загружается по защищённому соединению и обрабатывается на нашем сервере. Оригинал удаляется сразу после обработки, результат — через 1 час (в аккаунте — через 24 часа).
Выберите PDF-файл. Если он защищён паролем на открытие, введите его для текущей задачи.
В «Страницы» оставьте «Все страницы» или укажите номера и диапазоны, например 1-3, 5, 8-. В «Формат изображений» выберите «Исходный», PNG или JPG и нажмите «Извлечь изображения».
Скачайте изображения по отдельности или ZIP-архивом. До обработки проверяются выбранные страницы и ограничения. Оценка количества предварительная, точное число станет известно после извлечения.
Инструмент извлекает встроенные растровые изображения. «Исходный» сохраняет JPEG без повторного сжатия, а остальные форматы, включая JPEG 2000, JBIG2 и CCITT, — как PNG без потерь. PNG-конвертация сохраняет всё в PNG. JPG-конвертация использует качество 90, прозрачные области становятся белыми. Изображения с маской прозрачности в режимах «Исходный» и PNG сохраняются как PNG с прозрачностью.
Изображения извлекаются целиком, в исходном разрешении, без кадрирования и масштабирования страницы. Инструмент не извлекает текст, шрифты, векторные рисунки или диаграммы. Отсканированная страница обычно является одним изображением, разделить фотографии на ней нельзя.
Чтобы пропустить мелкие значки, линии и фрагменты, задайте длинную сторону в пикселях в параметре «Пропускать изображения меньше», 0 сохраняет всё. Пропуск повторяющихся изображений включён по умолчанию: одинаковый логотип будет извлечён один раз.
За задачу обрабатывается один PDF. Для гостей лимиты — 50 МБ, 200 страниц и 500 изображений, для зарегистрированных пользователей — 100 МБ и 500 страниц. PDF передаётся на сервер по HTTPS и удаляется сразу после обработки, результаты хранятся 1 час для гостей и 24 часа для зарегистрированных. Пароль на открытие используется только для текущей задачи и не сохраняется, пароль владельца не поддерживается.
Частые вопросы
Почему одинаковый логотип встречается в результате только один раз?
Параметр «Пропускать повторяющиеся изображения» включён по умолчанию. Это удобно, если один и тот же логотип размещён на многих страницах и нужна только одна копия. Если важно сохранить каждое повторение, отключите этот параметр.
Как называются извлечённые файлы?
В имени указываются имя PDF, номер страницы и порядковый номер изображения. Например, для документа report файл может называться report-p03-01.jpg. ZIP-архив по умолчанию получает имя report-images.zip, его название можно изменить в настройках «Имя ZIP-файла».
Можно ли заранее узнать точное количество изображений?
До обработки показывается только приблизительная оценка для выбранных страниц. Она может отличаться от результата, поэтому точное число становится известно после завершения извлечения.
Можно ли разделить фотографии на отсканированной странице?
Нет. Обычно скан всей страницы хранится в PDF как одно изображение, поэтому результатом будет изображение страницы целиком, а не отдельные фотографии внутри неё.
Извлекаются ли из PDF текст и диаграммы?
Нет. Инструмент сохраняет встроенные растровые изображения. Текст, шрифты и векторные рисунки или диаграммы не извлекаются, а распознавание текста на сканах не выполняется.