Ваши файлы остаются на устройстве

Файлы обрабатываются в браузере и не загружаются на наши серверы. Сайт может скачивать движки и отправлять события использования или обратной связи без содержимого файлов.

Как мы обращаемся с данными →

PDF в HTML

Конвертируйте PDF в HTML: сохраните текст домашней инструкции как простую веб-страницу, по разделу на страницу. Изображения и вёрстка не переносятся.

Учебный пример: проверьте настройки операции перед запуском.

Документы остаются на устройстве. Загрузка движков и статистика не включают содержимое файлов.

Локальные лимиты: Максимальный размер файла: 10 MB

Файлы обрабатываются в вашем браузере. Они не загружаются на этот сайт.

Практическое руководство

Откройте текстовую копию по страницам у себя на устройстве.

  1. Выберите PDF с выделяемым текстом.
  2. Экспортируйте HTML и откройте скачанный файл локально.
  3. Проверьте разделы страниц и формулировки по оригиналу, прежде чем использовать повторно.

Попробуйте этот пример

Экспортируйте в HTML двухстраничный PDF с вопросами и ответами и поиском по тексту. Откройте его локально и убедитесь, что каждый ответ стоит в разделе своей исходной страницы и не воспринимается как исполняемая разметка.

До

  • Страницы PDF с текстом

После

  • Разделы HTML по страницам
Исходный файл и ожидаемый результат этой задачи. Наглядный пример.

Перед началом: HTML содержит только экранированный текст; исходные шрифты, изображения и вёрстка не сохраняются, а сканы не распознаются через OCR.

Продолжить с исходным PDF
Результат

Экспортируйте встроенный текст в отдельный документ HTML с одним разделом на страницу. Текст экранируется и не выполняется как HTML. Исходные шрифты, изображения, таблицы и макет не сохраняются; OCR нет. Ограничения: 10 МиБ на входе, 200 страниц, 4 МиБ на выходе.

Ограничения

Не более 10 МиБ на входе, 200 страниц и 4 МиБ текста на выходе. Для сканированных документов без текстового слоя выдаётся ошибка вместо ложного успешного извлечения. Порядок чтения, колонки и шрифты могут не совпадать с визуальным макетом. Это не OCR и не PDF в Word.

Пример

Экспортируйте отчёт с текстовым слоем и откройте скачанный HTML локально. Разделы следуют порядку страниц PDF; пустые и сканированные страницы помечаются, а не молча считаются распознанным текстом.