Ваши файлы остаются на устройстве
Файлы обрабатываются в браузере и не загружаются на наши серверы. Сайт может скачивать движки и отправлять события использования или обратной связи без содержимого файлов.
Как мы обращаемся с данными →Извлечь текст из PDF
Извлеките текст из PDF с поиском в простую текстовую копию для повторного использования. Только имеющийся текст, без шрифтов, изображений и сканов.
Учебный пример: проверьте настройки операции перед запуском.
Документы остаются на устройстве. Загрузка движков и статистика не включают содержимое файлов.
Локальные лимиты: Максимальный размер файла: 10 MB
Файлы обрабатываются в вашем браузере. Они не загружаются на этот сайт.
Практическое руководство
Получите текст, не конвертируя оформление страниц.
- Выберите PDF с выделяемым текстом.
- Извлеките текст и просмотрите результат, разбитый по страницам.
- Скопируйте или скачайте TXT, затем проверьте важные фрагменты в PDF.
Попробуйте этот пример
Извлеките текст из PDF с поиском на шесть страниц с материалами встречи и сверьте заголовки повестки и пункты действий с источником, прежде чем делиться файлом TXT.
До
- Выделяемый текст PDF
После
- Простой текст .txt
Перед началом: В результате только текст, без исходных шрифтов, изображений и макета; сканированные страницы не распознаются.
Продолжить с исходным PDFРезультат
Извлеките встроенный текст в файл TXT. Для сканированных страниц нужен OCR; порядок чтения в источнике может отличаться от видимого макета.
Ограничения
Не более 10 МиБ на входе, 200 страниц и 4 МиБ текста на выходе. Для сканированных документов без текстового слоя выдаётся ошибка вместо ложного успешного извлечения. Порядок чтения, колонки и шрифты могут не совпадать с визуальным макетом. Это не OCR и не PDF в Word.
Пример
Извлеките текст из отчёта с поиском по тексту, просмотрите его в поле результата и скопируйте или скачайте. Исходные PDF остаются доступными после получения текста.