Vaše soubory zůstávají ve vašem zařízení

Soubory se zpracovávají ve vašem prohlížeči a nenahrávají se na naše servery. Web může stahovat zpracovatelské moduly a odesílat události o používání nebo zpětné vazbě bez obsahu souborů.

Jak nakládáme s vašimi údaji →

OCR PDF: vytvořit prohledávatelné PDF

OCR PDF: rozpoznejte skenované PDF a přidejte vybíratelný text v češtině, angličtině, španělštině nebo ruštině. Limity: až 10 stránek a 10 MiB na soubor. Soubory zůstávají ve vašem prohlížeči.

Soubory pro rozpoznávání ≈ 26 MB při prvním použití, plus jazyková data.

PDF · až 10 MiB, 10 stran. Text až 1 MiB; prohledávatelné PDF až 30 MiB.

Rozpoznaný text

Vyzkoušet příklad

Stáhnout ukázku

Nechte vybraný jazyk Čeština. Stáhněte PDF a vyhledejte FAKTURA, 148,50, Dvořák, DODÁVKA a 2048. Obě stránky by měly vypadat jako ukázka, s textem, který lze vybírat a kopírovat; háčky a čárky zůstanou zachovány.

Co očekávat

Každá stránka se rozpozná jako obrázek, postupně za sebou. K dispozici je rozpoznávání angličtiny, ruštiny a smíšených textů. OCR může špatně přečíst písmena, čísla, sloupce a tabulky: zkontrolujte výsledek. Tím vznikne nové PDF z vykreslených obrázků stránek a neviditelné textové vrstvy. Viditelná velikost stránky a otočení se zachovají; formuláře, odkazy, záložky, přílohy a digitální podpisy se nezachovají. Stávající text se rozpozná znovu; kvalita obrázku je omezena rozlišením vykreslení.

Stránky se vykreslují až ve 4 megapixelech. Načítání i každý krok zpracování mohou trvat až 90 sekund; celá úloha se zastaví po 10 minutách. Prázdné stránky jsou v textu označeny. Pokud zpracování selže nebo se nerozpozná žádný text, stažení se nenabídne.

PDF chráněné heslem?Nejprve je odemkněte jeho heslem.

Při prvním spuštění se mohou stáhnout soubory převodníku, což chvíli potrvá. Pokud se to nezdaří, zkontrolujte připojení nebo zkuste menší soubor. Tlačítko „Zrušit“ zastaví probíhající zpracování; můžete vybrat jiný soubor a zkusit to znovu.

Licence enginů a zdrojový kód

Praktický návod

Sken na vstupu, prohledávatelné PDF na výstupu.

  1. Vyberte skenované PDF do 10 stránek a 10 MiB.
  2. Zvolte češtinu, angličtinu, španělštinu nebo ruštinu.
  3. Vyhledejte ve výsledném PDF známé slovo, abyste ověřili textovou vrstvu.

Vyzkoušet tento příklad

Rozpoznejte skenovanou fakturu o 2 stránkách v češtině; hledání čísla faktury by ho mělo ve výsledném PDF najít zvýrazněné.

Než začnete: Podporována je jen čeština, angličtina, španělština a ruština, v mezích 10 stránek a 10 MiB; přesnost rozpoznání klesá u skenů nízké kvality.