Vaše soubory zůstávají ve vašem zařízení
Soubory se zpracovávají ve vašem prohlížeči a nenahrávají se na naše servery. Web může stahovat zpracovatelské moduly a odesílat události o používání nebo zpětné vazbě bez obsahu souborů.
Jak nakládáme s vašimi údaji →PDF na HTML
Změňte vložený text PDF na samostatný soubor HTML rozdělený po stránkách pro pohodlné čtení. Obrázky a původní rozvržení nejsou součástí výsledku.
Umělý příklad – před spuštěním zkontrolujte nastavení operace.
Vaše dokumenty zůstávají v tomto zařízení. Stahování nástrojů a statistiky používání neobsahují obsah souborů.
Omezení ve vašem zařízení: Max. velikost jednoho souboru: 10 MB
Vaše soubory se zpracovávají ve vašem prohlížeči. Nenahrávají se na tento web.
Praktický návod
Udržte textový náhled propojený s pořadím stránek.
- Vyberte PDF, jehož text lze vybírat.
- Exportujte HTML a stažený soubor otevřete lokálně.
- Porovnejte výsledné oddíly a znění se zdrojovým PDF.
Vyzkoušet tento příklad
Exportujte prohledávatelnou pětistránkovou nabídku do HTML. Ověřte, že souhrn ze stránky 1 a kontaktní údaje ze stránky 5 jsou v očekávaných oddílech, než textovou kopii sdílíte.
Před
- Stránky PDF s textem
Po
- Sekce stránek HTML
Než začnete: Nejde o vykreslení PDF ani o převod se zachováním formátu; obrázky a původní rozvržení se vynechávají.
Pokračovat se zdrojovým PDFCo získáte
Exportujte vložený text do samostatného dokumentu HTML s jednou sekcí na stránku. Text se zakóduje, nespouští se jako HTML. Původní písma, obrázky, tabulky a rozvržení se nezachovávají; bez OCR. Limity: vstup 10 MiB, 200 stránek, výstup 4 MiB.
Omezení a důležité podrobnosti
Nejvýše 10 MiB vstupu, 200 stránek a 4 MiB textového výstupu. Skenované dokumenty bez textové vrstvy ohlásí chybu místo zdánlivě úspěšné extrakce. Pořadí čtení, sloupce a písma se nemusí shodovat s vizuálním rozvržením. Nejde o OCR ani o převod PDF na Word.
Příklad
Exportujte zprávu založenou na textu a stažený soubor HTML otevřete místně. Sekce sledují pořadí stránek PDF; prázdné či skenované stránky jsou označeny, nikoli tiše považovány za rozpoznaný text.