Tvoje datoteke ostaju na tvom uređaju
Datoteke se obrađuju u tvom pregledniku i ne učitavaju se na naše poslužitelje. Web-mjesto može preuzeti mehanizme za obradu i slati događaje o korištenju ili povratne informacije bez sadržaja datoteka.
Kako postupamo s tvojim podacima →PDF u HTML
Pretvori ugrađeni tekst PDF-a u samostalnu HTML datoteku odvojenu po stranicama za ugodno čitanje. Slike i izvorni izgled nisu dio rezultata.
Umjetni primjer – prije pokretanja provjeri postavke operacije.
Tvoji dokumenti ostaju na ovom uređaju. Preuzimanja alata i statistika korištenja ne sadrže sadržaj datoteka.
Ograničenja na tvom uređaju: Najveća veličina po datoteci: 10 MB
Tvoje se datoteke obrađuju u pregledniku. Ne učitavaju se na ovu stranicu.
Praktičan vodič
Zadrži tekstni prikaz povezan sa slijedom stranica.
- Odaberi PDF čiji se tekst može označiti.
- Izvezi HTML i otvori preuzetu datoteku lokalno.
- Usporedi dobivene odjeljke i tekst s izvornim PDF-om.
Isprobaj ovaj primjer
Izvezi pretraživu ponudu od pet stranica u HTML. Prije dijeljenja tekstne kopije provjeri nalaze li se sažetak sa stranice 1 i kontaktni podaci sa stranice 5 u očekivanim odjeljcima.
Prije
- Stranice PDF-a s tekstom
Poslije
- HTML odjeljci po stranici
Prije nego što počneš: Ovo nije iscrtavanje PDF-a ni pretvorba koja čuva format; slike i izvorni izgled izostavljaju se.
Nastavi s izvornim PDF-omŠto dobivaš
Izvezi ugrađeni tekst u samostalan HTML dokument s jednim odjeljkom po stranici. Tekst se maskira i ne izvršava kao HTML. Izvorni fontovi, slike, tablice i raspored ne čuvaju se; bez OCR-a. Ograničenja: 10 MiB ulaza, 200 stranica, 4 MiB izlaza.
Ograničenja i važni detalji
Najviše 10 MiB ulaza, 200 stranica i 4 MiB tekstualnog izlaza. Skenirani dokumenti bez tekstnog sloja prijavljuju pogrešku umjesto prividno uspješnog izdvajanja. Redoslijed čitanja, stupci i fontovi mogu se ne podudarati s vizualnim rasporedom. Ovo nije OCR niti PDF u Word.
Primjer
Izvezi izvješće utemeljeno na tekstu i otvori preuzeti HTML lokalno. Odjeljci prate redoslijed stranica PDF-a; prazne/skenirane stranice označene su umjesto da se šutke tretiraju kao prepoznat tekst.