Τα αρχεία σας παραμένουν στη συσκευή σας
Τα αρχεία επεξεργάζονται στο πρόγραμμα περιήγησής σας και δεν μεταφορτώνονται στους διακομιστές μας. Ο ιστότοπος μπορεί να κατεβάσει μηχανές επεξεργασίας και να στείλει συμβάντα χρήσης ή σχολίων χωρίς το περιεχόμενο των αρχείων.
Πώς χειριζόμαστε τα δεδομένα σας →PDF σε HTML
Μετατρέψτε PDF σε HTML: αποθηκεύστε το κείμενο ενός οδηγού του σπιτιού ως απλή ιστοσελίδα, μία ενότητα ανά σελίδα. Χωρίς εικόνες και διάταξη.
Συνθετικό παράδειγμα – ελέγξτε τις ρυθμίσεις της λειτουργίας πριν την εκτελέσετε.
Τα έγγραφά σας παραμένουν σε αυτή τη συσκευή. Οι λήψεις εργαλείων και τα στατιστικά χρήσης δεν περιλαμβάνουν περιεχόμενο αρχείων.
Περιορισμοί στη συσκευή σας: Μέγ. μέγεθος αρχείου: 10 MB
Τα αρχεία σας επεξεργάζονται στο πρόγραμμα περιήγησής σας. Δεν μεταφορτώνονται σε αυτόν τον ιστότοπο.
Πρακτικός οδηγός
Ανοίξτε τοπικά ένα αντίγραφο κειμένου οργανωμένο ανά σελίδα.
- Επιλέξτε ένα PDF με επιλέξιμο κείμενο.
- Εξαγάγετε HTML και ανοίξτε τοπικά το αρχείο που κατεβάσατε.
- Ελέγξτε τις ενότητες των σελίδων και το κείμενο με το πρωτότυπο πριν το ξαναχρησιμοποιήσετε.
Δοκιμάστε αυτό το παράδειγμα
Εξαγάγετε σε HTML ένα PDF συχνών ερωτήσεων δύο σελίδων με δυνατότητα αναζήτησης. Ανοίξτε το τοπικά και επιβεβαιώστε ότι κάθε απάντηση εμφανίζεται κάτω από την ενότητα της σελίδας προέλευσής της, χωρίς να αντιμετωπίζεται ως εκτελέσιμος κώδικας.
Πριν
- Σελίδες PDF με κείμενο
Μετά
- Ενότητες σελίδων HTML
Πριν ξεκινήσετε: Το HTML περιέχει μόνο κείμενο με διαφυγή χαρακτήρων· οι αρχικές γραμματοσειρές, οι εικόνες και η διάταξη δεν διατηρούνται και οι σαρώσεις δεν περνούν από OCR.
Συνέχεια με το PDF προέλευσηςΤι παίρνετε
Εξαγάγετε το ενσωματωμένο κείμενο σε αυτόνομο έγγραφο HTML με μία ενότητα ανά σελίδα. Το κείμενο περνά με escape, δεν εκτελείται ως HTML. Οι αρχικές γραμματοσειρές, εικόνες, πίνακες και η διάταξη δεν διατηρούνται· χωρίς OCR. Όρια: 10 MiB εισόδου, 200 σελίδες, 4 MiB εξόδου.
Όρια και σημαντικές λεπτομέρειες
Έως 10 MiB εισόδου, 200 σελίδες και 4 MiB κειμένου εξόδου. Τα σαρωμένα έγγραφα χωρίς επίπεδο κειμένου εμφανίζουν σφάλμα αντί για μια ψευδώς επιτυχημένη εξαγωγή. Η σειρά ανάγνωσης, οι στήλες και οι γραμματοσειρές μπορεί να μην ταιριάζουν με την οπτική διάταξη. Δεν είναι OCR ούτε μετατροπή PDF σε Word.
Παράδειγμα
Εξαγάγετε μια αναφορά που βασίζεται σε κείμενο και ανοίξτε το HTML που κατεβάσατε τοπικά. Οι ενότητες ακολουθούν τη σειρά των σελίδων του PDF· οι κενές/σαρωμένες σελίδες επισημαίνονται και δεν αντιμετωπίζονται σιωπηλά ως αναγνωρισμένο κείμενο.