הקבצים שלכם נשארים במכשיר שלכם

הקבצים מעובדים בדפדפן שלכם ואינם מועלים לשרתים שלנו. האתר עשוי להוריד מנועי עיבוד ולשלוח אירועי שימוש או משוב ללא תוכן הקבצים.

כיצד אנו מטפלים בנתונים שלכם

PDF ל-HTML

המרת PDF ל-HTML: שמירת הטקסט הקיים של מדריך ביתי כדף אינטרנט פשוט, עם חלק אחד לכל דף מקור. תמונות ופריסה אינן נכללות.

דוגמה סינתטית – בדקו את הגדרות הפעולה לפני ההפעלה.

המסמכים שלכם נשארים במכשיר הזה. הורדות הכלים וסטטיסטיקות השימוש אינן כוללות תוכן של קבצים.

מגבלות במכשיר שלכם: גודל קובץ בודד מרבי: ⁦10 MB⁩

הקבצים שלכם מעובדים בדפדפן שלכם. הם אינם מועלים לאתר הזה.

מדריך מעשי

עותק טקסט מסודר לפי דפים, לפתיחה מקומית

  1. בחרו PDF עם טקסט הניתן לבחירה.
  2. ייצאו HTML ופתחו את הקובץ שהורד מקומית.
  3. בדקו את חלקי הדפים ואת הניסוח מול המקור לפני שימוש חוזר.

נסו את הדוגמה הזו

ייצאו ל-HTML PDF של שאלות נפוצות בן שני דפים, הניתן לחיפוש. פתחו אותו מקומית ובדקו שכל תשובה מופיעה תחת חלק דף המקור שלה, בלי שתטופל כקוד שניתן להרצה.

לפני

  • דפי PDF עם טקסט

אחרי

  • מקטעי דפים ב-HTML
הקלט והתוצאה הצפויה במשימה זו. דוגמה להמחשה.

לפני שמתחילים: ה-HTML מכיל טקסט עם תווי בריחה בלבד; גופנים, תמונות ופריסה מקוריים אינם נשמרים, ובסריקות לא מבוצע OCR.

המשך עם ה-PDF המקורי
מה מקבלים

ייצאו טקסט מוטמע למסמך HTML עצמאי, עם מקטע אחד לכל דף. הטקסט עובר הסתרת תווים (escaping) ואינו מורץ כ-HTML. גופנים, תמונות, טבלאות ופריסה מקוריים אינם נשמרים; ללא OCR. מגבלות: קלט של 10 MiB, 200 דפים, פלט של 4 MiB.

מגבלות ופרטים חשובים

קלט של עד 10 MiB, 200 דפים ופלט טקסט של 4 MiB. במסמכים סרוקים בלי שכבת טקסט מוצגת שגיאה, במקום חילוץ מוצלח לכאורה. סדר הקריאה, העמודות והגופנים עשויים לא להתאים לפריסה החזותית. זה אינו OCR ואינו המרה מ-PDF ל-Word.

דוגמה

ייצאו דוח מבוסס טקסט ופתחו את קובץ ה-HTML שהורד במכשיר. המקטעים עוקבים אחרי סדר הדפים ב-PDF; דפים ריקים או סרוקים מסומנים בתווית ואינם מטופלים בשקט כטקסט שזוהה.