تبقى الملفات على الجهاز
تُعالَج الملفات في المتصفح ولا تُرفع إلى خوادمنا. قد ينزّل الموقع محركات المعالجة ويرسل أحداث الاستخدام أو الملاحظات دون محتوى الملفات.
كيف نتعامل مع البياناتPDF إلى HTML
تحويل PDF إلى HTML: حفظ النص الموجود في دليل منزلي كصفحة ويب بسيطة، بقسم لكل صفحة مصدر. تُترك الصور والتخطيط جانبًا.
مثال اصطناعي — يُرجى مراجعة إعدادات العملية قبل التشغيل.
تبقى المستندات على هذا الجهاز. لا تتضمن عمليات تنزيل الأدوات وإحصاءات الاستخدام محتوى الملفات.
الحدود على الجهاز: الحد الأقصى للملف الواحد: 10 MB
تُعالج الملفات داخل المتصفح. لا تُرفع إلى هذا الموقع.
دليل عملي
فتح نسخة نصية منظمة بالصفحات محليًا.
- اختيار ملف PDF بنص قابل للتحديد.
- تصدير HTML وفتح الملف المنزّل محليًا.
- فحص أقسام الصفحات والصياغة مقابل الأصل قبل إعادة الاستخدام.
تجربة هذا المثال
تصدير PDF أسئلة شائعة قابل للبحث من صفحتين إلى HTML. يُفتح محليًا ويُتحقق من ظهور كل إجابة تحت قسم صفحتها المصدر دون معاملتها كمحتوى قابل للتنفيذ.
قبل
- صفحات PDF ذات نص
بعد
- أقسام صفحات HTML
قبل البدء: يحتوي HTML على نص مهرَّب فقط؛ ولا تُحفظ الخطوط الأصلية ولا الصور ولا التخطيط، ولا يُجرى OCR للمسوح.
المتابعة بملف PDF المصدرما الذي يتم الحصول عليه
تصدير النص المضمّن إلى مستند HTML مستقل بقسم واحد لكل صفحة. تُهرَّب رموز النص ولا يُنفَّذ بوصفه HTML. لا تُحفظ الخطوط الأصلية ولا الصور ولا الجداول ولا التخطيط؛ بلا OCR. الحدود: 10 MiB للمدخلات و200 صفحة و4 MiB للمخرجات.
الحدود والتفاصيل المهمة
10 MiB كحد أقصى للمدخلات، و200 صفحة، و4 MiB لمخرجات النص. تُبلغ المستندات الممسوحة ضوئيًا التي تفتقر إلى طبقة نصية عن خطأ بدلًا من استخراج ناجح زائف. قد لا يطابق ترتيب القراءة والأعمدة والخطوط التخطيط المرئي. هذا ليس OCR وليس تحويلًا من PDF إلى Word.
مثال
تصدير تقرير نصي وفتح ملف HTML الذي تم تنزيله محليًا. تتبع الأقسام ترتيب صفحات PDF؛ وتُوسم الصفحات الفارغة أو الممسوحة ضوئيًا ولا تُعامل بصمت كنص تم التعرف عليه.