ממיר PDF לטקסט
חלץ את הטקסט הפשוט משכבת הטקסט של PDF בדפדפן, עמוד אחר עמוד, מוכן להעתקה או הורדה.
תוצאה
קובץ PDF קל לקריאה אך מסורבל לשימוש חוזר: אי אפשר תמיד לבחור את הטקסט שלו בצורה נקייה, והעתקת עמוד אחר עמוד ביד היא מייגעת. כלי זה מחלץ את הטקסט הפשוט משכבת הטקסט של PDF במעבר אחד, כולו בתוך הדפדפן שלך, ומחזיר אותו מוכן להעתקה או הורדה - ללא העלאה, ללא חשבון, ללא סימן מים.
החילוץ עובד עמוד אחר עמוד. הטקסט של כל עמוד נמשך משכבת הטקסט של המסמך עצמו ומופרד על ידי סמן ברור של "עמוד N", כך שדוח בן חמישים עמודים נשאר מאורגן במקום להתמוטט לתוך קיר אחד לא מובחן של מילים. התוצאה נוחתת בתיבת טקסט שתוכל לקרוא, לבחור, להעתיק ללוח או לשמור כקובץ txt שנפתח בכל מקום.
הכנות חשובה כאן: קובצי PDF רבים הם סריקות - צילומי נייר ללא שכבת טקסט כלל. כשזה קורה, שום כמות של חילוץ לא תמצא מילים, אז במקום להחזיר קובץ ריק בשקט, הכלי מזהה את התוצאה הריקה ואומר לך שהמסמך הוא סריקה, ומכוון אותך לכלי תמונה לטקסט (OCR) שיכול לקרוא פיקסלים. זהו מחלץ טקסט, לא מנוע OCR, והוא אינו מתיימר להמיר קובץ PDF למסמך Word הניתן לעריכה.
מכיוון שכל התהליך פועל במחשב האישי שלך דרך מנוע pdf.js, חוזים, הצהרות ורשומות חסויים לעולם לא עוזבים את המכשיר - אין מגבלות עמוד ואין שרת הלוך ושוב. אם אתה צריך את הדפים כתמונות ולא כטקסט, הכלי PDF ל-JPG מעבד כל עמוד לתמונה במקום זאת.