דילוג לתוכן
פשוט PDF

עברית הפוכה כשמעתיקים מ-PDF

עודכן: · עם קישור למקור

PDF שומר טקסט לפי המיקום שלו על הדף, ולא תמיד לפי סדר הקריאה. תוכנות שיצרו את הקובץ שומרות לעיתים את האותיות העבריות בסדר חזותי, משמאל לימין, ולכן כשמעתיקים אותן לוורד או לוואטסאפ המילים יוצאות הפוכות. אפשר לנסות להעתיק מתוכנה אחרת (דפדפן או קורא PDF אחר), ואם עדיין יוצא הפוך, להפוך את הטקסט בכלי ייעודי.

שולחן עבודה עם מחשב נייד שמציג מסמך, ערימת דפים וטלפון

למה זה קורה

טקסט עברי מוצג בתוכנות לפי אלגוריתם הכיווניות של יוניקוד, שקובע איך מסדרים על המסך אותיות מימין לשמאל ומספרים ומילים לועזיות משמאל לימין. ב-PDF התוכנה שיצרה את הקובץ כבר "ציירה" את האותיות במקומן. אם היא שמרה אותן בסדר החזותי ולא בסדר הלוגי, ההעתקה מחזירה אותן הפוכות.

מקור: Unicode: Bidirectional Algorithm (UAX #9)

מה לנסות

  1. להעתיק מקורא PDF אחר: דפדפן (כרום, אדג׳) או Acrobat Reader. לפעמים אחד מהם מחזיר סדר נכון.
  2. לפתוח בוורד או בגוגל דוקס, שמנסים לשחזר את סדר הקריאה.
  3. אם הטקסט עדיין הפוך: להדביק אותו בכלי להיפוך טקסט באתר האחות אותיות.
  4. בסריקות: הטקסט הוא תמונה, וצריך זיהוי טקסט (OCR) ולא העתקה.

שאלות נפוצות

למה העברית יוצאת הפוכה כשמעתיקים מ-PDF?

כי חלק מהתוכנות שומרות ב-PDF את האותיות בסדר חזותי ולא בסדר קריאה. ההעתקה מחזירה אותן הפוכות.

איך הופכים טקסט עברי הפוך?

מעתיקים אותו לכלי להיפוך טקסט, כמו באתר האחות אותיות, ומעתיקים בחזרה.

למה אי אפשר להעתיק מסריקה?

כי בסריקה הטקסט הוא תמונה. צריך זיהוי טקסט (OCR), למשל בגוגל דרייב.

ההוראות לטלפונים ולתוכנות נכתבו לפי דפי העזרה של היצרנים, עם קישור בכל סעיף. תפריטים משתנים בין גרסאות, ולכן אם משהו נראה אחרת אצלכם, בדקו בדף העזרה. הכלים באתר עובדים בדפדפן, בלי להעלות קבצים.