צופה PDF+OCR

קבצים אחרונים
    אין עדיין קבצים אחרונים
    לא נבחר קובץ -
    📡 בעוד 5 ש'
    📄
    גרור לכאן קובץ או לחץ על "פתיחת קובץ" למעלה
    אפשר לפתוח PDF, תמונה או קובץ טקסט ישירות, בלי להוסיף אותו לספרייה
    טקסט
    אין עדיין טקסט להצגה

    🆕 מה חדש

    v2.6.3
    • פס הכותרת וסרגל הכלים מוזגו לרצועה אחת - חוסך שורת כותרת נפרדת ומפנה עוד מקום למסך.
    v2.6.2
    • פקדי הצילום עברו לרווח הפנוי שבסרגל העליון (ליד הכותרת), בלי להסתיר או להזיז שום כפתור בסרגל הכלים.
    v2.6.0
    • פקדי "צלם ובחר כאן" עברו לתוך סרגל הכלים העליון - כבר לא תופסים שורה נוספת על המסך.
    v2.5.7
    • תוקן: "צלם עכשיו" תפס את התוסף עצמו במקום את העמוד היעד (כי חזרה לתוסף כדי ללחוץ שינתה את מה שמוצג). עכשיו הצילום קורה אוטומטית אחרי ספירה לאחור, בלי צורך לחזור לתוסף.
    v2.5.6
    • 🖥️ "צלם ובחר כאן" כבר לא צולם מיד - השיתוף נשאר פעיל כדי לאפשר לעבור לעמוד אחר באוצריא ואז לחזור וללחוץ "📸 צלם עכשיו" (ניסיוני - אם לא עובד אצלכם, "✂️ הדבק גזרת מסך וחלץ" הוא החלופה הבטוחה).
    v2.5.5
    • תוקן באג בכלי "🖥️ צלם ובחר כאן": מלבן הבחירה המשיך לזוז עם העכבר גם אחרי שחרור הכפתור, מה שמנע לחיצה נוחה על "חלץ" עם עכבר (עבד רק במגע). עכשיו הבחירה ננעלת במקומה מיד עם שחרור העכבר.
    v2.5.4
    • סרגל הכלים צומצם: כפתורים משניים (הדבק גזרת מסך, צלם ובחר כאן, טקסט מוטבע, OCR לעמוד, שמירה עם טקסט מוטבע) הפכו לאיקונים בלבד עם תיאור מלא ב-tooltip - כדי שהסרגל לא ישבור לכמה שורות בפאנל צר.
    • עבר לגרסה יציבה.
    v2.5.3
    • ניקוי עיצוב: הוסרו צבעים מקודדים בקוד ה-CSS לטובת עקיבה מלאה אחרי ערכת הנושא של אוצריא (כולל תיקון הדגשת הבחירה בכלי צילום המסך שהייתה נשארת בצבע קבוע).
    • נוקו מה-manifest הרשאות שממילא ניתנות אוטומטית לכל תוסף - ללא שינוי בפועל.
    v2.5.2
    • התוסף עבר לניהול גרסאות במאגר גיט ציבורי עם פרסום אוטומטי לחנות - שינוי תשתיתי, ללא השפעה על השימוש.
    v2.4.0
    • כפתור הסרגל (✂️) בספר PDF בספרייה חזר לנסות קודם טקסט מאונדקס של אוצריא (כמו במקור) - ורק אם אין, מציע לגזור. שני המקרים מוצגים כהתראה בספרייה עצמה, בלי לעבור לתוסף (אלא אם לוחצים על ההתראה).
    • נוסף כפתור "🖥️ צלם ובחר כאן" - צילום מסך ובחירת אזור עם גרירה בתוך התוסף עצמו, כאלטרנטיבה לכלי הגזירה של המערכת.
    v2.3.1
    • כפתור הסרגל (✂️) בספר PDF בספרייה כבר לא מנסה טקסט מאונדקס שכמעט תמיד ריק - עכשיו מפעיל ישירות את חילוץ הטקסט מגזרת המסך שבלוח, ומנחה לגזור אם הלוח ריק.
    v2.3.0
    • נוסף כפתור "✂️ הדבק גזרת מסך וחלץ" - גוזרים עם כלי הגזירה של המערכת (Win+Shift+S) כל חלון שרואים, ומדביקים בתוסף (בכפתור או ב-Ctrl+V) כדי לחלץ ממנו טקסט - כולל עמוד PDF מהספרייה שאין לתוסף גישה ישירה לקובץ שלו.
    • אייקון כפתור סרגל הכלים בקורא הוחלף למספריים (✂️) בהתאם.
    v2.2.2
    • תוקן קישור ה-GitHub בפאנל אודות (github.com/Otzaria במקום המאגר הישן github.com/Sivan22).
    • הובהר בבקשת הפיצ'ר #3 שאין דרך "לייצא" עמוד PDF מספר בספרייה לתוך התוסף - זו מגבלה מכוונת של אוצריא (ראו שם).
    v2.2.1
    • עודכנה כתובת המייל לשליחת משוב.
    v2.2.0
    • נוסף כפתור "חלץ טקסט" בסרגל הכלים של הקורא - עובד גם בספרי PDF בספרייה (בניגוד לתפריט לחיצה ימנית, שאוצריא לא מפעילה במסך PDF).
    • הרישום עבר להצהרה ישירה ב-manifest.json - התוסף פעיל תמיד בספרייה, ואין יותר צורך ב"הרצה ברקע" (ההרשאה הרגישה app.run_on_startup הוסרה).
    • הודעת "לא נמצא טקסט" בספרי PDF בספרייה עודכנה להסביר את הסיבה האמיתית (ראו "בקשות פיצ'ר" למטה) במקום לרמוז בטעות שמדובר בעמוד סרוק.
    • כפתור המשוב עבר לתוך "אודות" כטופס קבוע במקום חלון prompt.
    • עיצוב מרענן: פס כותרת קבוע כמו במסכי הספרים של אוצריא, לפי DESIGN_GUIDE.md.

    צופה PDF עם OCR

    פתיחת קבצי PDF, תמונה או טקסט באוצריא ישירות, ללא צורך להוסיף אותם לספרייה. לתמונות ולעמודי PDF סרוקים ללא שכבת טקסט - ניתן להריץ זיהוי טקסט (OCR) בעברית לפי דרישה.

    🖱️ לחיצה ימנית על עמוד PDF/תמונה פתוח בתוסף מציגה קיצור "חלץ טקסט" - מנסה טקסט מוטבע קודם, ואם אין נופל אוטומטית ל-OCR.

    📚 בנוסף, בכל הספרייה של אוצריא (בספרי טקסט) - לחיצה ימנית על הקורא מציגה גם היא פריט "חלץ טקסט".

    📄 בספרי PDF בספרייה - כפתור ✂️ בסרגל הכלים של הקורא מנסה קודם טקסט שאוצריא כבר אינדקסה לספר (ומעתיק אותו ללוח אם נמצא) - ההודעה מופיעה ישירות בספרייה, בלי לצאת ממנה. אם לא נמצא טקסט מאונדקס (המצב הנפוץ לספרי PDF סרוקים, שכן לתוסף אין גישה לקובץ עצמו) - תופיע התראה שמציעה לגזור את האזור הרצוי עם כלי הגזירה של המערכת (Win+Shift+S בחלונות, Cmd+Shift+4 ב-Mac), עם אפשרות ללחוץ על ההתראה כדי לפתוח את התוסף. בתוך התוסף אפשר להדביק את הגזרה עם "✂️ הדבק גזרת מסך וחלץ" (או Ctrl+V), או לצלם ולבחור אזור בתוך התוסף עצמו עם "🖥️ צלם ובחר כאן" - בשני המקרים ינסה קודם טקסט מוטבע ואם אין יפעיל OCR אוטומטית.

    💡 שיטת הגזירה עובדת עם כל תוכנה שמציגה PDF (לא רק אוצריא), ולא רק עבור ספרי PDF בספרייה - אפשר להשתמש בה בכל מצב שבו קשה לפתוח את הקובץ המקורי ישירות בתוסף.

    💡 משוב על התוסף

    נוצר באמצעות Claude ע"י חד בדרא


    מנוע ה-OCR ושפת העברית כלולים בתוסף - זיהוי טקסט (OCR) מוכן לשימוש ללא צורך בהתקנה נוספת.

    אם רוצים גישה למנוע ה-OCR המובנה של Windows בעתיד, זה ידרוש בקשת פיצ'ר לאוצריא עצמה (התוסף לא יכול לעשות את זה בכוחות עצמו) — שהיא תוסיף permission חדשה שקוראת ל-OCR הנייטיבי מצד ה-Dart/Flutter וחושפת אותה כ-API לתוספים. בינתיים Tesseract.js הוא האפשרות היחידה שזמינה לתוסף.

    🛠️ בתכנון: שמירת קובץ PDF עם הטקסט שזוהה ב-OCR מוטבע בו כשכבת טקסט נסתרת (PDF ניתן לחיפוש), בדומה לתוכנות OCR מסחריות.


    🌐 שפות OCR

    עברית מובנית בתוסף. אפשר להוסיף שפות נוספות (כמו אנגלית) בלי לבנות גרסה חדשה של התוסף:

    1. מורידים קובץ שפה (סיומת .traineddata) מהמאגר הרשמי של Tesseract, למשל עבור אנגלית:
      https://github.com/tesseract-ocr/tessdata_fast/raw/main/eng.traineddata
      (אפשר להחליף eng בקוד כל שפה אחרת מאותו מאגר)
    2. לוחצים כאן ובוחרים את הקובץ שהורד:

    🔧 בקשות פיצ'ר פתוחות לאוצריא

    דברים שהתוסף לא יכול לפתור בכוחות עצמו - דורשים שינוי באוצריא עצמה. אפשר לפתוח עליהם Issue ב-github.com/Otzaria/otzaria:

    1. תמיכה בפריטי תוסף בתפריט הקשר במסך PDF

    לפי DESIGN_GUIDE.md: "תפריט ההקשר מוצג במסכי טקסט בלבד (CombinedView ו-PageShape). מסך PDF אינו תומך בפריטי תוסף בתפריט ההקשר כרגע." אומת בפועל - פריט מהתוסף (למשל "חלץ טקסט") נרשם ועובד בספרי טקסט, אך לא מופיע בכלל בלחיצה ימנית על ספרי PDF בספרייה. מגרסה 2.1.0 יש עקיפה חלקית - כפתור בסרגל הכלים (`reader.addToolbarItem`) כן נתמך במסך PDF - אבל עדיין כדאי לבקש תמיכה מלאה גם בתפריט ההקשר, לעקביות עם ספרי טקסט.

    2. גישה למנוע ה-OCR המובנה של Windows

    תוספים רצים בדף מבודד ללא גישה ל-API נייטיביים, ולכן חייבים להטמיע מנוע OCR מבוסס-WASM (Tesseract.js) בתוך התוסף עצמו - כבד ופחות מדויק ממנוע נייטיבי. בקשה: הוספת permission ו-API (למשל ocr.recognizeImage) שמפעיל את מנוע ה-OCR המובנה של המערכת (Windows.Media.Ocr בחלונות) מצד ה-Dart/Flutter של אוצריא, ומחזיר את הטקסט המזוהה לתוסף.

    3. גישה לקובץ/לתמונת עמוד של ספרי PDF בספרייה

    אין כיום API שחושף לתוסף את בייטים של קובץ ה-PDF או תמונת עמוד עבור ספר PDF שמנוהל בספריית אוצריא (בשונה מ-fs.pickUserFile, שעובד רק על קובץ שהמשתמש בוחר ידנית). זה מכוון: גם library.resolveBooks מציינת מפורש "בלי לחשוף נתיבים". לכן, "חלץ טקסט" על ספר כזה יכול להחזיר רק טקסט שאוצריא כבר אינדקסה בעצמה - לא לקרוא את שכבת הטקסט המוטבעת בקובץ בזמן אמת, ובוודאי לא להריץ עליו OCR. מגרסה 2.3.0 יש עקיפה נוחה (גזירת מסך + הדבקה בתוסף - ראו למעלה) שהופכת את זה לפחות דחוף, אך עדיין כדאי לבקש API רשמי כמו reader.getPdfPageImage (או חשיפת נתיב/בייטים מוגבלת-הרשאה, בהסכמת המשתמש) לחוויה חלקה יותר בלי צורך בגזירה ידנית.

    🐞 מגבלות ידועות ולא-באגים: קובץ TIFF מרובה-עמודים מציג רק את העמוד הראשון (מוצג בסטטוס בזמן פתיחה). גודל התוסף (כ-4.4MB) נובע ממנוע ה-OCR (Tesseract.js) המובנה בו לתמיכה מלאה במצב offline.


    🔧 אבחון

    מצב מנוע ה-OCR:

    טרם נבדק
    גררו לסימון האזור לחילוץ, ואז לחצו "✂️ חלץ מהבחירה" (Esc לביטול)
    צילום מסך