דילוג לתוכן
0
  • דף הבית
  • חוקי הפורום
  • מדריכים
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • פופולרי
  • משתמשים
  • תרומות לאוצריא
  • צור קשר
  • דף הבית
  • חוקי הפורום
  • מדריכים
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • פופולרי
  • משתמשים
  • תרומות לאוצריא
  • צור קשר
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
לוגו אתר

פורום אוצריא

אוצריא - דף הבית
|
קח שותפות בהוספת ספרים
|
תרום לאוצריא
  1. דף הבית
  2. הוספת ספרים לספריית אוצריא
  3. להורדה | השלמת שו"ת פרי עץ חיים

להורדה | השלמת שו"ת פרי עץ חיים

מתוזמן נעוץ נעול הועבר הוספת ספרים לספריית אוצריא
הוספת ספריםדיקטה
19 פוסטים 7 כותבים 721 צפיות 4 עוקבים
  • מהישן לחדש
  • מהחדש לישן
  • הכי הרבה הצבעות
    תגובה
    • תגובה כנושא
    התחברו כדי לפרסם תגובה
    נושא זה נמחק. רק משתמשים עם הרשאות מתאימות יוכלו לצפות בו.
    • יום חדש מתחילי
      יום חדש מתחילי
      יום חדש מתחיל
      מנהל ספריית אוצריא
      כתב ב נערך לאחרונה על ידי יום חדש מתחיל
      #6

      @אהרן אני מבין שאתה לא רוצה לעזור לנו כ"כ, חבל.
      לא מבין כ"כ מה המטרה שלך בפוסט הזה, אם אתה לא רוצה לעזור לנו....

      לעצם העניין, @האדם-החושב עיין כאן: https://files.dicta.org.il/books_internal.json
      ולכאורה יוצא שאין שם בכלל את האפשרות להוריד את הגירסא של ה OCR מה שהיינו מורידים תמיד, אלא רק את: https://files.dicta.org.il/prietshaim/prietshaim__text_files.zip למרות שזה יורד בלי שום תגיות.
      או שיש לך פתרון אחר לחידה הזו.

      האדם החושבה תגובה 1 תגובה אחרונה
      0
      • יום חדש מתחילי יום חדש מתחיל

        @אהרן אני מבין שאתה לא רוצה לעזור לנו כ"כ, חבל.
        לא מבין כ"כ מה המטרה שלך בפוסט הזה, אם אתה לא רוצה לעזור לנו....

        לעצם העניין, @האדם-החושב עיין כאן: https://files.dicta.org.il/books_internal.json
        ולכאורה יוצא שאין שם בכלל את האפשרות להוריד את הגירסא של ה OCR מה שהיינו מורידים תמיד, אלא רק את: https://files.dicta.org.il/prietshaim/prietshaim__text_files.zip למרות שזה יורד בלי שום תגיות.
        או שיש לך פתרון אחר לחידה הזו.

        האדם החושבה
        האדם החושבה
        האדם החושב
        מפתח
        כתב ב נערך לאחרונה על ידי
        #7

        @יום-חדש-מתחיל
        פרי עץ חיים.rar

        import io
        import json
        import re
        import zipfile
        from pathlib import Path
        
        import requests
        from tqdm import tqdm
        
        BASE_URL = "https://files.dicta.org.il/prietshaim/"
        
        
        def get_toc() -> list[dict]:
            url = BASE_URL + "pages.json"
            response = requests.get(url)
            return response.json()
        
        
        def get_page_content(page: str) -> dict:
            response = requests.get(BASE_URL + page)
            if page.endswith(".zip"):
                with zipfile.ZipFile(io.BytesIO(response.content)) as z, z.open(z.namelist()[0]) as f:
                    return json.loads(f.read().decode("utf-8"))
        
            return response.json()
        
        
        def process_page(output_file: io.TextIOWrapper, content: list[dict]) -> None:
            for entry in content:
                if 'display' not in entry:
                    output_file.write(entry['str'])
                    continue
                for i in entry['display']:
                    val = i["c"]
                    heading = i.get("heading", False)
                    bold = i.get("bold", False)
                    if heading is True:
                        output_file.write(f"<big>{val}</big>")
                    elif bold is True:
                        output_file.write(f"<b>{val}</b>")
                    else:
                        output_file.write(val)
        
        
        def main() -> None:
            book_name = "פרי עץ חיים"
            author = ""
            target_file_path = Path(f"{book_name}.txt")
            toc = get_toc()
            with target_file_path.open("w", encoding="utf-8") as output_file:
                output_file.write(f"<h1>{book_name}</h1>\n{author}")
                for entry in tqdm(toc, total=len(toc)):
                    if entry["type"] == "index":
                        continue
                    page = entry["fileName"]
                    display_name = entry["displayName"]
                    output_file.write(f"\n<h2>{display_name}</h2>\n")
                    content = get_page_content(page)
                    process_page(output_file, content["tokens"])
            with target_file_path.open("r", encoding="utf-8") as output_file:
                content = output_file.read()
                content = re.sub(r'\n+', '\n', content)
            with target_file_path.open("w", encoding="utf-8") as output_file:
                output_file.write(content)
        
        
        if __name__ == "__main__":
            main()
        
        


        אגב, בזכות זה חקרתי קצת יותר את האתר של דיקטה ויתכן שיש דרך להוריד את הספרים שעדיין לא ערכו עם ירידות שורה, הדגשות וכו'.

        יום חדש מתחילי תגובה 1 תגובה אחרונה
        4
        • האדם החושבה האדם החושב

          @יום-חדש-מתחיל
          פרי עץ חיים.rar

          import io
          import json
          import re
          import zipfile
          from pathlib import Path
          
          import requests
          from tqdm import tqdm
          
          BASE_URL = "https://files.dicta.org.il/prietshaim/"
          
          
          def get_toc() -> list[dict]:
              url = BASE_URL + "pages.json"
              response = requests.get(url)
              return response.json()
          
          
          def get_page_content(page: str) -> dict:
              response = requests.get(BASE_URL + page)
              if page.endswith(".zip"):
                  with zipfile.ZipFile(io.BytesIO(response.content)) as z, z.open(z.namelist()[0]) as f:
                      return json.loads(f.read().decode("utf-8"))
          
              return response.json()
          
          
          def process_page(output_file: io.TextIOWrapper, content: list[dict]) -> None:
              for entry in content:
                  if 'display' not in entry:
                      output_file.write(entry['str'])
                      continue
                  for i in entry['display']:
                      val = i["c"]
                      heading = i.get("heading", False)
                      bold = i.get("bold", False)
                      if heading is True:
                          output_file.write(f"<big>{val}</big>")
                      elif bold is True:
                          output_file.write(f"<b>{val}</b>")
                      else:
                          output_file.write(val)
          
          
          def main() -> None:
              book_name = "פרי עץ חיים"
              author = ""
              target_file_path = Path(f"{book_name}.txt")
              toc = get_toc()
              with target_file_path.open("w", encoding="utf-8") as output_file:
                  output_file.write(f"<h1>{book_name}</h1>\n{author}")
                  for entry in tqdm(toc, total=len(toc)):
                      if entry["type"] == "index":
                          continue
                      page = entry["fileName"]
                      display_name = entry["displayName"]
                      output_file.write(f"\n<h2>{display_name}</h2>\n")
                      content = get_page_content(page)
                      process_page(output_file, content["tokens"])
              with target_file_path.open("r", encoding="utf-8") as output_file:
                  content = output_file.read()
                  content = re.sub(r'\n+', '\n', content)
              with target_file_path.open("w", encoding="utf-8") as output_file:
                  output_file.write(content)
          
          
          if __name__ == "__main__":
              main()
          
          


          אגב, בזכות זה חקרתי קצת יותר את האתר של דיקטה ויתכן שיש דרך להוריד את הספרים שעדיין לא ערכו עם ירידות שורה, הדגשות וכו'.

          יום חדש מתחילי
          יום חדש מתחילי
          יום חדש מתחיל
          מנהל ספריית אוצריא
          כתב ב נערך לאחרונה על ידי
          #8

          @האדם-החושב מדהים!!

          תגובה 1 תגובה אחרונה
          0
          • ק
            ק
            קטנטן
            עורך ספרים מקצועי
            כתב ב נערך לאחרונה על ידי
            #9

            @האדם-החושב אתה יכול להוריד גם את הספר הזה:
            https://library.dicta.org.il/book/alfeimenashetorah/alfeimenashetorah-003
            פשוט הגירסא שמורידים תמיד מכילה רק את העמוד הראשון.

            האדם החושבה תגובה 1 תגובה אחרונה
            0
            • אהרןא
              אהרןא
              אהרן
              כתב ב נערך לאחרונה על ידי
              #10

              למה לא להוריד באתר?

              יום חדש מתחילי תגובה 1 תגובה אחרונה
              0
              • ק קטנטן

                @האדם-החושב אתה יכול להוריד גם את הספר הזה:
                https://library.dicta.org.il/book/alfeimenashetorah/alfeimenashetorah-003
                פשוט הגירסא שמורידים תמיד מכילה רק את העמוד הראשון.

                האדם החושבה
                האדם החושבה
                האדם החושב
                מפתח
                כתב ב נערך לאחרונה על ידי האדם החושב
                #11

                @קטנטן
                אלפי מנשה על התורה.rar

                import io
                import json
                import re
                import zipfile
                from pathlib import Path
                
                import requests
                from tqdm import tqdm
                
                BASE_URL = "https://files.dicta.org.il/library-1-0/"
                
                
                def get_toc(url: str) -> list[dict]:
                    url = url + "pages.json"
                    response = requests.get(url)
                    return response.json()
                
                
                def get_page_content(url: str, page: str) -> dict:
                    response = requests.get(url + page)
                    if page.endswith(".zip"):
                        with zipfile.ZipFile(io.BytesIO(response.content)) as z, z.open(z.namelist()[0]) as f:
                            return json.loads(f.read().decode("utf-8"))
                
                    return response.json()
                
                
                def process_page(output_file: io.TextIOWrapper, content: list[dict]) -> None:
                    for entry in content:
                        if 'display' not in entry:
                            output_file.write(entry['str'])
                            continue
                        for i in entry['display']:
                            val = i["c"]
                            heading = i.get("heading", False)
                            bold = i.get("bold", False)
                            if heading is True:
                                output_file.write(f"<big>{val}</big>")
                            elif bold is True:
                                output_file.write(f"<b>{val}</b>")
                            else:
                                output_file.write(val)
                
                
                def main() -> None:
                    book_name = "alfeimenashetorah"
                    book_url = f"{BASE_URL}{book_name}/"
                    book_name = "אלפי מנשה על התורה"
                    author = ""
                    target_file_path = Path(f"{book_name}.txt")
                    toc = get_toc(book_url)
                    with target_file_path.open("w", encoding="utf-8") as output_file:
                        output_file.write(f"<h1>{book_name}</h1>\n{author}")
                        for entry in tqdm(toc, total=len(toc)):
                            page = entry["fileName"]
                            output_file.write("\n")
                            content = get_page_content(book_url, page)
                            process_page(output_file, content["tokens"])
                    with target_file_path.open("r", encoding="utf-8") as output_file:
                        content = output_file.read()
                        content = re.sub(r'\n+', '\n', content)
                    with target_file_path.open("w", encoding="utf-8") as output_file:
                        output_file.write(content)
                
                
                if __name__ == "__main__":
                    main()
                
                
                תגובה 1 תגובה אחרונה
                2
                • אהרןא אהרן

                  למה לא להוריד באתר?

                  יום חדש מתחילי
                  יום חדש מתחילי
                  יום חדש מתחיל
                  מנהל ספריית אוצריא
                  כתב ב נערך לאחרונה על ידי יום חדש מתחיל
                  #12

                  @אהרן כתב בלהורדה | השלמת שו"ת פרי עץ חיים:

                  למה לא להוריד באתר?

                  [אם התכוונת לאתר של דיקטה, אז התשובה היא] כי מה שיורד מהאתר זה בלי עיצוב כלל.

                  תגובה 1 תגובה אחרונה
                  0
                  • אהרןא
                    אהרןא
                    אהרן
                    כתב ב נערך לאחרונה על ידי
                    #13

                    לפי מה שאני רואה בספרים שיורד עם העיצוב של דיקטה (עד עכשיו ערכתי כבר 15 ספרים שלהם ב"ה), הרבה מזה הוא פשוט נוראה, הדגשות שלא נצרכות וכדו'. יותר קל לי לערוך ספר בלי העיצוב של דיקטה מאשר עם העיצוב שלהם.

                    תגובה 1 תגובה אחרונה
                    0
                    • יום חדש מתחילי
                      יום חדש מתחילי
                      יום חדש מתחיל
                      מנהל ספריית אוצריא
                      כתב ב נערך לאחרונה על ידי יום חדש מתחיל
                      #14

                      @אהרן לך אולי יותר קל לערוך ככה,
                      אבל אנחנו רוצים כן עם כל ההדגשות והכל.
                      לכן לאוצריא זה לא ייכנס. נקודה.

                      אם אתה לא מסתדר, וכן בכל בקשה ועזרה
                      נוכל בל"נ לתת לך עזרה ככל שידרש.

                      מ תגובה 1 תגובה אחרונה
                      0
                      • אהרןא
                        אהרןא
                        אהרן
                        כתב ב נערך לאחרונה על ידי
                        #15

                        רק עם היה לי פה דוגמא של העיצוב שלהם, זה זוועה ממש. בכל מקרה תוכל להסביר לי מה ההדגשות שאתה מדבר? זה רק הדגשת מילה ראשונה. כל הכותרות זה כך: <b>הלכות</b> <b>עכו"ם</b> . וזה לא עוזר בכלל. קיצור מה העניין של ההדגשות שלהם?

                        תגובה 1 תגובה אחרונה
                        0
                        • D9D
                          D9D
                          D9
                          כתב ב נערך לאחרונה על ידי
                          #16

                          רוב ההדגשות שלהם אם לא כולם הם על כותרות שבין כה לא נפק"מ לאוצריא
                          ותחילת קטע שניתן לעשות את זה בקלות בתוכנה היעודית

                          תגובה 1 תגובה אחרונה
                          1
                          • D9D
                            D9D
                            D9
                            כתב ב נערך לאחרונה על ידי
                            #17

                            לי אישית זה עזר כי כך היה לי יותר קל למצוא כותרות שהושמטו מסיבות כאילו ואחרות מההדגשה האוטומטית
                            אבל אני לא מבין למה מי שזה יותר קל לו לא יכול להסיר את זה

                            תגובה 1 תגובה אחרונה
                            0
                            • יום חדש מתחילי יום חדש מתחיל

                              @אהרן לך אולי יותר קל לערוך ככה,
                              אבל אנחנו רוצים כן עם כל ההדגשות והכל.
                              לכן לאוצריא זה לא ייכנס. נקודה.

                              אם אתה לא מסתדר, וכן בכל בקשה ועזרה
                              נוכל בל"נ לתת לך עזרה ככל שידרש.

                              מ
                              מ
                              מישהו 1
                              כתב ב נערך לאחרונה על ידי
                              #18

                              @יום-חדש-מתחיל כתב בלהורדה | השלמת שו"ת פרי עץ חיים:

                              @אהרן לך אולי יותר קל לערוך ככה,
                              אבל אנחנו רוצים כן עם כל ההדגשות והכל.
                              לכן לאוצריא זה לא ייכנס. נקודה.

                              אם אתה לא מסתדר, וכן בכל בקשה ועזרה
                              נוכל בל"נ לתת לך עזרה ככל שידרש.

                              איך המודגש מסתדר עם דבריך כאן ?

                              תגובה 1 תגובה אחרונה
                              1
                              • יום חדש מתחילי
                                יום חדש מתחילי
                                יום חדש מתחיל
                                מנהל ספריית אוצריא
                                כתב ב נערך לאחרונה על ידי יום חדש מתחיל
                                #19

                                @מישהו-1 אתה שואל שאלה מצויינת!
                                והתשובה ממש פשוטה.

                                אני כרגע בתפקיד שהקב"ה שם אותי בו, ואני משתדל למלא את תפקידי בשלמות כמו שאני מבין את זה.
                                אני ממש משתדל הרבה מאוד, אתה אפילו לא יודע עד כמה. (וכמובן הכל בלי לקבל אגורה שחוקה).

                                בכל מה שהוא לא קשור לתפקיד שלי, כגון לגבי הוספת ספרים,
                                זה לא ממש מתאים לאופי שלי, גם במצ'ינגים לא הסתדרתי אף פעם...
                                ולכן אני באמת לא מבין למה אני קשור לזה יותר ממך.
                                בסופו של דבר, אין לי תועלת מהתוכנה הזאת יותר מהתועלת שיש לך, אני לא מרוויח עלי' שום דבר, והרווח הוא של כולנו יחד, ושל כל לומדי התורה הקדושה.

                                לכן כל מי שמוכן לעזור בכל תחום שהוא בהתנדבות גמורה - מצוין,
                                מה שייך לבוא בטענות על מישהו למה הוא לא עושה משהו?
                                משא"כ על מי שעושה משהו ש [לכה"פ] לדעתו הוא לא טוב, זה באמת לא בסדר.

                                תגובה 1 תגובה אחרונה
                                7

                                שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.

                                נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.

                                בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗

                                הרשמה התחברות

                                • התחברות

                                • אין לך חשבון עדיין? הרשמה

                                • התחברו או הירשמו כדי לחפש.
                                • פוסט ראשון
                                  פוסט אחרון