דילוג לתוכן
0
  • דף הבית
  • חוקי הפורום
  • מדריכים
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • פופולרי
  • משתמשים
  • תרומות לאוצריא
  • צור קשר
  • דף הבית
  • חוקי הפורום
  • מדריכים
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • פופולרי
  • משתמשים
  • תרומות לאוצריא
  • צור קשר
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
לוגו אתר

פורום אוצריא

אוצריא - דף הבית
|
קח שותפות בהוספת ספרים
|
תרום לאוצריא
  1. דף הבית
  2. הוספת ספרים לספריית אוצריא
  3. להורדה | השלמת שו"ת פרי עץ חיים

להורדה | השלמת שו"ת פרי עץ חיים

מתוזמן נעוץ נעול הועבר הוספת ספרים לספריית אוצריא
הוספת ספריםדיקטה
19 פוסטים 7 כותבים 721 צפיות 4 עוקבים
  • מהישן לחדש
  • מהחדש לישן
  • הכי הרבה הצבעות
    תגובה
    • תגובה כנושא
    התחברו כדי לפרסם תגובה
    נושא זה נמחק. רק משתמשים עם הרשאות מתאימות יוכלו לצפות בו.
    • אהרןא
      אהרןא
      אהרן
      כתב ב נערך לאחרונה על ידי
      #2

      השלמת שות פרי עץ חיים_123142.txt

      תגובה 1 תגובה אחרונה
      1
      • יום חדש מתחילי
        יום חדש מתחילי
        יום חדש מתחיל
        מנהל ספריית אוצריא
        כתב ב נערך לאחרונה על ידי
        #3

        מהיכן המקור?
        תביא קישור מדוייק.
        לא ככה אנחנו עובדים.

        לכל דבר יש דרך וצורה איך מורידים, ואיך מטפלים.

        תגובה 1 תגובה אחרונה
        0
        • י. פל.י
          י. פל.י
          י. פל.
          כתב ב נערך לאחרונה על ידי
          #4

          @אהרן
          אם זה מדיקטה, ממש חבל!
          אתה פשוט יכול להודיע לנו, וזה יבוצע כשאר ספרי דיקטה.

          תגובה 1 תגובה אחרונה
          1
          • אהרןא
            אהרןא
            אהרן
            כתב ב נערך לאחרונה על ידי
            #5

            למה שלא תעשו חיפוש פשוט בגוגל פרי עץ חיים דיקטה, תקבלו תשובות לשאלות שלכם.

            תגובה 1 תגובה אחרונה
            0
            • יום חדש מתחילי
              יום חדש מתחילי
              יום חדש מתחיל
              מנהל ספריית אוצריא
              כתב ב נערך לאחרונה על ידי יום חדש מתחיל
              #6

              @אהרן אני מבין שאתה לא רוצה לעזור לנו כ"כ, חבל.
              לא מבין כ"כ מה המטרה שלך בפוסט הזה, אם אתה לא רוצה לעזור לנו....

              לעצם העניין, @האדם-החושב עיין כאן: https://files.dicta.org.il/books_internal.json
              ולכאורה יוצא שאין שם בכלל את האפשרות להוריד את הגירסא של ה OCR מה שהיינו מורידים תמיד, אלא רק את: https://files.dicta.org.il/prietshaim/prietshaim__text_files.zip למרות שזה יורד בלי שום תגיות.
              או שיש לך פתרון אחר לחידה הזו.

              האדם החושבה תגובה 1 תגובה אחרונה
              0
              • יום חדש מתחילי יום חדש מתחיל

                @אהרן אני מבין שאתה לא רוצה לעזור לנו כ"כ, חבל.
                לא מבין כ"כ מה המטרה שלך בפוסט הזה, אם אתה לא רוצה לעזור לנו....

                לעצם העניין, @האדם-החושב עיין כאן: https://files.dicta.org.il/books_internal.json
                ולכאורה יוצא שאין שם בכלל את האפשרות להוריד את הגירסא של ה OCR מה שהיינו מורידים תמיד, אלא רק את: https://files.dicta.org.il/prietshaim/prietshaim__text_files.zip למרות שזה יורד בלי שום תגיות.
                או שיש לך פתרון אחר לחידה הזו.

                האדם החושבה
                האדם החושבה
                האדם החושב
                מפתח
                כתב ב נערך לאחרונה על ידי
                #7

                @יום-חדש-מתחיל
                פרי עץ חיים.rar

                import io
                import json
                import re
                import zipfile
                from pathlib import Path
                
                import requests
                from tqdm import tqdm
                
                BASE_URL = "https://files.dicta.org.il/prietshaim/"
                
                
                def get_toc() -> list[dict]:
                    url = BASE_URL + "pages.json"
                    response = requests.get(url)
                    return response.json()
                
                
                def get_page_content(page: str) -> dict:
                    response = requests.get(BASE_URL + page)
                    if page.endswith(".zip"):
                        with zipfile.ZipFile(io.BytesIO(response.content)) as z, z.open(z.namelist()[0]) as f:
                            return json.loads(f.read().decode("utf-8"))
                
                    return response.json()
                
                
                def process_page(output_file: io.TextIOWrapper, content: list[dict]) -> None:
                    for entry in content:
                        if 'display' not in entry:
                            output_file.write(entry['str'])
                            continue
                        for i in entry['display']:
                            val = i["c"]
                            heading = i.get("heading", False)
                            bold = i.get("bold", False)
                            if heading is True:
                                output_file.write(f"<big>{val}</big>")
                            elif bold is True:
                                output_file.write(f"<b>{val}</b>")
                            else:
                                output_file.write(val)
                
                
                def main() -> None:
                    book_name = "פרי עץ חיים"
                    author = ""
                    target_file_path = Path(f"{book_name}.txt")
                    toc = get_toc()
                    with target_file_path.open("w", encoding="utf-8") as output_file:
                        output_file.write(f"<h1>{book_name}</h1>\n{author}")
                        for entry in tqdm(toc, total=len(toc)):
                            if entry["type"] == "index":
                                continue
                            page = entry["fileName"]
                            display_name = entry["displayName"]
                            output_file.write(f"\n<h2>{display_name}</h2>\n")
                            content = get_page_content(page)
                            process_page(output_file, content["tokens"])
                    with target_file_path.open("r", encoding="utf-8") as output_file:
                        content = output_file.read()
                        content = re.sub(r'\n+', '\n', content)
                    with target_file_path.open("w", encoding="utf-8") as output_file:
                        output_file.write(content)
                
                
                if __name__ == "__main__":
                    main()
                
                


                אגב, בזכות זה חקרתי קצת יותר את האתר של דיקטה ויתכן שיש דרך להוריד את הספרים שעדיין לא ערכו עם ירידות שורה, הדגשות וכו'.

                יום חדש מתחילי תגובה 1 תגובה אחרונה
                4
                • האדם החושבה האדם החושב

                  @יום-חדש-מתחיל
                  פרי עץ חיים.rar

                  import io
                  import json
                  import re
                  import zipfile
                  from pathlib import Path
                  
                  import requests
                  from tqdm import tqdm
                  
                  BASE_URL = "https://files.dicta.org.il/prietshaim/"
                  
                  
                  def get_toc() -> list[dict]:
                      url = BASE_URL + "pages.json"
                      response = requests.get(url)
                      return response.json()
                  
                  
                  def get_page_content(page: str) -> dict:
                      response = requests.get(BASE_URL + page)
                      if page.endswith(".zip"):
                          with zipfile.ZipFile(io.BytesIO(response.content)) as z, z.open(z.namelist()[0]) as f:
                              return json.loads(f.read().decode("utf-8"))
                  
                      return response.json()
                  
                  
                  def process_page(output_file: io.TextIOWrapper, content: list[dict]) -> None:
                      for entry in content:
                          if 'display' not in entry:
                              output_file.write(entry['str'])
                              continue
                          for i in entry['display']:
                              val = i["c"]
                              heading = i.get("heading", False)
                              bold = i.get("bold", False)
                              if heading is True:
                                  output_file.write(f"<big>{val}</big>")
                              elif bold is True:
                                  output_file.write(f"<b>{val}</b>")
                              else:
                                  output_file.write(val)
                  
                  
                  def main() -> None:
                      book_name = "פרי עץ חיים"
                      author = ""
                      target_file_path = Path(f"{book_name}.txt")
                      toc = get_toc()
                      with target_file_path.open("w", encoding="utf-8") as output_file:
                          output_file.write(f"<h1>{book_name}</h1>\n{author}")
                          for entry in tqdm(toc, total=len(toc)):
                              if entry["type"] == "index":
                                  continue
                              page = entry["fileName"]
                              display_name = entry["displayName"]
                              output_file.write(f"\n<h2>{display_name}</h2>\n")
                              content = get_page_content(page)
                              process_page(output_file, content["tokens"])
                      with target_file_path.open("r", encoding="utf-8") as output_file:
                          content = output_file.read()
                          content = re.sub(r'\n+', '\n', content)
                      with target_file_path.open("w", encoding="utf-8") as output_file:
                          output_file.write(content)
                  
                  
                  if __name__ == "__main__":
                      main()
                  
                  


                  אגב, בזכות זה חקרתי קצת יותר את האתר של דיקטה ויתכן שיש דרך להוריד את הספרים שעדיין לא ערכו עם ירידות שורה, הדגשות וכו'.

                  יום חדש מתחילי
                  יום חדש מתחילי
                  יום חדש מתחיל
                  מנהל ספריית אוצריא
                  כתב ב נערך לאחרונה על ידי
                  #8

                  @האדם-החושב מדהים!!

                  תגובה 1 תגובה אחרונה
                  0
                  • ק
                    ק
                    קטנטן
                    עורך ספרים מקצועי
                    כתב ב נערך לאחרונה על ידי
                    #9

                    @האדם-החושב אתה יכול להוריד גם את הספר הזה:
                    https://library.dicta.org.il/book/alfeimenashetorah/alfeimenashetorah-003
                    פשוט הגירסא שמורידים תמיד מכילה רק את העמוד הראשון.

                    האדם החושבה תגובה 1 תגובה אחרונה
                    0
                    • אהרןא
                      אהרןא
                      אהרן
                      כתב ב נערך לאחרונה על ידי
                      #10

                      למה לא להוריד באתר?

                      יום חדש מתחילי תגובה 1 תגובה אחרונה
                      0
                      • ק קטנטן

                        @האדם-החושב אתה יכול להוריד גם את הספר הזה:
                        https://library.dicta.org.il/book/alfeimenashetorah/alfeimenashetorah-003
                        פשוט הגירסא שמורידים תמיד מכילה רק את העמוד הראשון.

                        האדם החושבה
                        האדם החושבה
                        האדם החושב
                        מפתח
                        כתב ב נערך לאחרונה על ידי האדם החושב
                        #11

                        @קטנטן
                        אלפי מנשה על התורה.rar

                        import io
                        import json
                        import re
                        import zipfile
                        from pathlib import Path
                        
                        import requests
                        from tqdm import tqdm
                        
                        BASE_URL = "https://files.dicta.org.il/library-1-0/"
                        
                        
                        def get_toc(url: str) -> list[dict]:
                            url = url + "pages.json"
                            response = requests.get(url)
                            return response.json()
                        
                        
                        def get_page_content(url: str, page: str) -> dict:
                            response = requests.get(url + page)
                            if page.endswith(".zip"):
                                with zipfile.ZipFile(io.BytesIO(response.content)) as z, z.open(z.namelist()[0]) as f:
                                    return json.loads(f.read().decode("utf-8"))
                        
                            return response.json()
                        
                        
                        def process_page(output_file: io.TextIOWrapper, content: list[dict]) -> None:
                            for entry in content:
                                if 'display' not in entry:
                                    output_file.write(entry['str'])
                                    continue
                                for i in entry['display']:
                                    val = i["c"]
                                    heading = i.get("heading", False)
                                    bold = i.get("bold", False)
                                    if heading is True:
                                        output_file.write(f"<big>{val}</big>")
                                    elif bold is True:
                                        output_file.write(f"<b>{val}</b>")
                                    else:
                                        output_file.write(val)
                        
                        
                        def main() -> None:
                            book_name = "alfeimenashetorah"
                            book_url = f"{BASE_URL}{book_name}/"
                            book_name = "אלפי מנשה על התורה"
                            author = ""
                            target_file_path = Path(f"{book_name}.txt")
                            toc = get_toc(book_url)
                            with target_file_path.open("w", encoding="utf-8") as output_file:
                                output_file.write(f"<h1>{book_name}</h1>\n{author}")
                                for entry in tqdm(toc, total=len(toc)):
                                    page = entry["fileName"]
                                    output_file.write("\n")
                                    content = get_page_content(book_url, page)
                                    process_page(output_file, content["tokens"])
                            with target_file_path.open("r", encoding="utf-8") as output_file:
                                content = output_file.read()
                                content = re.sub(r'\n+', '\n', content)
                            with target_file_path.open("w", encoding="utf-8") as output_file:
                                output_file.write(content)
                        
                        
                        if __name__ == "__main__":
                            main()
                        
                        
                        תגובה 1 תגובה אחרונה
                        2
                        • אהרןא אהרן

                          למה לא להוריד באתר?

                          יום חדש מתחילי
                          יום חדש מתחילי
                          יום חדש מתחיל
                          מנהל ספריית אוצריא
                          כתב ב נערך לאחרונה על ידי יום חדש מתחיל
                          #12

                          @אהרן כתב בלהורדה | השלמת שו"ת פרי עץ חיים:

                          למה לא להוריד באתר?

                          [אם התכוונת לאתר של דיקטה, אז התשובה היא] כי מה שיורד מהאתר זה בלי עיצוב כלל.

                          תגובה 1 תגובה אחרונה
                          0
                          • אהרןא
                            אהרןא
                            אהרן
                            כתב ב נערך לאחרונה על ידי
                            #13

                            לפי מה שאני רואה בספרים שיורד עם העיצוב של דיקטה (עד עכשיו ערכתי כבר 15 ספרים שלהם ב"ה), הרבה מזה הוא פשוט נוראה, הדגשות שלא נצרכות וכדו'. יותר קל לי לערוך ספר בלי העיצוב של דיקטה מאשר עם העיצוב שלהם.

                            תגובה 1 תגובה אחרונה
                            0
                            • יום חדש מתחילי
                              יום חדש מתחילי
                              יום חדש מתחיל
                              מנהל ספריית אוצריא
                              כתב ב נערך לאחרונה על ידי יום חדש מתחיל
                              #14

                              @אהרן לך אולי יותר קל לערוך ככה,
                              אבל אנחנו רוצים כן עם כל ההדגשות והכל.
                              לכן לאוצריא זה לא ייכנס. נקודה.

                              אם אתה לא מסתדר, וכן בכל בקשה ועזרה
                              נוכל בל"נ לתת לך עזרה ככל שידרש.

                              מ תגובה 1 תגובה אחרונה
                              0
                              • אהרןא
                                אהרןא
                                אהרן
                                כתב ב נערך לאחרונה על ידי
                                #15

                                רק עם היה לי פה דוגמא של העיצוב שלהם, זה זוועה ממש. בכל מקרה תוכל להסביר לי מה ההדגשות שאתה מדבר? זה רק הדגשת מילה ראשונה. כל הכותרות זה כך: <b>הלכות</b> <b>עכו"ם</b> . וזה לא עוזר בכלל. קיצור מה העניין של ההדגשות שלהם?

                                תגובה 1 תגובה אחרונה
                                0
                                • D9D
                                  D9D
                                  D9
                                  כתב ב נערך לאחרונה על ידי
                                  #16

                                  רוב ההדגשות שלהם אם לא כולם הם על כותרות שבין כה לא נפק"מ לאוצריא
                                  ותחילת קטע שניתן לעשות את זה בקלות בתוכנה היעודית

                                  תגובה 1 תגובה אחרונה
                                  1
                                  • D9D
                                    D9D
                                    D9
                                    כתב ב נערך לאחרונה על ידי
                                    #17

                                    לי אישית זה עזר כי כך היה לי יותר קל למצוא כותרות שהושמטו מסיבות כאילו ואחרות מההדגשה האוטומטית
                                    אבל אני לא מבין למה מי שזה יותר קל לו לא יכול להסיר את זה

                                    תגובה 1 תגובה אחרונה
                                    0
                                    • יום חדש מתחילי יום חדש מתחיל

                                      @אהרן לך אולי יותר קל לערוך ככה,
                                      אבל אנחנו רוצים כן עם כל ההדגשות והכל.
                                      לכן לאוצריא זה לא ייכנס. נקודה.

                                      אם אתה לא מסתדר, וכן בכל בקשה ועזרה
                                      נוכל בל"נ לתת לך עזרה ככל שידרש.

                                      מ
                                      מ
                                      מישהו 1
                                      כתב ב נערך לאחרונה על ידי
                                      #18

                                      @יום-חדש-מתחיל כתב בלהורדה | השלמת שו"ת פרי עץ חיים:

                                      @אהרן לך אולי יותר קל לערוך ככה,
                                      אבל אנחנו רוצים כן עם כל ההדגשות והכל.
                                      לכן לאוצריא זה לא ייכנס. נקודה.

                                      אם אתה לא מסתדר, וכן בכל בקשה ועזרה
                                      נוכל בל"נ לתת לך עזרה ככל שידרש.

                                      איך המודגש מסתדר עם דבריך כאן ?

                                      תגובה 1 תגובה אחרונה
                                      1
                                      • יום חדש מתחילי
                                        יום חדש מתחילי
                                        יום חדש מתחיל
                                        מנהל ספריית אוצריא
                                        כתב ב נערך לאחרונה על ידי יום חדש מתחיל
                                        #19

                                        @מישהו-1 אתה שואל שאלה מצויינת!
                                        והתשובה ממש פשוטה.

                                        אני כרגע בתפקיד שהקב"ה שם אותי בו, ואני משתדל למלא את תפקידי בשלמות כמו שאני מבין את זה.
                                        אני ממש משתדל הרבה מאוד, אתה אפילו לא יודע עד כמה. (וכמובן הכל בלי לקבל אגורה שחוקה).

                                        בכל מה שהוא לא קשור לתפקיד שלי, כגון לגבי הוספת ספרים,
                                        זה לא ממש מתאים לאופי שלי, גם במצ'ינגים לא הסתדרתי אף פעם...
                                        ולכן אני באמת לא מבין למה אני קשור לזה יותר ממך.
                                        בסופו של דבר, אין לי תועלת מהתוכנה הזאת יותר מהתועלת שיש לך, אני לא מרוויח עלי' שום דבר, והרווח הוא של כולנו יחד, ושל כל לומדי התורה הקדושה.

                                        לכן כל מי שמוכן לעזור בכל תחום שהוא בהתנדבות גמורה - מצוין,
                                        מה שייך לבוא בטענות על מישהו למה הוא לא עושה משהו?
                                        משא"כ על מי שעושה משהו ש [לכה"פ] לדעתו הוא לא טוב, זה באמת לא בסדר.

                                        תגובה 1 תגובה אחרונה
                                        7

                                        שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.

                                        נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.

                                        בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗

                                        הרשמה התחברות

                                        • התחברות

                                        • אין לך חשבון עדיין? הרשמה

                                        • התחברו או הירשמו כדי לחפש.
                                        • פוסט ראשון
                                          פוסט אחרון