דילוג לתוכן
0
  • דף הבית
  • חוקי הפורום
  • מדריכים
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • פופולרי
  • משתמשים
  • תרומות לאוצריא
  • צור קשר
  • דף הבית
  • חוקי הפורום
  • מדריכים
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • פופולרי
  • משתמשים
  • תרומות לאוצריא
  • צור קשר
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
לוגו אתר

פורום אוצריא

אוצריא - דף הבית
|
קח שותפות בהוספת ספרים
|
תרום לאוצריא
  1. דף הבית
  2. הוספת ספרים לספריית אוצריא
  3. להורדה | השלמת שו"ת פרי עץ חיים

להורדה | השלמת שו"ת פרי עץ חיים

מתוזמן נעוץ נעול הועבר הוספת ספרים לספריית אוצריא
הוספת ספריםדיקטה
19 פוסטים 7 כותבים 721 צפיות 4 עוקבים
  • מהישן לחדש
  • מהחדש לישן
  • הכי הרבה הצבעות
    תגובה
    • תגובה כנושא
    התחברו כדי לפרסם תגובה
    נושא זה נמחק. רק משתמשים עם הרשאות מתאימות יוכלו לצפות בו.
    • יום חדש מתחילי
      יום חדש מתחילי
      יום חדש מתחיל
      מנהל ספריית אוצריא
      כתב ב נערך לאחרונה על ידי
      #3

      מהיכן המקור?
      תביא קישור מדוייק.
      לא ככה אנחנו עובדים.

      לכל דבר יש דרך וצורה איך מורידים, ואיך מטפלים.

      תגובה 1 תגובה אחרונה
      0
      • י. פל.י
        י. פל.י
        י. פל.
        כתב ב נערך לאחרונה על ידי
        #4

        @אהרן
        אם זה מדיקטה, ממש חבל!
        אתה פשוט יכול להודיע לנו, וזה יבוצע כשאר ספרי דיקטה.

        תגובה 1 תגובה אחרונה
        1
        • אהרןא
          אהרןא
          אהרן
          כתב ב נערך לאחרונה על ידי
          #5

          למה שלא תעשו חיפוש פשוט בגוגל פרי עץ חיים דיקטה, תקבלו תשובות לשאלות שלכם.

          תגובה 1 תגובה אחרונה
          0
          • יום חדש מתחילי
            יום חדש מתחילי
            יום חדש מתחיל
            מנהל ספריית אוצריא
            כתב ב נערך לאחרונה על ידי יום חדש מתחיל
            #6

            @אהרן אני מבין שאתה לא רוצה לעזור לנו כ"כ, חבל.
            לא מבין כ"כ מה המטרה שלך בפוסט הזה, אם אתה לא רוצה לעזור לנו....

            לעצם העניין, @האדם-החושב עיין כאן: https://files.dicta.org.il/books_internal.json
            ולכאורה יוצא שאין שם בכלל את האפשרות להוריד את הגירסא של ה OCR מה שהיינו מורידים תמיד, אלא רק את: https://files.dicta.org.il/prietshaim/prietshaim__text_files.zip למרות שזה יורד בלי שום תגיות.
            או שיש לך פתרון אחר לחידה הזו.

            האדם החושבה תגובה 1 תגובה אחרונה
            0
            • יום חדש מתחילי יום חדש מתחיל

              @אהרן אני מבין שאתה לא רוצה לעזור לנו כ"כ, חבל.
              לא מבין כ"כ מה המטרה שלך בפוסט הזה, אם אתה לא רוצה לעזור לנו....

              לעצם העניין, @האדם-החושב עיין כאן: https://files.dicta.org.il/books_internal.json
              ולכאורה יוצא שאין שם בכלל את האפשרות להוריד את הגירסא של ה OCR מה שהיינו מורידים תמיד, אלא רק את: https://files.dicta.org.il/prietshaim/prietshaim__text_files.zip למרות שזה יורד בלי שום תגיות.
              או שיש לך פתרון אחר לחידה הזו.

              האדם החושבה
              האדם החושבה
              האדם החושב
              מפתח
              כתב ב נערך לאחרונה על ידי
              #7

              @יום-חדש-מתחיל
              פרי עץ חיים.rar

              import io
              import json
              import re
              import zipfile
              from pathlib import Path
              
              import requests
              from tqdm import tqdm
              
              BASE_URL = "https://files.dicta.org.il/prietshaim/"
              
              
              def get_toc() -> list[dict]:
                  url = BASE_URL + "pages.json"
                  response = requests.get(url)
                  return response.json()
              
              
              def get_page_content(page: str) -> dict:
                  response = requests.get(BASE_URL + page)
                  if page.endswith(".zip"):
                      with zipfile.ZipFile(io.BytesIO(response.content)) as z, z.open(z.namelist()[0]) as f:
                          return json.loads(f.read().decode("utf-8"))
              
                  return response.json()
              
              
              def process_page(output_file: io.TextIOWrapper, content: list[dict]) -> None:
                  for entry in content:
                      if 'display' not in entry:
                          output_file.write(entry['str'])
                          continue
                      for i in entry['display']:
                          val = i["c"]
                          heading = i.get("heading", False)
                          bold = i.get("bold", False)
                          if heading is True:
                              output_file.write(f"<big>{val}</big>")
                          elif bold is True:
                              output_file.write(f"<b>{val}</b>")
                          else:
                              output_file.write(val)
              
              
              def main() -> None:
                  book_name = "פרי עץ חיים"
                  author = ""
                  target_file_path = Path(f"{book_name}.txt")
                  toc = get_toc()
                  with target_file_path.open("w", encoding="utf-8") as output_file:
                      output_file.write(f"<h1>{book_name}</h1>\n{author}")
                      for entry in tqdm(toc, total=len(toc)):
                          if entry["type"] == "index":
                              continue
                          page = entry["fileName"]
                          display_name = entry["displayName"]
                          output_file.write(f"\n<h2>{display_name}</h2>\n")
                          content = get_page_content(page)
                          process_page(output_file, content["tokens"])
                  with target_file_path.open("r", encoding="utf-8") as output_file:
                      content = output_file.read()
                      content = re.sub(r'\n+', '\n', content)
                  with target_file_path.open("w", encoding="utf-8") as output_file:
                      output_file.write(content)
              
              
              if __name__ == "__main__":
                  main()
              
              


              אגב, בזכות זה חקרתי קצת יותר את האתר של דיקטה ויתכן שיש דרך להוריד את הספרים שעדיין לא ערכו עם ירידות שורה, הדגשות וכו'.

              יום חדש מתחילי תגובה 1 תגובה אחרונה
              4
              • האדם החושבה האדם החושב

                @יום-חדש-מתחיל
                פרי עץ חיים.rar

                import io
                import json
                import re
                import zipfile
                from pathlib import Path
                
                import requests
                from tqdm import tqdm
                
                BASE_URL = "https://files.dicta.org.il/prietshaim/"
                
                
                def get_toc() -> list[dict]:
                    url = BASE_URL + "pages.json"
                    response = requests.get(url)
                    return response.json()
                
                
                def get_page_content(page: str) -> dict:
                    response = requests.get(BASE_URL + page)
                    if page.endswith(".zip"):
                        with zipfile.ZipFile(io.BytesIO(response.content)) as z, z.open(z.namelist()[0]) as f:
                            return json.loads(f.read().decode("utf-8"))
                
                    return response.json()
                
                
                def process_page(output_file: io.TextIOWrapper, content: list[dict]) -> None:
                    for entry in content:
                        if 'display' not in entry:
                            output_file.write(entry['str'])
                            continue
                        for i in entry['display']:
                            val = i["c"]
                            heading = i.get("heading", False)
                            bold = i.get("bold", False)
                            if heading is True:
                                output_file.write(f"<big>{val}</big>")
                            elif bold is True:
                                output_file.write(f"<b>{val}</b>")
                            else:
                                output_file.write(val)
                
                
                def main() -> None:
                    book_name = "פרי עץ חיים"
                    author = ""
                    target_file_path = Path(f"{book_name}.txt")
                    toc = get_toc()
                    with target_file_path.open("w", encoding="utf-8") as output_file:
                        output_file.write(f"<h1>{book_name}</h1>\n{author}")
                        for entry in tqdm(toc, total=len(toc)):
                            if entry["type"] == "index":
                                continue
                            page = entry["fileName"]
                            display_name = entry["displayName"]
                            output_file.write(f"\n<h2>{display_name}</h2>\n")
                            content = get_page_content(page)
                            process_page(output_file, content["tokens"])
                    with target_file_path.open("r", encoding="utf-8") as output_file:
                        content = output_file.read()
                        content = re.sub(r'\n+', '\n', content)
                    with target_file_path.open("w", encoding="utf-8") as output_file:
                        output_file.write(content)
                
                
                if __name__ == "__main__":
                    main()
                
                


                אגב, בזכות זה חקרתי קצת יותר את האתר של דיקטה ויתכן שיש דרך להוריד את הספרים שעדיין לא ערכו עם ירידות שורה, הדגשות וכו'.

                יום חדש מתחילי
                יום חדש מתחילי
                יום חדש מתחיל
                מנהל ספריית אוצריא
                כתב ב נערך לאחרונה על ידי
                #8

                @האדם-החושב מדהים!!

                תגובה 1 תגובה אחרונה
                0
                • ק
                  ק
                  קטנטן
                  עורך ספרים מקצועי
                  כתב ב נערך לאחרונה על ידי
                  #9

                  @האדם-החושב אתה יכול להוריד גם את הספר הזה:
                  https://library.dicta.org.il/book/alfeimenashetorah/alfeimenashetorah-003
                  פשוט הגירסא שמורידים תמיד מכילה רק את העמוד הראשון.

                  האדם החושבה תגובה 1 תגובה אחרונה
                  0
                  • אהרןא
                    אהרןא
                    אהרן
                    כתב ב נערך לאחרונה על ידי
                    #10

                    למה לא להוריד באתר?

                    יום חדש מתחילי תגובה 1 תגובה אחרונה
                    0
                    • ק קטנטן

                      @האדם-החושב אתה יכול להוריד גם את הספר הזה:
                      https://library.dicta.org.il/book/alfeimenashetorah/alfeimenashetorah-003
                      פשוט הגירסא שמורידים תמיד מכילה רק את העמוד הראשון.

                      האדם החושבה
                      האדם החושבה
                      האדם החושב
                      מפתח
                      כתב ב נערך לאחרונה על ידי האדם החושב
                      #11

                      @קטנטן
                      אלפי מנשה על התורה.rar

                      import io
                      import json
                      import re
                      import zipfile
                      from pathlib import Path
                      
                      import requests
                      from tqdm import tqdm
                      
                      BASE_URL = "https://files.dicta.org.il/library-1-0/"
                      
                      
                      def get_toc(url: str) -> list[dict]:
                          url = url + "pages.json"
                          response = requests.get(url)
                          return response.json()
                      
                      
                      def get_page_content(url: str, page: str) -> dict:
                          response = requests.get(url + page)
                          if page.endswith(".zip"):
                              with zipfile.ZipFile(io.BytesIO(response.content)) as z, z.open(z.namelist()[0]) as f:
                                  return json.loads(f.read().decode("utf-8"))
                      
                          return response.json()
                      
                      
                      def process_page(output_file: io.TextIOWrapper, content: list[dict]) -> None:
                          for entry in content:
                              if 'display' not in entry:
                                  output_file.write(entry['str'])
                                  continue
                              for i in entry['display']:
                                  val = i["c"]
                                  heading = i.get("heading", False)
                                  bold = i.get("bold", False)
                                  if heading is True:
                                      output_file.write(f"<big>{val}</big>")
                                  elif bold is True:
                                      output_file.write(f"<b>{val}</b>")
                                  else:
                                      output_file.write(val)
                      
                      
                      def main() -> None:
                          book_name = "alfeimenashetorah"
                          book_url = f"{BASE_URL}{book_name}/"
                          book_name = "אלפי מנשה על התורה"
                          author = ""
                          target_file_path = Path(f"{book_name}.txt")
                          toc = get_toc(book_url)
                          with target_file_path.open("w", encoding="utf-8") as output_file:
                              output_file.write(f"<h1>{book_name}</h1>\n{author}")
                              for entry in tqdm(toc, total=len(toc)):
                                  page = entry["fileName"]
                                  output_file.write("\n")
                                  content = get_page_content(book_url, page)
                                  process_page(output_file, content["tokens"])
                          with target_file_path.open("r", encoding="utf-8") as output_file:
                              content = output_file.read()
                              content = re.sub(r'\n+', '\n', content)
                          with target_file_path.open("w", encoding="utf-8") as output_file:
                              output_file.write(content)
                      
                      
                      if __name__ == "__main__":
                          main()
                      
                      
                      תגובה 1 תגובה אחרונה
                      2
                      • אהרןא אהרן

                        למה לא להוריד באתר?

                        יום חדש מתחילי
                        יום חדש מתחילי
                        יום חדש מתחיל
                        מנהל ספריית אוצריא
                        כתב ב נערך לאחרונה על ידי יום חדש מתחיל
                        #12

                        @אהרן כתב בלהורדה | השלמת שו"ת פרי עץ חיים:

                        למה לא להוריד באתר?

                        [אם התכוונת לאתר של דיקטה, אז התשובה היא] כי מה שיורד מהאתר זה בלי עיצוב כלל.

                        תגובה 1 תגובה אחרונה
                        0
                        • אהרןא
                          אהרןא
                          אהרן
                          כתב ב נערך לאחרונה על ידי
                          #13

                          לפי מה שאני רואה בספרים שיורד עם העיצוב של דיקטה (עד עכשיו ערכתי כבר 15 ספרים שלהם ב"ה), הרבה מזה הוא פשוט נוראה, הדגשות שלא נצרכות וכדו'. יותר קל לי לערוך ספר בלי העיצוב של דיקטה מאשר עם העיצוב שלהם.

                          תגובה 1 תגובה אחרונה
                          0
                          • יום חדש מתחילי
                            יום חדש מתחילי
                            יום חדש מתחיל
                            מנהל ספריית אוצריא
                            כתב ב נערך לאחרונה על ידי יום חדש מתחיל
                            #14

                            @אהרן לך אולי יותר קל לערוך ככה,
                            אבל אנחנו רוצים כן עם כל ההדגשות והכל.
                            לכן לאוצריא זה לא ייכנס. נקודה.

                            אם אתה לא מסתדר, וכן בכל בקשה ועזרה
                            נוכל בל"נ לתת לך עזרה ככל שידרש.

                            מ תגובה 1 תגובה אחרונה
                            0
                            • אהרןא
                              אהרןא
                              אהרן
                              כתב ב נערך לאחרונה על ידי
                              #15

                              רק עם היה לי פה דוגמא של העיצוב שלהם, זה זוועה ממש. בכל מקרה תוכל להסביר לי מה ההדגשות שאתה מדבר? זה רק הדגשת מילה ראשונה. כל הכותרות זה כך: <b>הלכות</b> <b>עכו"ם</b> . וזה לא עוזר בכלל. קיצור מה העניין של ההדגשות שלהם?

                              תגובה 1 תגובה אחרונה
                              0
                              • D9D
                                D9D
                                D9
                                כתב ב נערך לאחרונה על ידי
                                #16

                                רוב ההדגשות שלהם אם לא כולם הם על כותרות שבין כה לא נפק"מ לאוצריא
                                ותחילת קטע שניתן לעשות את זה בקלות בתוכנה היעודית

                                תגובה 1 תגובה אחרונה
                                1
                                • D9D
                                  D9D
                                  D9
                                  כתב ב נערך לאחרונה על ידי
                                  #17

                                  לי אישית זה עזר כי כך היה לי יותר קל למצוא כותרות שהושמטו מסיבות כאילו ואחרות מההדגשה האוטומטית
                                  אבל אני לא מבין למה מי שזה יותר קל לו לא יכול להסיר את זה

                                  תגובה 1 תגובה אחרונה
                                  0
                                  • יום חדש מתחילי יום חדש מתחיל

                                    @אהרן לך אולי יותר קל לערוך ככה,
                                    אבל אנחנו רוצים כן עם כל ההדגשות והכל.
                                    לכן לאוצריא זה לא ייכנס. נקודה.

                                    אם אתה לא מסתדר, וכן בכל בקשה ועזרה
                                    נוכל בל"נ לתת לך עזרה ככל שידרש.

                                    מ
                                    מ
                                    מישהו 1
                                    כתב ב נערך לאחרונה על ידי
                                    #18

                                    @יום-חדש-מתחיל כתב בלהורדה | השלמת שו"ת פרי עץ חיים:

                                    @אהרן לך אולי יותר קל לערוך ככה,
                                    אבל אנחנו רוצים כן עם כל ההדגשות והכל.
                                    לכן לאוצריא זה לא ייכנס. נקודה.

                                    אם אתה לא מסתדר, וכן בכל בקשה ועזרה
                                    נוכל בל"נ לתת לך עזרה ככל שידרש.

                                    איך המודגש מסתדר עם דבריך כאן ?

                                    תגובה 1 תגובה אחרונה
                                    1
                                    • יום חדש מתחילי
                                      יום חדש מתחילי
                                      יום חדש מתחיל
                                      מנהל ספריית אוצריא
                                      כתב ב נערך לאחרונה על ידי יום חדש מתחיל
                                      #19

                                      @מישהו-1 אתה שואל שאלה מצויינת!
                                      והתשובה ממש פשוטה.

                                      אני כרגע בתפקיד שהקב"ה שם אותי בו, ואני משתדל למלא את תפקידי בשלמות כמו שאני מבין את זה.
                                      אני ממש משתדל הרבה מאוד, אתה אפילו לא יודע עד כמה. (וכמובן הכל בלי לקבל אגורה שחוקה).

                                      בכל מה שהוא לא קשור לתפקיד שלי, כגון לגבי הוספת ספרים,
                                      זה לא ממש מתאים לאופי שלי, גם במצ'ינגים לא הסתדרתי אף פעם...
                                      ולכן אני באמת לא מבין למה אני קשור לזה יותר ממך.
                                      בסופו של דבר, אין לי תועלת מהתוכנה הזאת יותר מהתועלת שיש לך, אני לא מרוויח עלי' שום דבר, והרווח הוא של כולנו יחד, ושל כל לומדי התורה הקדושה.

                                      לכן כל מי שמוכן לעזור בכל תחום שהוא בהתנדבות גמורה - מצוין,
                                      מה שייך לבוא בטענות על מישהו למה הוא לא עושה משהו?
                                      משא"כ על מי שעושה משהו ש [לכה"פ] לדעתו הוא לא טוב, זה באמת לא בסדר.

                                      תגובה 1 תגובה אחרונה
                                      7

                                      שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.

                                      נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.

                                      בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗

                                      הרשמה התחברות

                                      • התחברות

                                      • אין לך חשבון עדיין? הרשמה

                                      • התחברו או הירשמו כדי לחפש.
                                      • פוסט ראשון
                                        פוסט אחרון