English
RebbeHub

המודלים ומדדי הביצוע

RebbeHub קורא סריקות ושומע הקלטות במודלים משלו. כאן כתוב מה כל אחד עושה, איזה מהם בשימוש, ואיך הוא הצליח במבחן שלא למד ממנו. המודלים הם של RebbeHub ואינם משוחררים; רק התיאורים והציונים מתפרסמים.

כל מה שמודל כותב מסומן באתר כפלט מכונה עד שאדם בודק אותו, יהיה הציון טוב ככל שיהיה.

קורא לקוטי שיחות (OCR)

קורא כל שורה בעמוד סרוק של לקוטי שיחות לטקסט. ״אותיות״ ו״מילים״: כמה נקראו נכון; ״שורות מושלמות״: שורות שנקראו כולן בלי טעות אחת; ״גוף״ ו״הערות״: ציון האותיות בפנים ובהערות; ״אותיות דומות״: החלפות של ב/כ, ת/ח, ז/ן/ו.

  • rebbehub-kraken-ls-v1קורא את לקוטי שיחות מהסריקות; קורא עכשיו את חלקים טו-כהבשימוש
  • rebbehub-kraken-v1קורא את המפתחות; לא נבדק כאןבשימוש

עיקר התוצאות

4,500 שורות מלקוטי שיחות חלק לט שאף מודל לא למד מהן. מפתח התשובות הוא הטקסט המוקלד, מתוקן מול הסריקה, ועוד 35 מקפים ו״. . .״ בקצות שורות שחסרו בו ומופיעים בסריקה.

מודלאותיותמיליםשורות מושלמות
PP-OCRv6, כמו שהוא נקודת ההתחלה96.45%86.39%כ-44%
מועמד קודם (הטוב שלפניו) הוחלף99.82%99.41%96.1%
rebbehub-kraken-ls-v1 בשימוש99.91%99.68%97.7%
+ בדיקת המילים אחרי הקריאה בשימוש99.88%*99.60%*97.3%*
מועמד מאוחר (הטוב שבו) לא בשימוש99.87%99.51%97.0%

* נבדק מול מפתח מחמיר יותר (בלי 35 הסימנים שנוספו), ולכן אינו נמוך מהשורה שמעליו: מול אותו מפתח בדיקת המילים רק מתקנת. היא תיקנה 15 מתוך 16 השורות עם טעות באותיות דומות, ולא קלקלה אף שורה.

כל המועמדים על 4,500 השורות

4,500 שורות מלקוטי שיחות חלק לט שאף מודל לא למד מהן. מפתח התשובות הוא הטקסט המוקלד, מתוקן מול הסריקה, ועוד 35 מקפים ו״. . .״ בקצות שורות שחסרו בו ומופיעים בסריקה.

מודל או מועמדאותיותמיליםשורות מושלמותגוףהערותטעויותאותיות דומותמקף נשמט / נוסףנקודות נשמטו / נוספו
recover start99.6598.3888.999.7099.336997415 / 1015 / 2
00-0.998599.8199.4196.299.8299.793722457 / 143 / 0
00-0.998699.8399.3796.099.8599.733381941 / 626 / 1
00-0.998499.8399.3695.999.8499.743461433 / 134 / 2
00-0.9986-v199.8099.3095.699.8299.703991857 / 047 / 0
01-0.998699.8299.3695.899.8599.653662055 / 127 / 2
01-0.9986-v199.8399.4096.099.8599.683471749 / 033 / 0
01-0.998799.8299.3896.099.8499.693611749 / 041 / 0
01-0.9987-v1 הוחלף99.8299.4196.199.8499.693571851 / 042 / 0
rebbehub-kraken-ls-v1 בשימוש99.9199.6897.799.9399.81179184 / 06 / 1

בלי 35 הסימנים שנוספו הוא עדיין מנצח: 99.87% אותיות ו-97.0% שורות מושלמות, מול 99.84% ו-96.3%. הוא חצה את הטעויות (357 ל-179), כמעט כולן סימנים: מקפים שנשמטו מ-51 ל-4, נקודות מ-42 ל-6. באותיות הדומות לא השתנה דבר (18 ל-18).

המועמדים המאוחרים

אותן 4,500 שורות, ומפתח של הטקסט המוקלד ועוד 24 סימנים בקצות שורות; rebbehub-kraken-ls-v1 נקרא שוב באותה דרך להשוואה.

מודל או מועמדאותיותמיליםשורות מושלמותגוףהערותטעויותאותיות דומותמקף נשמט / נוסףנקודות נשמטו / נוספו
rebbehub-kraken-ls-v1 בשימוש99.9099.6397.599.9199.80206204 / 10 / 10
r3-00-0.9982-234799.8399.3895.899.8499.743485938 / 010 / 3
r3-00-0.9983-000399.8399.3595.899.8599.743374137 / 06 / 5
r3-00-0.9984-0019 לא בשימוש99.8799.5197.099.8899.812582221 / 010 / 2
r3-00-0.9986-003599.8399.4396.599.8399.833381839 / 111 / 1
r3-01-0.9984-005099.8399.4796.599.8499.793392151 / 011 / 1
r3-01-0.9984-v1-010599.8499.4896.699.8499.823232147 / 011 / 1
r3-01-0.9984-v2-013799.8499.4896.699.8499.813272144 / 011 / 1
r3-01-0.9985-012099.8499.4996.899.8599.813182342 / 011 / 2
r3-final-ppm_best99.8399.4396.599.8399.833381839 / 111 / 1

אף אחד מהם אינו טוב ממנו; הפער כמעט כולו מקפים שנשמטו בפתיחת שורה.

300 שורות בדוקות מחלק לט

מבחן מוקדם וקטן יותר: 300 שורות מחלק לט שמפתח התשובות שלהן נבדק שורה שורה מול הסריקה. ההבדלים בין המועמדים כאן הם 1 עד 6 טעויות ב-300 שורות, בגבולות הרעש, ולכן 4,500 השורות מכריעות.

מודל או מועמדאותיותמיליםשורות מושלמותגוףהערותטעויות
PP-OCRv6, כמו שהוא נקודת ההתחלה96.48%86.07%44.3%96.41%96.95%459
s2-00-0.995399.82%99.24%94.7%99.8%99.94%24
s2-00-0.998299.9%99.64%97.7%99.89%100.0%13
s2-00-0.998199.92%99.64%97.7%99.93%99.88%10
s2-abort99.92%99.64%97.3%99.93%99.82%11
s2-00-0.998699.95%99.68%98.0%99.94%100.0%7
s2-00-0.9982-v199.95%99.72%98.0%99.94%100.0%7
s2-00-0.998499.89%99.52%96.7%99.89%99.82%15
s2-00-0.998099.9%99.56%97.0%99.92%99.77%13
s2-01-0.998299.92%99.6%97.0%99.95%99.77%10
s2-01-0.997999.92%99.52%97.3%99.92%99.88%11
s2-00-0.998599.92%99.68%98.0%99.91%100.0%10

ספקות הקורא בחלקים טו-יז

החלקים הראשונים שקרא (182 שיחות, 725 אלף מילים), רובם ביידיש: 157 שיחות מול 25 בלשון הקודש. אין להם טקסט מוקלד להשוות אליו, ולכן אלה ספקות הקורא עצמו, הערכה ולא ציון שנמדד.

טקסטמיליםביטחון מתחת ל-0.9מתחת ל-0.6
שיחות בלשון הקודש, גוף43,1781.24%0.33%
שיחות ביידיש, גוף402,5342.81%0.64%
שיחות בלשון הקודש, הערות7,5482.04%0.46%
שיחות ביידיש, הערות (רובן בלשון הקודש)189,5631.85%0.49%

נקודות חולשה

  • יידיש: בגוף הטקסט ביידיש הקורא מסופק בערך פי שניים מאשר בלשון הקודש. זה הפער הגדול ביותר.
  • אותיות דומות: ב/כ, ת/ח, ז/ן (כ-18 ב-4,500 השורות; בדיקת המילים מתקנת את רובן).
  • פ ו-ט נקראות ס באות הקטנה של ההערות (פירוש כ״סירוש״, הבעש״ט כ״הבעש״ס״).
  • הנקודה שמתחת לאל״ף ביידיש נשמטת לפעמים.
  • כוכבית ״*״ לבדה אינה נקראת בידי הקורא; היא נלקחת מהדיו.

הבא: סבב ליידיש, ואחריו אותה בדיקה שוב, לראות שהפער נסגר.

גלאי המירם (מודגש)

בשיחות הרבי אותיות מירם מסמנות את המילים המודגשות, ו-RebbeHub מציג אותן מודגשות. הגלאי אומר, מילה במילה, אילו מילים בעמוד הן במירם.

  • rebbehub-facenet-v2מוצא אילו מילים בעמוד הן במירםבשימוש
  • rebbehub-facenet-v1מוצא אילו מילים בעמוד הן במירםהוחלף

חמישה עמודים שנבדקו בעין

חמישה עמודי שיחה רגילים (לח:מ, לד:מב, לא:צג, לו:נ, לג:ע), 1,832 מילים, 82 מהן במירם, כל מילה נבדקה בעין.

מודלמילים שמסכימות עם העין
כללי עובי, בלי מודל הוחלףמילים חלקיות; מחמיץ הערות מירם שלמות
rebbehub-facenet-v1 הוחלף1,832 / 1,832
rebbehub-facenet-v2 בשימוש1,832 / 1,832

סבב הבדיקה הראשון (2026-10-02) מצא 12 מילות מירם שהוחמצו, כולן בעמודים שנבנו לפני ש-rebbehub-facenet-v2 רץ. חמישה עמודים הם מבחן קטן; כל עמוד שנבדק בכלי הבדיקה מוסיף לו.

נקודות חולשה

  • המבחן קטן: חמישה עמודים.

קול הרבי לטקסט (Whisper)

שומע הקלטה של הרבי ביידיש וכותב אותה, כל מילה עם הזמן שלה. הציונים הם מילים שגויות / אותיות שגויות (WER / CER); נמוך יותר טוב יותר.

  • rebbehub-whisper-v3שומע את היידיש של הרבי וכותב אותהבשימוש
  • rebbehub-whisper-v2שומע את היידיש של הרבי וכותב אותההוחלף
  • rebbehub-whisper-v1שומע את היידיש של הרבי וכותב אותההוחלף

התוועדויות שלא נלמדו

התוועדויות שאף גרסה לא למדה מהן, בכתיב החוברות.

נבדק עלivrit.ai Yiddish (נקודת ההתחלה)v1v2v3 (בשימוש)
שלוש התוועדויות תשמ״ב, 395 קטעים11.8% / 5.7%10.1% / 5.2%
י״ז תמוז תשמ״ב, 109 קטעים10.8% / 4.6%8.2% / 3.8%
י״א ניסן תשל״ג (תקופה מוקדמת), 344 קטעים13.7% / 5.2%13.7% / 5.1%
י״ז תמוז תשמ״ב, כל 29 הדקות58% / 28%13.0% / 5.9%11.9% / 5.3%11.5% / 5.5%

כפי שכל גרסה נבדקה כשהייתה חדשה

הציון של v3 על תשמ״ב הוא בכתיב החוברות והקודמים לא, ולכן הטבלה שלמעלה היא זו שמשווים לפיה.

מודלהתוועדויות תשמ״בי״א ניסן תשל״גכל י״ז תמוז תשמ״ב (29 דקות)
ivrit.ai Yiddish נקודת ההתחלהכ-60%
rebbehub-whisper-v1 הוחלף12% / 6%22.5% / 9.0%13.0% / 5.9%
rebbehub-whisper-v2 הוחלף9.5% / 4.8%13.8% / 5.2%11.9% / 5.3%
rebbehub-whisper-v3 בשימוש10.1% / 5.2%13.7% / -11.5% / 5.5%

נקודות חולשה

  • מילים נדירות (״תנות״ במקום ״תענית״).
  • השנים המוקדמות (י״א ניסן תשל״ג למעלה).

הבא: v4, שייבדק על אותן התוועדויות ויוכנס לשימוש רק אם יהיה טוב יותר.

תיאורי המודלים ומדדי הביצוע: CC BY-NC-ND 4.0. המודלים עצמם אינם משוחררים; כל הזכויות שמורות.