![[157] לפצח את העברית: מאחורי הקלעים של אימון של הבטרון](/_next/image?url=https%3A%2F%2Fd3t3ozftmdmh3i.cloudfront.net%2Fstaging%2Fpodcast_uploaded_episode%2F44943178%2F44943178-1781626071519-de49b855a2958.jpg&w=384&q=75&dpl=dpl_De19gkM5g3qdwaWbojgZwwVbwnzp)
[157] לפצח את העברית: מאחורי הקלעים של אימון של הבטרון
16 ביוני 202600:33:08
עודכן: מאת צוות פודקאסט·ישראל
אורחים:מייק
האזן לפרק
/ הפרק במספרים
| פורסם | 16 ביוני 2026 |
|---|---|
| אורך | 33 דק׳ (ארוך ב-15% מהממוצע בתוכנית) |
| אורחים | מייק |
| קטגוריה | הייטק וסטארטאפים |
על הפרק
איך לוקחים שפה מורכבת ועשירה כמו עברית ומלמדים מודל בינה מלאכותית לדבר אותה שוטף? ולמה דווקא המודל של אינבידיה הוא זה שניצח את Llama ואת המודלים של IBM במבחן העלות-תועלת? בפרק החדש של אקספלינבל , מייק מארח את שארל ויינברגר (מוביל פיתוח ב-AI Next של PWC) ונעם קייזר (מפתח בצוות) לשיחת עומק על מאחורי הקלעים של פרויקט אימון מודל השפה בעברית: פרויקט ששבר את הרשת עם 30,000 הורדות ו-4 שחרורי גרסאות בשבוע אחד בלבד. בפרק נדבר על: אתגר השפה העברית: למה המורפולוגיה העברית עושה צרות לטוקנייזרים הסטנדרטיים, ואיך מנצחים את זה. מלחמת המודלים: למה הצוות בחר דווקא ב-"נימטרון" (Nemotron) של Nvidia, ולמה מודלים