האזן לפרק
/ הפרק במספרים
| פורסם | 9 ביולי 2026 |
|---|---|
| אורך | 34 דק׳ (ארוך ב-26% מהממוצע בתוכנית) |
| קטגוריה | בריאות ואיכות חיים |
על הפרק
מחקר השווה יכולת פתרון בעיות קליניות בין כלי בינה מלאכותית שונים. כל כלי עמד לבחינה אל מול שלוש בדיקות שונות: שאלות רבות בחירה, מצבים רפואיים מסובכים הדורשים החלטות אבחנתיות וטיפוליות, ובעיות אמיתיות שרופאים הציגו למנוע תמיכה רפואית. נבחנו הכלים "הרגילים": ג’מיני, צ’אטגפט וקלוד, וכן מנועי בינה קליניים ייעודיים. להפתעת כולם, בכל שלוש הבדיקות, דווקא הכלים הרגילים הגיעו לביצועים טובים יותר מאשר הכלים הייעודיים. האם ניתן להסתמך על מחקר זה? נגלה מספר בעיות מהותיות בשיטת המחקר שיגרמו לנו להיות ספקניים: אפשרות חשיפת מנועי הבינה הכלליים לאותן שאלות בשלב אימון המודל, הצורה שבה הוזנו הנתונים למנועי הבינ