top of page
הקטעים בעמוד הם הסברים שרלוונטים לתוכן שאני מייצר בטלגרם

הזיות (Hallucinations)

כל מה שמודל שפה עושה זה להזות, פשוט ברוב המקרים הוא צודק.

הזיות הן כינוי למצב שמודל שפה מדבר שטויות. הבעיה העיקרית עם הזיות היא שאין באמת דבר כזה. מודלי שפה גדולים פשוט חוזים את הטוקן הבא, וברוב המקרים הוא הטוקן הנכון.
כשהוא לא, אין שום דבר בארכיטקטורת הטרנספורמר שידוע לנו ומאפשר לדעת את זה.
יש לא מעט מחקרים בנושא ״האם המודל יודע שהוא הוזה״, ואין תשובה חד משמעית בעניין.

כל מי שמדבר על ״פתרון לבעית ההזיות״ קצת הוזה :)

bottom of page