arrow_forwardAI Engineering / הזיות (Hallucinations)
רמה: מתחיל-מתקדם עודכן: אוגוסט 2026

הזיות AI — Hallucinations

כשה-LLM ממציא מידע שנשמע אמין אבל שגוי. הבעיה מספר 1 במוצרי AI — והנה 9 טכניקות מוכחות לצמצם אותה.

מה זו הזיה

הזיה (Hallucination) היא מצב שבו מודל שפה מייצר מידע שגוי או מומצא — בביטחון מלא. הוא ימציא עובדה, ציטוט, מספר, קישור או שם, וינסח את זה בצורה משכנעת לחלוטין. זה מסוכן דווקא כי זה נשמע אמין.

דוגמאות: להמציא סעיף חוק שלא קיים, לצטט מחקר שלא נכתב, לתת מחיר שגוי של מוצר, או "לזכור" מדיניות חברה שמעולם לא הייתה.

warning
למה זה קריטי

בצ'אט אישי הזיה זו טרחה. במוצר (תמיכה, ייעוץ, משפט, רפואה) — היא יכולה לגרום נזק אמיתי ולשחוק אמון. צמצום הזיות הוא לב ה-AI Engineering.

למה זה קורה

זו לא "תקלה" — זו התנהגות מובנית. מודל שפה לא שולף עובדות ממאגר; הוא חוזה את המילה הבאה הסבירה סטטיסטית לפי הדפוסים שראה באימון. כשיש לו מידע מדויק — הוא מדייק. כשאין — הוא עדיין מייצר משהו שנשמע נכון, כי זה מה שהוא עושה. הוא "מעדיף" תשובה שוטפת על פני "אני לא יודע".

לכן הפתרון אינו "מודל חכם יותר" בלבד, אלא הנדסה נכונה: לתת לו מקור אמיתי, ולאפשר לו לומר שאין לו תשובה.

סוגי הזיות

9 טכניקות מוכחות לצמצום

  1. עיגון במקור (Grounding / RAG). הכי יעיל. תן למודל את המידע הרלוונטי בRAG והורה לו לענות רק לפיו.
  2. אפשר "אני לא יודע". הוסף לפרומפט: "אם התשובה לא נמצאת בהקשר, אמור שאינך יודע והצע להעביר לאדם". זה משנה הכל.
  3. דרוש ציטוטים. בקש שכל טענה תפנה לקטע המקור. אם אין מקור — אין טענה. גם מקל על אימות.
  4. טמפרטורה נמוכה (0-0.3). למשימות עובדתיות. פחות "יצירתיות" = פחות המצאות.
  5. פלט מובנה + ולידציה. JSON schema מגביל את מרחב הפלט, וולידציה בצד שלך תופסת ערכים לא חוקיים.
  6. Self-consistency. למשימות קריטיות — הרץ כמה פעמים והשווה. אם התשובות סותרות, זה דגל אדום.
  7. שלב אימות (verification). מודל שני (או קוד) בודק את התשובה מול המקור לפני שמציגים למשתמש.
  8. הוראות ברורות ומצומצמות. פרומפט מעורפל מזמין ניחושים. הגדר תחום, פורמט ומגבלות.
  9. Evals ל-hallucination. מדוד את שיעור ההזיות עם evals (למשל LLM-judge שבודק נאמנות למקור), כדי לדעת אם שיפרת.
bolt
אם תזכור רק דבר אחד

עיגון במקור + רשות לומר "לא יודע" מצמצמים את רוב ההזיות. זו נקודת הפתיחה של כל מערכת עובדתית.

שכבות הגנה במערכת אמיתית

במוצר קריטי לא מסתמכים על טכניקה אחת, אלא בונים כמה שכבות:

  1. מניעה: RAG + הוראות + טמפרטורה נמוכה.
  2. בקרה: ולידציה של הפלט ואימות מול מקור.
  3. גבולות: Guardrails שחוסמים תשובות בנושאים רגישים בלי מקור.
  4. מדידה: Evals וניטור בייצור לזיהוי הזיות שחומקות.
  5. אדם בלולאה: בהחלטות בעלות סיכון גבוה — אישור אנושי לפני פעולה.
rocket_launch

הצעד הבא

הטכניקה מספר 1 היא grounding. למד RAG לעומק, והוסף בקרה עם guardrails ו-evals.