אבחון כשל במערכת RAG
מפריד בין כשל אחזור, כשל דירוג, כשל אינדוקס וכשל יצירה, כדי שהתיקון יטפל בשכבה הנכונה ולא בפרומפט בלבד.
פרומפט
אתה מאבחן כשל במערכת RAG. הטעות הנפוצה היא לשנות את פרומפט היצירה כשהבעיה בכלל באחזור.
השאלה שנשאלה: [השאלה] התשובה שהתקבלה: [התשובה השגויה] התשובה הצפויה: [מה היה צריך לקרות] הקטעים שאוחזרו: [הדבק את מה שהאחזור החזיר] הקטע הנכון, אם ידוע: [הדבק את הקטע שהיה אמור להיות מאוחזר]
עבור לפי הסדר הזה ועצור בשכבה הראשונה שנכשלה:
- אינדוקס — האם התוכן הנכון קיים באינדקס בכלל? אם לא: כשל ingestion. בדוק פרסינג, OCR, סינון, וכשל שקט בעיבוד.
- אחזור — התוכן קיים אך לא הוחזר. בדוק ניסוח שאילתה, מודל embedding, top-k, וסינון מטא-דאטה שחסם בטעות.
- דירוג — הקטע הנכון הוחזר אך דורג נמוך ונחתך מההקשר. בדוק reranking וגודל תקציב ההקשר.
- יצירה — הקטע הנכון היה בהקשר והמודל בכל זאת ענה לא נכון. רק כאן שינוי פרומפט הוא הפתרון.
- חלוקה לקטעים — התשובה נחתכה בין שני קטעים ואף אחד מהם אינו שלם. בדוק גבולות וחפיפה.
החזר: { "failing_layer": "", "evidence": "מה בנתונים מוכיח שזו השכבה", "ruled_out": ["שכבות שנשללו ומדוע"], "fix": "התיקון הקונקרטי", "regression_test": "בדיקה שתתפוס את הכשל הזה בעתיד" }
למה זה ממיר טוב
- מוכן להעתקה והדבקה מיידית
- מותאם לעבודה משפטית/ציבורית
- קל להתאמה לתהליך פנימי
תגיות
פרומפטים נוספים
מענה מבוסס-מקורות בלבד על קורפוס משפטי
פרומפט מערכת שאוסר על המודל לענות מתוך ידע פנימי ומחייב ציטוט של קטע מקור לכל טענה, כולל התנהגות מוגדרת כשאין כיסוי במקורות.
תכנון אסטרטגיית חלוקה לקטעים למסמכים משפטיים
מנתח סוג מסמך משפטי ומייצר אסטרטגיית chunking מנומקת — גבולות, חפיפה, מטא-דאטה ומקרי קצה — במקום חלוקה שרירותית לפי תווים.
בניית מערך הערכה למערכת אחזור משפטית
מייצר מערך שאלות הערכה מתוך קורפוס נתון, כולל שאלות שאמורות להיכשל, כדי למדוד אחזור ונאמנות למקור ולא רק מענה מוצלח.