תכנון חיפוש היברידי לתוכן משפטי
מאזן בין חיפוש לקסיקלי לסמנטי לתוכן משפטי, שבו מספרי סעיפים ומונחים מדויקים דורשים התאמה מילולית אך שאלות מושגיות דורשות דמיון סמנטי.
פרומפט
תכנן שכבת חיפוש היברידי. חיפוש סמנטי בלבד מפספס מספרי סעיפים ומונחים מוגדרים; חיפוש מילולי בלבד מפספס שאלות מושגיות.
הקורפוס: [סוג המסמכים והיקפם] שפות: [עברית / אנגלית / מעורב] סוגי שאילתות טיפוסיים: [תאר 4-6 דוגמאות אמיתיות] תשתית קיימת: [מסד נתונים, מנוע חיפוש, מודל embedding]
הפק:
- חלוקת עבודה — אילו שאילתות צריכות ללכת ללקסיקלי, אילו לסמנטי, ואילו לשניהם. בסס על הדוגמאות שסופקו.
- מקרים שחייבים התאמה מילולית — מספרי סעיפים, מונחים מוגדרים במרכאות, שמות צדדים, מספרי תיק, סכומים, תאריכים. הסבר מדוע embedding נכשל בכל אחד.
- שיטת מיזוג — Reciprocal Rank Fusion או שקלול ליניארי. נמק את הבחירה והצע ערכי פתיחה.
- עברית ספציפית — טיפול בניקוד, כתיב מלא וחסר, צורות נטויות, ראשי תיבות ("ביהמ"ש", "בע"מ"), ותערובת עברית-אנגלית באותו משפט.
- סינון מטא-דאטה — מתי לסנן לפני החיפוש ומתי אחריו, ומדוע הסדר משנה.
- מדידה — כיצד לדעת שההיברידי עדיף על כל שיטה לחוד. הצע מדד ואת נקודת הייחוס.
ציין במפורש שלושה מקרים שבהם ההיברידי עדיין ייכשל.
למה זה ממיר טוב
- מוכן להעתקה והדבקה מיידית
- מותאם לעבודה משפטית/ציבורית
- קל להתאמה לתהליך פנימי
תגיות
פרומפטים נוספים
מענה מבוסס-מקורות בלבד על קורפוס משפטי
פרומפט מערכת שאוסר על המודל לענות מתוך ידע פנימי ומחייב ציטוט של קטע מקור לכל טענה, כולל התנהגות מוגדרת כשאין כיסוי במקורות.
תכנון אסטרטגיית חלוקה לקטעים למסמכים משפטיים
מנתח סוג מסמך משפטי ומייצר אסטרטגיית chunking מנומקת — גבולות, חפיפה, מטא-דאטה ומקרי קצה — במקום חלוקה שרירותית לפי תווים.
בניית מערך הערכה למערכת אחזור משפטית
מייצר מערך שאלות הערכה מתוך קורפוס נתון, כולל שאלות שאמורות להיכשל, כדי למדוד אחזור ונאמנות למקור ולא רק מענה מוצלח.