חילוץ מטא-דאטה למסמך משפטי לפני אינדוקס
מחלץ שדות מטא-דאטה מובנים ממסמך משפטי כדי לאפשר סינון באחזור, כולל דירוג ודאות והפרדה בין מה שנמצא לבין מה שהוסק.
פרומפט
חלץ מטא-דאטה לאינדוקס מהמסמך הבא. מטא-דאטה שגוי גרוע ממטא-דאטה חסר — הוא מסנן החוצה תוצאות נכונות.
המסמך: <document> [הדבק את המסמך או את עמודיו הראשונים] </document>
החזר JSON בלבד: { "doc_type": "חוזה | פסק דין | חקיקה | תקנות | חוות דעת | מכרז | אחר", "title": "", "parties": [{"name": "", "role": ""}], "dates": {"signed": "", "effective": "", "expiry": "", "published": ""}, "governing_law": "", "jurisdiction": "", "language": "he | en | mixed", "clause_count": 0, "has_schedules": false, "key_topics": [], "confidence": {"שדה": "found | inferred | missing"} }
כללים מחייבים:
- found = הערך מופיע מפורשות בטקסט. inferred = הוסק מהקשר. missing = לא נמצא.
- לעולם אל תמלא שדה בניחוש. missing הוא ערך תקין ורצוי.
- תאריכים בפורמט ISO 8601. אם התאריך במסמך חלקי (רק שנה), החזר את מה שידוע וסמן inferred.
- שמות צדדים בדיוק כפי שהם מופיעים, כולל צורת ההתאגדות.
- אל תסכם את תוכן המסמך. רק חילוץ.
למה זה ממיר טוב
- מוכן להעתקה והדבקה מיידית
- מותאם לעבודה משפטית/ציבורית
- קל להתאמה לתהליך פנימי
תגיות
פרומפטים נוספים
מענה מבוסס-מקורות בלבד על קורפוס משפטי
פרומפט מערכת שאוסר על המודל לענות מתוך ידע פנימי ומחייב ציטוט של קטע מקור לכל טענה, כולל התנהגות מוגדרת כשאין כיסוי במקורות.
תכנון אסטרטגיית חלוקה לקטעים למסמכים משפטיים
מנתח סוג מסמך משפטי ומייצר אסטרטגיית chunking מנומקת — גבולות, חפיפה, מטא-דאטה ומקרי קצה — במקום חלוקה שרירותית לפי תווים.
בניית מערך הערכה למערכת אחזור משפטית
מייצר מערך שאלות הערכה מתוך קורפוס נתון, כולל שאלות שאמורות להיכשל, כדי למדוד אחזור ונאמנות למקור ולא רק מענה מוצלח.