ערוך זאת מתיאור
- עבור לAnalyze → eval authoring ובחר new eval.
- תאר מה למדוד באנגלית פשוטה, או בחר מstart from an example…, ובחר draft.
- בדוק את השדות ואת הקוד שהוא ממלא, ואז בדוק אותו ופרוס אותו.

הגדר את השדות
השתמש בתנאי כדי להגביל הערכה לעוזרים וסביבות המיועדות לה:
כתוב את הקוד בעצמך
קוד ה-evaluator הוא ביטוי Python אחד שמחזירEvalResult(...), עם session בהיקף. זה מדרג את חלק תוצאות הכלים שחזרו בסדר:
score= להערכת ניקוד, או ערך metrics או assertions בשם המפתח להערכת מטרי או קביעה. מטריקות ותביעות אחרות רוכבות איתו, עד 25 תוצאות בריצה.
כלום אחר אינו זמין: אין ייבואים, וללא תכונות מעבר לנתוני הסשן וטופל טקסט ושיטות מילון רגילות כמו
get, lower, ו-split, שיש להם להיקרא במקום להיות מופנים. מפתחות payload הם כל מה שהעוזרים שלך שולחים — status לעיל הוא רק דוגמה — אז קרא אותם מסשן אמיתי. format מסדר את הקוד ו-fix מבקש מהעוזר לתקן אותו. הקוד יכול להיות עד 128 KiB, והתנאי עד 16 KiB.


