بازگشت به نتایج جستجو

github / AGENT SKILL

arize-evaluator

فارسی + English

این اسکیل چه می‌کند؟

برای روندهای ارزیابی LLM-as-judge در Arize است؛ شامل ساخت یا به‌روزرسانی evaluator، اجرای ارزیابی روی spanها یا experimentها و taskها…

ORIGINAL DESCRIPTION

INVOKE THIS SKILL for LLM-as-judge evaluation workflows on Arize: creating/updating evaluators, running evaluations on spans or experiments, tasks…

چه زمانی به کار می‌آید؟

در دادهٔ اصلی، کاربرد جداگانه‌ای ثبت نشده است. توضیح بالا و صفحهٔ منبع را ببینید.

بخشی از متن اصلی با «…» قطع شده است. ادامهٔ آن حدس زده یا تکمیل نشده است.