بازگشت به نتایج جستجو

github / AGENT SKILL

eval-driven-dev

فارسی + English

این اسکیل چه می‌کند؟

ساخت pipeline ارزیابی خودکار سرتاسری اپ AI پایتونی؛ اجرای مانند کاربر واقعی با ورودی واقعی، امتیازدهی evaluator و pass/fail با pixie test.

ORIGINAL DESCRIPTION

You're building an automated evaluation pipeline that tests a Python-based AI application end-to-end — running it the same way a real user would, with real inputs — then scoring the outputs using evaluators and producing pass/fail results via pixie test .

چه زمانی به کار می‌آید؟

در دادهٔ اصلی، کاربرد جداگانه‌ای ثبت نشده است. توضیح بالا و صفحهٔ منبع را ببینید.

کاربردهای مرتبط

برچسب‌گذاری خودکار بر اساس نام و توضیح؛ ممکن است نیازمند اصلاح باشد.