این اسکیل چه میکند؟
fine-tuning مدل در Azure AI Foundry با SFT نظارتی، DPO ترجیحی یا RFT تقویتی با graderها.
ORIGINAL DESCRIPTION
Fine-tune models on Azure AI Foundry using SFT (supervised), DPO (preference), or RFT (reinforcement with graders).
چه زمانی به کار میآید؟
در دادهٔ اصلی، کاربرد جداگانهای ثبت نشده است. توضیح بالا و صفحهٔ منبع را ببینید.