این اسکیل چه میکند؟
آموزش و fine-tuning مدلهای زبانی transformer با TRL یا Transformers Reinforcement Learning.
ORIGINAL DESCRIPTION
Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning).
چه زمانی به کار میآید؟
در دادهٔ اصلی، کاربرد جداگانهای ثبت نشده است. توضیح بالا و صفحهٔ منبع را ببینید.