Hugging Face выпустила TRL 1.13 с обучением на контексте свыше миллиона токенов

Wait 5 sec.

TRL 1.13 ускоряет расчёт функции потерь и добавляет пример обучения на контексте свыше миллиона токенов. Из библиотеки удалён устаревший PPOTrainer.— Читать дальше «Hugging Face выпустила TRL 1.13 с обучением на контексте свыше миллиона токенов»