Учиться быстрее: новый бенчмарк для обобщения в обучении с подкреплением
Читать статью

Аннотация
В данном отчете мы представляем новый бенчмарк для обучения с подкреплением (RL), основанный на франшизе видеоигр Sonic the Hedgehog™. Этот бенчмарк предназначен для оценки эффективности алгоритмов трансферного обучения и обучения на малом числе примеров (few-shot learning) в области RL. Мы также представляем и оцениваем несколько базовых алгоритмов на новом бенчмарке.
Авторы
Alex Nichol, Vicki Pfau, Christopher Hesse, Oleg Klimov, John Schulman
Полный текст статьи читайте на OpenAI
