Обзор Reinforcement Learning с ICML | Дмитрий Бабаев, Яндекс

Опубликовано: 04 Март 2026
на канале: Yandex for ML
506
16

Это Дмитрий Бабаев, руководитель ML R&D в Яндекс Картах. Дмитрий рассказал о самых запоминающихся статьях про обучение с подкреплением с ICML этого года. Например, Дмитрий поговорил о работе Stop Regressing: Training Value Functions via Classification for Scalable Deep RL от DeepMind, которая посвящена нестандартному подходу к регрессиям.

Подписывайтесь на телеграм-канал «Яндекс для ML-инженеров»: https://t.me/yandexforml