Открыть возможность и почитать учебник по Reinforcement Learning 💛

Ребята собрали большой open-source учебник по RL — от многоруких бандитов и MDP до RLHF, reasoning-моделей и мультиагентных систем.

🔜 Внутри: • 320+ страниц и 17 глав • Jupyter-ноутбуки для каждой темы • задачи с решениями • запуск в бесплатном Google Colab • черновой перевод на русский

▶️Темы: • основы RL: MDP, Monte Carlo, TD-learning • Deep RL: DQN, PPO, actor-critic • RLHF и alignment: DPO, ORPO, GRPO и другие подходы • reasoning, chain-of-thought и AI-агенты

🔥 Также есть разборы кейсов: • InstructGPT • Llama 2 • Constitutional AI • DeepSeek-R1

Говорят, по материалам уже готовились к hard-RL собеседованиям в топ-компании.

Отдельно — комьюнити ML-энтузиастов Mountain AI: TG: @mountainai_info Сайт: https://mountainai.tech

Открыть возможность и почитать учебник по Reinforcement Learning 💛
Ребята собрали большой open-source учебник по RL — от многоруких бандитов и MDP до RLHF, reasoning-моделей и мультиагентных систем | Сетка — социальная сеть от hh.ru
Открыть возможность и почитать учебник по Reinforcement Learning 💛
Ребята собрали большой open-source учебник по RL — от многоруких бандитов и MDP до RLHF, reasoning-моделей и мультиагентных систем | Сетка — социальная сеть от hh.ru Открыть возможность и почитать учебник по Reinforcement Learning 💛
Ребята собрали большой open-source учебник по RL — от многоруких бандитов и MDP до RLHF, reasoning-моделей и мультиагентных систем | Сетка — социальная сеть от hh.ru