Курс на Stepik
Обложка курса «Reinforcement Learning для LLM» на Stepik
5 000 ₽

Reinforcement Learning для LLM 0.000

Открыть на
STEPIK.ORG

Инженерный курс по обучению с подкреплением для LLM и систем с агентами: от MDP, бандитов, REINFORCE/PPO и offline RL до моделей награды, RLHF/DPO, RLVR/GRPO, test-time search, agentic RL, инфраструктуры и evaluation. Платный курс на Stepik дополнительно к открытым лекциям включает более 500 заданий: автопроверяемые тесты, упражнения с решениями и вопросы для самопроверки с ответами и ноутбуки. Курс входит в развивающуюся серию об ML и LLM.

Показатель Текущие показатели Рост
Значение 🏆 Рейтинг 3 дн 7 дн 30 дн
Количество учеников на курсе «Reinforcement Learning для LLM»Учеников на курсе 0
Сертификаты, выданные на курсе «Reinforcement Learning для LLM»Сертификатов выдано 0
Отзывы о курсе «Reinforcement Learning для LLM»Отзывов получено 0
Рейтинг курса «Reinforcement Learning для LLM»Рейтинг курса 0.000
Уроки в курсе «Reinforcement Learning для LLM»Количество уроков 114
Тесты в курсе «Reinforcement Learning для LLM»Количество квизов 136
Задачи с кодом в курсе «Reinforcement Learning для LLM»Количество задач с кодом 7
Стоимость курса «Reinforcement Learning для LLM»Стоимость курса 5 000 ₽
Обновления курса «Reinforcement Learning для LLM»Обновления курса
Дата публикации курса «Reinforcement Learning для LLM»Дата публикации курса
Последнее обновление курса «Reinforcement Learning для LLM»Последнее обновление
Сложность normal

Команда курса

Аватар Влад Куликов — преподаватель курса Reinforcement Learning для LLM

Влад Куликов

author instructor

Lead AI/ML (LLMs) в FinTech. В ML с 2017 года — R&D, разработка ML/GenAI систем, консультирование бизнеса по созданию и внедрению AI. Магистратура МФТИ — Modern State of AI. Диссертация и публикации...