Привет, Хабр! В начале июня в Вене прошла главная международная конференция по робототехнике и автономным системам — International Conference on Robotics and Automation (ICRA). В этом году среди участников была и наша команда автономного транспорта Яндекса.Топиков, которые обсуждаются…
Продолжаю погружаться в Reinforcement Learning. Здесь продолжение статьи Intro Reinforcement Learning. Если предыдущая часть помогла вам понять, что такое среда, агент, награды и функции ценности, то здесь мы сделаем шаг дальше: мы переходим к model-free алгоритмам и Deep Reinforcement Learning, где агент учится оптимальной стратегии, не имея прямого доступа к модели среды. Читать далее
Привет, Хабр! Меня зовут Артем Лыков, я руководитель направления Physical AI в МТС Web Services. В начале июня я побывал на ICRA 2026 в Вене — одной из главных мировых конференций по робототехнике и автоматизации.В этом году мероприятие проходило с 1 по 5 июня на площадке Messe Wien. Конференция…
В предыдущих статьях Intro Reinforcement Learning и Reinforcement Learning: Model-free & Deep RL были рассмотрены подходы, в которых оптимальные действия находились косвенно через оценку полезности состояний или пар «состояние–действие». Такие методы принято называть value-based. Однако возникает…