Привет, Хабр!Q-learning — это алгоритм обучения с подкреплением, который позволяет агенту оптимизировать свою стратегию действий в динамичной среде, стремясь максимизировать сумму будущих наград. Агент исследует среду, принимая решения, основанные на предыдущем опыте, а не на предварительной модели мира.В этой статье мы и рассмотрим этот алгоритм. Читать далее
В данной статье будет подробно рассмотрен алгоритм блочного шифрования, определенный в ГОСТ Р 34.12-2015 как «Кузнечик». На чем он основывается, какова математика блочных криптоалгоритмов, а так же как реализуется данный алгоритм в java. Кто, как, когда и зачем разработал данный…
Картинка отсюда. Machine Learning от Stanford University Machine Learning Foundations: A Case Study Approach от University of Washington CS188.1x: Artificial Intelligence от University of California, Berkeley Practical Machine Learning от Johns Hopkins University Introduction to Artificial Intelligence от Stanford University Artificial Intelligence for Robotics от Stanford University Introduction to Machine Learning Course от Stanford University Читать дальше →
Алгоритм классификации методом поиска ближайших соседей - самый простой и понятный алгоритм, с которого начинается познание азов машинного обучения. Но модификации этого простого алгоритма могут потребовать нетривиального подхода к решению задачи. В этой статье я описал реализацию классификатора, использующего алгоритм поиска ближайших соседей под названием Ball Tree. И как же написать его на Python?