Darin (deep and reinforced intelligence net): различия между версиями
Fix course |
Fix topics' list |
||
| Строка 28: | Строка 28: | ||
AWS/Gсloud | AWS/Gсloud | ||
===Темы вводных занятий?=== | ===Темы вводных занятий?=== | ||
Обучении с учителем | * Обучении с учителем | ||
Линейные модели, градиентный спуск | * Линейные модели, градиентный спуск | ||
Введение в нейронные сети | * Введение в нейронные сети | ||
Сверточные сети | * Сверточные сети | ||
Обучение с подкреплением | * Обучение с подкреплением | ||
* Разбор базовых статей | |||
===Направления развития?=== | ===Направления развития?=== | ||
DeepMind и Blizzard сделали [https://deepmind.com/blog/deepmind-and-blizzard-open-starcraft-ii-ai-research-environment/ песочницу] для StarCraft II, поле для исследований просто безгранично. | DeepMind и Blizzard сделали [https://deepmind.com/blog/deepmind-and-blizzard-open-starcraft-ii-ai-research-environment/ песочницу] для StarCraft II, поле для исследований просто безгранично. | ||
Версия от 16:29, 4 ноября 2018
| Ментор | Денис Симагин |
| Учебный семестр | Осень 2018 |
| Учебный курс | 2-3-й курс |
| Максимальное количество студентов, выбравших проект: до 10 | |
Что это за проект?
Сочетание reinforcement learning и deep learning является горячей темой на сегодняшний день. К примеру, изучите статью Playing atari with deep reinforcement learning. Также вы, наверняка, слышали о AlpaGo, программе, которая впервые победила человека, профессионально играющего в Go. Подробнее об этом здесь. Конечная цель перенести идеи статью AlphaGo Zero на игру рендзю.
Для участия в проекте нужно пройти собеседование.
Чему студент научится?
Чтение научных статей на английском Погружение в машинное обучение, сверточные нейронные сети Обучение с подкреплением Плохие шутки
Какие начальные требования?
Машина с UNIX-подобной ОС и мощной видеокартой (возможно облачная) Знание Python 3, Git и работа с командной оболочкой Хорошая математическая подготовка Английский
Какие будут использоваться технологии?
Python3, scipy stack, PyTorch AWS/Gсloud
Темы вводных занятий?
- Обучении с учителем
- Линейные модели, градиентный спуск
- Введение в нейронные сети
- Сверточные сети
- Обучение с подкреплением
- Разбор базовых статей
Направления развития?
DeepMind и Blizzard сделали песочницу для StarCraft II, поле для исследований просто безгранично.
Критерии оценки?
В конце проекта проводится турнир между алгоритмами, на основе которого и выставляются оценки.