AlphaZero самостоятельно учится играть в игры на высочайшем уровне

Друзья, с момента основания проекта прошло уже 20 лет и мы рады сообщать вам, что сайт, наконец, переехали на новую платформу.

Какое-то время продолжим трудится на общее благо по адресу https://n-n-n.ru.
На новой платформе мы уделили особое внимание удобству поиска материалов.
Особенно рекомендуем познакомиться с работой рубрикатора.

Спасибо, ждём вас на N-N-N.ru

Опубликовано gumarov в 10 декабря, 2018 - 20:39

Группа ученых из группы DeepMind и Университетского колледжа в Лондоне разработала систему искусственного интеллекта, способную самообучаться игре и совершенствованию в трех сложных настольных играх. В своей работе, опубликованной в журнале Science, ученые описывают свою новую систему и объясняют, почему считают, что она представляет собой большой шаг в направлении развития будущих систем ИИ.

Прошло более 20 лет с тех пор, как суперкомпьютер Deep Blue победил чемпиона мира по шахматам Гари Каспарова и показал миру, как далеко продвинулись вычисления в сфере ИИ. С тех пор компьютеры становились все умнее и сегодня побеждают людей в таких играх, как шахматы, сёги и го. Однако каждая из подобных программ настраивалась специально, чтобы стать мастером в отдельной игре. В своей новой работе ученые описали создание искусственного интеллекта, который не только хорош в нескольких играх, но и обучается этому совершенствованию самостоятельно.

AlphaZero: новый мастер

Новая система под названием AlphaZero представляет собой систему обучения с подкреплением, то есть обучается, многократно играя в игру и учась на своем опыте. Это, разумеется, очень похоже на процесс обучения людей. Задается базовый набор правил и компьютер играет в игру — сам с собой. Ему даже партнеры не нужны. Он играет сам с собой много раз, отмечая хорошие и победные ходы. Со временем он становится все лучше и лучше, превосходит не только людей, но и другие системы ИИ, разработанные для настольных игр.

Данная система также использовала метод поиска «древа поиска Монте-Карло». Совмещение двух технологий позволило системе научиться совершенствованию в игре. Ученые опробовали силы программы, обеспечив ее большой мощностью — 5000 тензорных процессоров, работающих в паре с большим суперкомпьютером.

На текущий момент AlphaZero освоил шахматы, сёги и го. Следующим шагом станут популярные видеоигры. Что касается производительности ИИ, то в го, например, AlphaZero обыграл легендарного AlphaGo уже через 30 часов.

Пожалуйста, оцените статью:

Источник(и):: Hi-News

Добавить свое объявление
Загрузка...

Войдите на сайт для отправки комментариев

Сайт о нанотехнологиях #1 в России

AlphaZero самостоятельно учится играть в игры на высочайшем уровне

AlphaZero: новый мастер

Категории статьи