ХАРД-КОР-ОБУЧЕНИЕ ДЛЯ НЕЙРОСЕТЕЙ 🤖
ㅤ
Похоже, системы планирования ИИ скоро ждёт сильный буст. За них взялся Владислав Куренков, руководитель научной группы «Адаптивные агенты» Института AIRI.
ㅤ
Исследователь запустил
открытое сообщество экспертов, чтобы вместе научить ИИ проходить одну из самых сложных игр — NetHack.
ㅤ
В чём суть 👇
ㅤ
🔥 Подробности читайте в интервью
ㅤ
Похоже, системы планирования ИИ скоро ждёт сильный буст. За них взялся Владислав Куренков, руководитель научной группы «Адаптивные агенты» Института AIRI.
ㅤ
Исследователь запустил
открытое сообщество экспертов, чтобы вместе научить ИИ проходить одну из самых сложных игр — NetHack.
ㅤ
В чём суть 👇
ㅤ
• NetHack — прекрасный полигон для обучения ИИ. За одну сессию можно сделать десятки тысяч ходов, у игрока есть всего одна жизнь, нет сохранений, а в каждой партии генерируется новое уникальное подземелье. Ошибка, допущенная несколько тысяч ходов назад, может легко привести к поражениюㅤ
• Такие условия отлично ложатся на одну из главных проблем ИИ-агентов. Отдельные шаги они выполняют качественно, но с долгосрочным планированием справляются плохо. Обучение в NetHack поможет им развить этот навык
🔥 Подробности читайте в интервью