BEGIN:VCALENDAR
VERSION:2.0
PRODID:-//jEvents 2.0 for Joomla//EN
CALSCALE:GREGORIAN
METHOD:PUBLISH
BEGIN:VEVENT
UID:9eq509a23qlb2u2ho91e8246ac@google.com
CATEGORIES:RTportal.ru
CREATED:20170606T092329
SUMMARY:Семинар "Структурные модели и глубинное обучение"
LOCATION:аудитория 615 ИППИ РАН  
DESCRIPTION;ENCODING=QUOTED-PRINTABLE:1830\n \nДокладчик: Максим Кретов (5vision)\n \nТема: Intrinsically-motivat
 ed Reinforcement Learning\n \nАннотация: В докладе будет рассмотрена расшир
 енная постановка задачи обучения с подкреплением, в которую введено понятие
  "внутренних" (intrinsic) наград или мотиваций для решений агента. Данная п
 остановка особенно актуальна для случаев, когда награда среды за действие а
 гента сильно отложена во времени (reward sparsity). Будут рассмотрены разли
 чные подходы к описанию ""внутренней мотивации"" (intrinsic motivation) аге
 нта, и разобран подход к обучению и мотивации через "взаимную информацию" (
 mutual information). "Variational Information Maximisation for Intrinsicall
 y Motivated Reinforcement Learning"\n \n1930 \n \nДокладчик: Михаил Павлов 
 (5vision)\n \nТема: Efficient Domain Exploration Methods for Reinforcement 
 Learning\n\nАннотация: В докладе рассматривается проблема исследования сред
 ы через подсчет числа посещенных состояний (модель псевдо-подсчета состояни
 й, pseudo counts) и установлена связь с обучением через "внутреннюю мотивац
 ию" (intrinsic motivation) агента. Результаты продемонстрированы на примере
  игр Atari. "Unifying Count-Based Exploration and Intrinsic Motivation"\n \
 nhttp://iitp.ru/ru/news/1988.htm This event was imported from: https://rtpo
 rtal.ru/index.php/kalendar-sobytij/eventdetail/141/-/seminar-strukturnye-mo
 deli-i-glubinnoe-obuchenie?tmpl=component
DTSTAMP:20260812T215904Z
DTSTART;TZID=Europe/Moscow:20161025T183000
DTEND;TZID=Europe/Moscow:20161025T210000
SEQUENCE:0
TRANSP:OPAQUE
END:VEVENT
END:VCALENDAR