Please enable javascript in your browser.
Page
of
0
بهینه سازی سیستم در محاسبات لبه با استفاده از متا یادگیری
زواشکیانی، سعید رضا Zouashkiani, Saeed Reza
Cataloging brief
بهینه سازی سیستم در محاسبات لبه با استفاده از متا یادگیری
پدیدآور اصلی :
زواشکیانی، سعید رضا Zouashkiani, Saeed Reza
ناشر :
صنعتی شریف
سال انتشار :
1403
موضوع ها :
فرایادگیری تقویتی Meta Reinforcement Learning شبکه عصبی گرافی Graph Neural Network ...
شماره راهنما :
05-57248
Find in content
sort by
page number
page score
Bookmark
مقدمه
(12)
تعریف مسئله
(13)
اهداف پژوهش
(16)
راهکار پیشنهادی
(18)
ساختار پایاننامه
(19)
مفاهیم پایه در یادگیری عمیق و یادگیری تقویتی
(20)
یادگیری عمیق
(20)
شبکههای عصبی پیشخور
(21)
شبکههای عصبی پیچشی
(22)
شبکههای عصبی بازگشتی
(22)
شبکههای عصبی گرافی
(24)
یادگیری تقویتی عمیق
(25)
مقدمات یادگیری تقویتی
(25)
برنامهریزی پویا (DP)
(29)
مونت کارلو (MC)
(30)
تفاوت زمانی (TD)
(31)
یادگیری تقویتی بدون مدل
(32)
SARSA
(33)
Q-learning
(33)
شبکه Q عمیق(DQN)
(34)
گرادیان خطمشی
(35)
REINFORCE
(35)
عملگر-نقاد
(36)
روشهای ناحیه اطمینان (TRPO)
(37)
بهینهسازی خطمشی تقریبی (PPO)
(37)
فرایادگیری تقویتی
(38)
Reptile
(41)
کارهای پیشین
(43)
تاریخچه
(43)
روشهای زمانبندی وظیفه
(45)
واگذاری دودویی
(47)
روشهای سنتی
(47)
روشهای مبتنی بر یادگیری تقویتی
(48)
واگذاری جزئی
(48)
روشهای سنتی
(49)
روشهای مبتنی بر یادگیری تقویتی
(51)
جمعبندی
(52)
راهکار پیشنهادی
(54)
صورتبندی مسئله واگذاری محاسباتی جزئی وابسته در رایانش لبه
(54)
مدلسازی فرآیند واگذاری محاسباتی جزئی به مسئله یادگیری تقویتی
(59)
طراحی مدل خطمشی یادگیری تقویتی
(60)
نحوه آموزش مدل
(63)
پیادهسازی و نتایج
(66)
تنظیمات اولیه مدل
(66)
تسریع فرآیند آموزش
(67)
محیط شبیهسازی
(68)
نتایج
(70)
نتیجهگیری و راهکارهای آینده
(75)
نتیجهگیری و جمعبندی
(75)
راهکارهای آینده
(76)
استفاده از معماریهای مبتنی بر ترنسفورمر
(76)
استفاده از روشهای فشردهسازی مدل
(76)
افزایش پیچیدگی سناریو رایانش لبه
(77)
معرفی معیارهای جدید برای بهینهسازی
(77)
تابآوری خطا در تصمیمگیری
(77)
مراجع
(78)
مطالب تکمیلی
(85)
الگوریتم PPO
(85)