|
Deep Learning 4|用Python進行強化學習的開發實作
|
|
|
|
|
|
|
|
|
ISBN |
9786263246119 |
定价 |
NT680 |
售价 |
RM106.30 |
优惠价 |
RM94.61 *
|
作者 |
斎藤康毅
|
译者 |
吳嘉芳 |
出版社 |
歐萊禮
|
出版日期 |
2023-09-14 |
装订 |
平裝. 單色印刷. 344 页. 23. |
库存量 |
海外库存 下单时可选择“空运”或“海运”(空运和海运需独立下单)。空运费每本书/CD是RM28.00。 空运需时8-11个工作天,海运需时约30个工作天。 (以上预计时间不包括出版社调货的时间以及尚未出版的预购商品) |
|
我要订购 有现货时通知我 |
|
放入下次购买清单 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
本暢銷系列作品的第4本書,這次的主題是強化學習。書中延續此系列的一貫風格,顯示實際的程式碼,讓讀者邊執行邊學習,不依賴外部程式庫,從零開始建置、學習支撐強化學習的基本技術與概念。
從「理論」與「實踐」兩方面著手,仔細解說強化學習這個複雜主題的構成要素,讓讀者確實掌握強化學習的獨特理論。有別於只用公式說明理論的書籍,讀者可以從書中的程式碼,獲得許多意想不到的領悟。 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
目錄
第 1 章 吃角子老虎機問題
第 2 章 馬可夫決策過程
第 3 章 貝爾曼方程式
第 4 章 動態規劃法
第 5 章 蒙地卡羅法
第 6 章 TD 法
第 7 章 類神經網路與 Q 學習
第 8 章 DQN
第 9 章 策略梯度法
第 10 章 進階內容
附錄 A 離線策略蒙地卡羅法
附錄 B n 步 TD 法
附錄 C 理解 Double DQN
附錄 D 驗證策略梯度法
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
作者簡介
斎藤康毅
1984年生於長崎縣對馬,畢業於東京工業大學工學院,東京大學研究所學際情報學府學士課程修畢。現在於企業內從事與電腦視覺、機器學習有關的研究開發工作。1984年生於長崎縣對馬,畢業於東京工業大學工學院,東京大學研究所學際情報學府學士課程修畢。現在於企業內從事與電腦視覺、機器學習有關的研究開發工作。 |
|
|
|
|
|
|
|
|
|
|
|