iPAS AI 應用規劃師初級 114 年第四次 科一 第 18 題 詳解
114 年第四次 科一 人工智慧基礎概論
關於Q-Learning與Deep Q-Learning,下列敘述何者最正確?
- AQ-Learning與Deep Q-Learning的差異在於是否使用標記資料作為學習基礎
兩者都屬強化學習,靠獎勵訊號學習,不以標記資料為基礎。
- BQ-Learning可處理任意維度的狀態空間,因此比Deep Q-Learning更靈活
Q 表受限於離散且有限的狀態空間,高維時反而無法擴展。
- CDeep Q-Learning透過深度神經網路近似Q值,避免了Q表在高維空間中難以擴展的問題(正確答案)
正解:以深度神經網路近似 Q 值,解決 Q 表維度爆炸問題。
- DDeep Q-Learning無法搭配經驗回放(Experience Replay),因為會導致樣本順序被打亂
經驗回放正是 DQN 的核心技巧,打亂順序可降低樣本相關性。
正確答案:C
Q-Learning 與 Deep Q-Learning 的差異與強化學習基本機制 看到強化學習題,先確認它靠獎勵訊號試誤學習,再看價值函數是用表格還是神經網路近似。
用刷8題準備 iPAS AI 應用規劃師初級
每天隨手刷 8 題,答錯的題目會自動排回來再考一次。不用註冊,打開就能開始。
開始刷題