iPAS AI 應用規劃師初級 114 年第四次 科一 第 18 題 詳解

114 年第四次 科一 人工智慧基礎概論

關於Q-Learning與Deep Q-Learning,下列敘述何者最正確?

  1. AQ-Learning與Deep Q-Learning的差異在於是否使用標記資料作為學習基礎

    兩者都屬強化學習,靠獎勵訊號學習,不以標記資料為基礎。

  2. BQ-Learning可處理任意維度的狀態空間,因此比Deep Q-Learning更靈活

    Q 表受限於離散且有限的狀態空間,高維時反而無法擴展。

  3. CDeep Q-Learning透過深度神經網路近似Q值,避免了Q表在高維空間中難以擴展的問題(正確答案)

    正解:以深度神經網路近似 Q 值,解決 Q 表維度爆炸問題。

  4. DDeep Q-Learning無法搭配經驗回放(Experience Replay),因為會導致樣本順序被打亂

    經驗回放正是 DQN 的核心技巧,打亂順序可降低樣本相關性。

正確答案:C

Q-Learning 與 Deep Q-Learning 的差異與強化學習基本機制 看到強化學習題,先確認它靠獎勵訊號試誤學習,再看價值函數是用表格還是神經網路近似。

用刷8題準備 iPAS AI 應用規劃師初級

每天隨手刷 8 題,答錯的題目會自動排回來再考一次。不用註冊,打開就能開始。

開始刷題