iPAS AI 應用規劃師初級 114 年第四次 科一 第 17 題 詳解

114 年第四次 科一 人工智慧基礎概論

一間金融科技公司設計一款智慧投資系統,該系統會根據市場變化自動決定「買進」、「持有」或「賣出」的行動,並根據每次交易後的盈虧結果,逐步優化下一次的投資策略。整個過程中,系統不依賴事先標記的資料,而是根據歷次行動獲得的獎勵進行調整。請問此系統最可能採用哪一種學習方法?

  1. A強化式學習(Reinforcement Learning)(正確答案)

    以行動與獎勵訊號反覆調整策略,符合強化式學習定義。

  2. B監督式學習(Supervised Learning)

    需事先標記的輸入與正確答案,題幹明講沒有標記資料。

  3. C非監督式學習(Unsupervised Learning)

    目的在分群或降維找隱藏結構,不含獎勵回饋。

  4. D遷移學習(Transfer Learning)

    是把既有模型知識搬到新任務的技巧,非學習回饋機制。

正確答案:A

判斷情境屬於哪一種機器學習典範,重點在強化式學習的獎勵回饋機制。 先看資料形式:有標準答案走監督式,只有特徵找結構走非監督式,靠行動後的獎懲調整就是強化式。

用刷8題準備 iPAS AI 應用規劃師初級

每天隨手刷 8 題,答錯的題目會自動排回來再考一次。不用註冊,打開就能開始。

開始刷題