iPAS AI 應用規劃師初級 115 年第二次 科二 第 30 題 詳解

115 年第二次 科二 生成式 AI 應用與規劃

一家法律科技公司導入RAG系統協助律師查詢判例,但有時會引用關聯性不足的文件,影響生成內容的可信度。若在流程中引入強化學習(Reinforcement Learning),其主要作用為何?

  1. A依據律師回饋作為獎勵訊號,優化系統判斷檢索結果品質的能力(正確答案)

    律師回饋即獎勵訊號,用來優化檢索品質判斷,符合強化學習定義。

  2. B改善檢索排序機制,使較相關的文件優先被選用

    只講排序結果變好,沒有獎勵回饋機制,傳統重排序即可做到。

  3. C增加知識庫文件數量,以提升查詢涵蓋範圍

    擴充知識庫屬資料面工程,與學習機制無關。

  4. D以模型生成取代檢索機制,直接產生答案

    取消檢索就不是 RAG,且會放大幻覺。

正確答案:A

強化學習以獎勵訊號回饋調整策略,在 RAG 流程中的實際角色。 看到強化學習就先找「誰給獎勵、優化什麼決策」,沒有回饋訊號的敘述就不是它。

用刷8題準備 iPAS AI 應用規劃師初級

每天隨手刷 8 題,答錯的題目會自動排回來再考一次。不用註冊,打開就能開始。

開始刷題