iPAS AI 應用規劃師初級 115 年第三次 科二 第 39 題 詳解

115 年第三次 科二 生成式 AI 應用與規劃

在將開源的大語言模型應用於實際商業產品時,為降低模型產生敏感或不當內容的風險,下列哪一項安全防護措施最為合理且可行?

  1. A信任開源模型出廠時已完成安全對齊(Safety Alignment),在產品端無須再對其輸入輸出進行任何監控

    開源模型的安全對齊會被繞過,產品端仍須自建防護。

  2. B採取嚴格的關鍵字阻擋,禁止使用者輸入任何涉及政治或宗教等爭議話題,以求徹底杜絕不當輸出

    純關鍵字阻擋易誤殺且被改寫繞過,防護不完整。

  3. C為了達到零風險,系統產生的每一筆AI回覆都必須先交由人工逐件審核通過後,才能呈現給使用者

    逐件人工審核無法規模化,實務上不可行。

  4. D於模型前後端部署獨立的安全防護網(Guardrails)監控機制,即時攔截並過濾有害輸入,並在模型產生不當內容時進行阻斷或拒答(正確答案)

    輸入輸出雙向即時攔截,兼顧安全與可營運性。

正確答案:D

考生能否辨識生成式AI產品化時的防護網(Guardrails)機制設計原則。 遇到風險控管題,先問這個做法能否在可營運的成本下持續運作,再問它是否覆蓋輸入與輸出兩端。

用刷8題準備 iPAS AI 應用規劃師初級

每天隨手刷 8 題,答錯的題目會自動排回來再考一次。不用註冊,打開就能開始。

開始刷題