iPAS AI 應用規劃師初級 115 年第三次 科一 第 13 題 詳解

115 年第三次 科一 人工智慧基礎概論

某電商平台的資料科學團隊欲建置一套NLP模型,用於分析顧客在社群媒體上對商品的評論情緒。在將原始貼文資料送入模型訓練前,團隊執行了以下步驟:移除貼文中夾雜的HTML標籤與網址、將表情符號轉換或移除、去除「的、了、啊」等對情緒判斷無實質貢獻的停用詞,並統一將文字轉換為小寫格式。請問上述步驟主要屬於機器學習專案流程中的哪一環節?

  1. A模型評估(Model Evaluation):透過移除干擾詞彙,計算模型在測試資料集上的準確率、精確率等指標表現

    評估是用指標檢驗訓練後模型,非處理原始文字。

  2. B特徵萃取(Feature Extraction):將文字資料轉換為數值向量,使模型能夠識別評論中與情緒相關的關鍵詞彙權重

    特徵萃取是把已清理文字轉成數值向量,屬下一步。

  3. C資料清理與預處理(Data Cleaning and Preprocessing):將原始、雜亂的文字資料轉換為格式一致、去除雜訊的乾淨資料,以利後續模型有效學習(正確答案)

    去標籤、去停用詞、統一大小寫即典型預處理。

  4. D超參數調校(Hyperparameter Tuning):調整模型訓練過程中的學習率、批次大小等參數,以移除訓練資料中的雜訊干擾

    調學習率、批次大小與清除資料雜訊無關。

正確答案:C

辨識機器學習專案流程中「資料清理與預處理」所涵蓋的工作內容。 先看動作是在「整理原始資料」還是在「轉數值、調參數、算指標」,再對應流程環節。

用刷8題準備 iPAS AI 應用規劃師初級

每天隨手刷 8 題,答錯的題目會自動排回來再考一次。不用註冊,打開就能開始。

開始刷題