iPAS AI 應用規劃師初級 114 年第四次 科一 第 28 題 詳解
114 年第四次 科一 人工智慧基礎概論
對非常長的輸入序列進行推理(Inference),Transformer模型推理的主要計算瓶頸通常是什麼?
- A模型輸出層產生文本的過程,因為每生成一個詞都必須重新訓練整個模型一次
推理不會重新訓練模型,敘述本身違反基本流程。
- B詞嵌入(Embedding)查找操作,因為其時間複雜度隨詞彙表大小指數級增長
詞嵌入只是查表,成本固定且極低。
- CSoftmax函數的計算,因為對每個Token都需要執行繁重的運算
Softmax對每個Token是線性成本,非主要瓶頸。
- D自注意力層的計算和其記憶體使用,因為注意力矩陣的大小隨序列長度呈平方級增長(正確答案)
注意力矩陣為序列長度的平方,記憶體與算力同時爆增。
正確答案:D
考自注意力機制的計算複雜度與長序列推理瓶頸。 問模型效能瓶頸時,先鎖定隨輸入長度非線性成長的運算結構。
用刷8題準備 iPAS AI 應用規劃師初級
每天隨手刷 8 題,答錯的題目會自動排回來再考一次。不用註冊,打開就能開始。
開始刷題