第 22 題(共 548 題)
一間金融科技公司設計一款智慧投資系統,該系統會根據市場變化自動決定「買進」、「持有」或「賣出」的行動,並根據每次交易後的盈虧結果,逐步優化下一次的投資策略。整個過程中,系統不依賴事先標記的資料,而是根據歷次行動獲得的獎勵進行調整。請問此系統最可能採用哪一種學習方法?
解析
系統根據獎勵(盈虧)逐步優化決策策略,不依賴標記資料,這正是強化式學習的特徵。
正確答案:A. 強化式學習(Reinforcement Learning);
系統根據獎勵(盈虧)逐步優化決策策略,不依賴標記資料,這正是強化式學習的特徵。
正確答案:A. 強化式學習(Reinforcement Learning);