AIAgent李宏毅免不責一聲定明跟:其A他I地Ag方e一nt樣是一個被廣泛使用的詞彙,故本課程中所講的AIAgent今的天方使式用AIAIAgent的翻譯「人工智慧代理人」人類給予明確指令A一I個一動個作口令(解決某個研究問題)假設…實驗…分析AIAgent需要多步驟、靈活調整計畫人類給予目標AI自己想辦法達成AIAgentObseationActionGoalAIAgent(AlphaGo)Obseation贏棋Goal“5-5”Action好像在那裡聽過這個段落?這是ReinforcementLearning(RL)常見開場如何打造AIAgent?RL?(RL:ReinforcementLearninObseation贏棋GoalRewardRL:Learnto“5-5”MaximizeActionReward侷限:需要為了每一個任務以RL訓練模型如何打造AIAgent?直接用!LLM以文字描述Obseation(option)“你要贏得勝G利oa”lLLM“我要下在5-5”轉譯為行動Action以望LLM直接...
发表评论取消回复