李宏毅：深入浅出讲解AI Agent

阅读 47 格式 pdf 大小 4.94 MB 共96页2025-07-30 19:40:20发布于浙江

立即下载加入VIP

海报

/96

立即下载加入VIP

文本预览下载提示常见问题

AIAgent李宏毅免責聲明：AIAgent是一個被廣泛使用的詞彙，故本課程中所講的AIAgent不一定跟其他地方一樣今天使用AIAIAgent的翻譯的方式「人工智慧代理人」人類給予明確指令(解決某個研究問題)AI一個口令假設…實驗…分析一個動作需要多步驟、靈活調整計畫AIAgent人類給予目標AI自己想辦法達成AIAgentObservationActionGoalAIAgent(AlphaGo)ObservationGoal贏棋“5-5”Action好像在那裡聽過這個段落？這是ReinforcementLearning(RL)常見開場(RL:ReinforcementLearning)如何打造AIAgent?RL?ObservationGoal贏棋RewardRL:Learnto“5-5”MaximizeRewardAction侷限：需要為了每一個任務以RL訓練模型如何打造AIAgent?直接用LLM！以文字描述Observation(option)Goal“你要贏得勝利”LLM“我要下在5-5”轉譯為行動Action以...

1、当您付费下载文档后，您只拥有了使用权限，并不意味着购买了版权，文档只能用于自身使用，不得用于其他商业用途（如 [转卖]进行直接盈利或[编辑后售卖]进行间接盈利）。
2、本站所有内容均由合作方或网友上传，本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺！文档内容仅供研究参考，付费前请自行鉴别。
3、如文档内容存在违规，或者侵犯商业秘密、侵犯著作权等，请点击“违规举报”。

碎片内容

港仔研报的最新文档