李宏毅:AI Agent技术

阅读 35 格式 pdf 大小 17.7 MB 共96页2025-05-18 22:11:22发布于浙江
AIAgent李宏毅免不責一聲定明跟:其A他I地Ag方e一nt樣是一個被廣泛使用的詞彙,故本課程中所講的AIAgent今的天方使式用AIAIAgent的翻譯「人工智慧代理人」人類給予明確指令A一I個一動個作口令(解決某個研究問題)假設…實驗…分析AIAgent需要多步驟、靈活調整計畫人類給予目標AI自己想辦法達成AIAgentObseationActionGoalAIAgent(AlphaGo)Obseation贏棋Goal“5-5”Action好像在那裡聽過這個段落?這是ReinforcementLearning(RL)常見開場如何打造AIAgent?RL?(RL:ReinforcementLearninObseation贏棋GoalRewardRL:Learnto“5-5”MaximizeActionReward侷限:需要為了每一個任務以RL訓練模型如何打造AIAgent?直接用!LLM以文字描述Obseation(option)“你要贏得勝G利oa”lLLM“我要下在5-5”轉譯為行動Action以望LLM直接...

1、当您付费下载文档后,您只拥有了使用权限,并不意味着购买了版权,文档只能用于自身使用,不得用于其他商业用途(如 [转卖]进行直接盈利或[编辑后售卖]进行间接盈利)。
2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。
3、如文档内容存在违规,或者侵犯商业秘密、侵犯著作权等,请点击“违规举报”。

碎片内容

发表评论取消回复

参与评论可获取积分奖励  
嘿牛投研
所有文档均来自公开网络合法下载搬运, 仅供学习交流,不对其内容观点负责,感谢大哥大姐老板们支持打赏!有事请私信我,少一次投诉,多一份感恩🥹!

文档

1784

收藏

0

店铺

企业店铺
广告位不存在!
确认删除?
VIP会员服务
限时9折优惠