当前位置:我的网站主页 > 我的网站国内 > 我的网站内容

黑色幽默

一文讲透Agent的底层逻辑_我的网站

醉玲珑

一 |       北京8月18日电朱镕基同志生平  中国共产党的优秀党员,久经考验的忠诚的共产主义战士,杰出的无产阶级革命家、政治家,党和国家的卓越领导人,中国共产党第十四届、十五届中央政治局常委,国务院原总理朱镕基同志,因病医治无效,于2026年8月12日11时06分在北京逝世,享年98岁。    这篇文章,源于我一年半的AI开发实践,也源于我离职这近两个月里和许多团队密集交流后的一个强烈感受。  朱镕基同志,1928年10月23日生,湖南长沙人。

二 | 1948年12月参加革命工作,1949年10月加入中国共产党。我发现,在讨论Agent时,我们常常陷入两种误区:一些人将其神秘化,认为它无所不能;另一些人则将其过度简化,认为它“不过是把ChatGPT多调用几次”。

三 | 他青少年时期就热爱祖国,勤奋好学,追求进步,矢志报国。

四 | 1947年至1951年,在清华大学电机系电机制造专业学习并参加“新民主主义青年联盟”。1951年至1952年,任东北工业部计划处生产计划室副主任。1952年至1958年,历任国家计划委员会燃动局、综合局组长,国家计委主任办公室副处长,国家计委机械局综合处副处长。                   因为对 agentic 循环过程的体感缺少和原理的理解,形成认知的错位,最终导致我们的沟通成本很高。

五 | 1958年至1969年,历任国家计委干部业余学校教员、国民经济综合局工程师。1970年至1975年,下放国家计委“五七”干校劳动。                   因此,我写下这篇长文,希望能为我们这些从业者,建立一个关于Agent的体感和共识基础:AI Agent能力的质变,不仅在于底层大模型日益增长的智力,更关键的,在于我们围绕模型所设计的、那一套行之有效的“认知流程”。                   本文近万字,就是体感的建立和对这套“流程”的完整拆解。你可以根据这份指南,快速找到自己感兴趣的部分:                    第一部分:建立直观理解                         这里,我用了一个“学霸的五个成长阶段”的比喻,来描述Agent核心能力的演进过程。1975年至1979年,历任石油工业部管道局电力通讯工程公司办公室副主任、副主任工程师,中国社会科学院工业经济研究所室主任。1979年至1983年,历任国家经济委员会燃动局处长、综合局副局长、技改局局长,国家经委委员。                   同时,我们会分析那个被行业广泛使用的“旅行规划”案例。1983年至1987年,历任国家经委副主任、党组成员,国家经委副主任、党组副书记。

六 | 它就像一道“标准考题”,在对比中,我们可以清晰地看到一个动态流程与一次性生成的本质区别。他提出,国家经济管理部门对企业技术进步工作的管理职能要完成“三个转变”,即以投资支持为主转到以政策支持为主、以指令性计划为主转到以指导性计划为主、以行政手段为主转到以经济手段和法律手段为主,将工作重点放在制定规划、政策、法规和组织协调、检查监督等方面,以加强宏观管理;在对外贸易中,要坚持引进技术和扩大贸易相结合的原则,加大企业技术改造力度。

七 |                    第二部分:面向开发者的核心                         第四节是本文的技术核心。它会详细拆解“流程”带来的三重价值:如何用“结构”为思考建立脚手架,如何用“迭代”为记忆打造压缩算法,以及如何用“交互”为模型连接现实世界。

八 |   1987年12月至1991年4月,朱镕基同志历任上海市委副书记、市长、市委书记。他强调,面对国际国内经济竞争的双重挑战,上海的根本出路是下决心调整工业结构,重组新的发展优势,增强国际竞争能力,走发展外向型经济的路子,利用国际经济资源,争取更大的发展空间。他稳步推进上海产业结构调整和升级,发展深加工、知识技术密集型主导产业和重点行业,用新技术改造传统产业,抓好原材料工业建设,增强工业协调、配套能力,推动上海在转型发展道路上迈出坚实步伐。                   第六节探讨了我们的角色转变——从“提示词工程师”到“Agent 流程架构师” ,并讨论了Agent的性能工程与未来的架构演进方向。                   第三部分:探寻理论根基                         最后,如果你好奇为什么这套“思考->行动->观察”的流程从根本上就是有效的,0x04 会为你揭示其背后的科学基石,它与经典的控制论和信息论有着深刻的联系。                   希望这篇文章,能为我们后续的交流与协作,提供一个更坚实的起点。                   一、如果,高考可以再来一次                    这几个月,我和非常多的开发者交流AI Agent。一个普遍的困惑是,很多人都知道Agent那个抽象的“思考 -> 行动 -> 观察”循环,但却无法真正“体感”到它的威力。注重搞活上海地方国营企业,引导企业从产品经济观念转到商品经济观念,从内向型经营思想转到外向型经营思想,引入竞争机制,推行承包经营责任制,真正使企业自负盈亏、提高经济效益。他们会问:                              “这不就是我和ChatGPT多聊几轮吗?凭什么自动化之后就能产生质变?”                    为了回答这个问题,我们不妨先回到一个大家都经历过的场景。                   问一个可能有些“扎心”的问题:如果时间倒流,让你在高考结束的第二天,立刻重考一次,你的分数会更高吗?                    相信许多曾为高考结果扼腕叹息的同学会立刻站起来:                    “我考完才猛然想起,那道复杂的解析几何题,如果换个思路用‘数形结合’的方法,本可以迎刃而解。着力加强质量管理,强调质量是生命、质量是效益,要充分发挥上海的科技和人才优势,开发新产品、新品种,走优质优价的路子。重视金融业开放和发展,积极引进外资银行和外资保险公司,推动开设上海证券交易所。加快推进以交通为中心的基础设施建设,构建上海枢纽型、功能性、网络化的现代城市基础设施体系。”                         “我因为太过紧张,有道选择题,脑子里想的是B,手上却涂成了C,交卷前也没检查出来。

九 | 大力推进住房制度改革,在全国率先推行住房公积金制度,提出改造上海旧城区、棚户区的整体构想,为住房商品化改革和强化住房保障工作提供了重要经验。狠抓“菜篮子工程”,实行产供销“一条龙”改革,推动上海初步形成现代化的副食品生产、购销系统。提升城市管理水平,提高政府办事效率,优化投资环境,树立上海国际化城市形象。贯彻落实党中央关于开发开放浦东的重大战略决策,研究出台一系列既体现浦东特点又具有可操作性的政策措施,推动浦东开发开放进入实质性启动阶段。通过积极推动改革开放,着力改善民生,稳定和发展经济,在较短时间内使全市经济社会面貌发生重大变化,为上海进一步改革开放和发展打下坚实基础。”                         “我当时就是时间分配不合理,最后一道物理大题的完整思路明明都在草稿纸上,却没来得及誊上答卷!”                         再来一次,就凭着这些细微末节的调整,提升几十分,并非不可能。                   短短一天,你那经过十二年寒窗苦读才构建的知识储备,并没有发生任何质变。这就像今天的大语言模型(LLM),它的核心知识在训练完成的那一刻就被“冻结”了,形成了一个庞大但静态的知识库。  1991年4月,朱镕基同志任国务院副总理,后兼任国务院生产办公室主任、党组书记,国务院经济贸易办公室主任、党组书记,分管机电能源、铁道交通、冶金化工、轻工纺织等工作。

十 |                    那么,分数提升的奥秘究竟在哪?                    答案,正是我们理解AI Agent的核心所在:Agent的强大,并非源于模型智力的再次飞跃,而是源于我们为其赋予的“认知流程”的巨大提升。1992年10月,朱镕基同志在中共十四届一中全会上当选为中央政治局委员、常委,负责国务院常务工作。

十一 | 1993年6月,兼任中国人民银行行长。他积极宣传贯彻邓小平同志南方谈话精神,贯彻落实党的十四大精神,着力推动改革开放和现代化建设。                   这套“流程”,就如同你在考场上学会的“先易后难”的时间分配策略、交卷前雷打不动的“检查”习惯、以及解不出难题时果断“换个思路”的变通能力。坚决贯彻执行中央经济工作指导思想和方针政策,正确处理改革发展稳定的关系,着力提高经济增长质量和效益,克服盲目铺摊子、片面追求产值和速度的倾向。                   而要理解这套流程是如何在AI身上一步步建立起来的,我们不妨从学霸“小明”的成长史说起。                   二、一个比喻讲清Agent核心:学霸的五个成长阶段                    小明的成长,就是一部不断优化“解题流程”的进化史。                   阶段一:原生天才                    小明天赋异禀,脑子转得飞快。针对一度出现的投资规模增加过快、工业生产增速过快以及开发区热、房地产热、股票热等问题,研究制定关于加强和改善宏观调控的思路举措,更多运用经济、法律手段调控经济运行,为扭转经济过热、抑制通货膨胀、实现“软着陆”做了大量卓有成效的工作。做数学题时,他极度自信,全程心算。组织开展“三角债”清理,立足治本清源,采取限产压库、“压贷双挂钩”等措施,基本遏制住了前清后欠势头,增强了企业经营活力。着力整顿财税秩序,严肃财经纪律,强化税收征管,加快财税改革,严控税收减免和财政支出,严格执行财政预算,开展增产节约、增收节支工作。考试时,他总是第一个把卷子“啪”地一声拍在讲台上,一脸轻松地走出教室。完善金融调控体系,推动从运用贷款规模的直接调控向运用利率、公开市场和存款准备金的间接调控转变,实现人民币经常项目可兑换,实行以市场供求为基础的、单一的、有管理的浮动汇率制度,加强证券期货市场监管,规范金融秩序。至于分数?别问,问就是“快不快吧!”。他确实把卷子做完了,但卷面之下,究竟有多少是因为跳步导致的计算失误,有多少是审题不清造成的方向性错误,他自己都不知道。

十二 | 推动粮食价格和购销体制改革,建立适应社会主义市场经济要求、购销方便、调度灵活的粮食购销体制,缩小工农业产品价格剪刀差,保护农民种粮积极性,稳定粮食生产和供应。                   这完美对应了我们最开始使用大语言模型(LLM)的方式:基础API调用。我们把问题丢给它,它一次性地、黑盒般地生成一个答案。改革农业生产资料流通体制,稳定化肥等农资价格水平,充分发挥供销社主渠道作用,搞好农村市场供应。

十三 | 在农民自愿的基础上实行种粮大户承包、发展适度规模经营,大力发展社会化农业生产服务体系,给种粮大户以更多支持。  1997年9月,朱镕基同志在中共十五届一中全会上再次当选为中央政治局委员、常委。这个答案看起来很完整,甚至文采飞扬,但它究竟是如何得出的?其中有没有事实性错误?我们一无所知。1998年3月,在九届全国人大一次会议上,他被任命为国务院总理,后担任国务院党组书记。

十四 | 这个阶段的AI,就像只追求速度的小明,交付了一个结果,却无法保证这个结果的可靠性。

十五 | 面对亚洲金融危机冲击和国内特大洪涝灾害,他按照党中央决策部署,正确把握宏观调控的方向和力度,从实行适度从紧的财政政策、货币政策转向实行积极的财政政策和稳健的货币政策,着力扩大国内需求,抑制通货紧缩趋势,深化重点领域改革,保持了经济稳定、快速增长,维护了社会大局稳定,人民生活明显改善,我国国际地位不断提升。                   阶段二:思考者                    在几次因粗心丢分后,老师下达了硬性要求:所有题目,必须在草稿纸上写下详细的解题步骤。小明虽不情愿,但照做之后发现,正确率真的大幅提升了。把思考过程“外化”在纸上,让他能轻易发现逻辑链条中的微小瑕疵。

十六 | 全面调整产业结构、地区结构和城乡结构,加强基础设施建设,大力发展高新技术产业特别是信息产业,改造和提升传统工业,积极支持现代服务业加快发展,强化产品质量管理,着力提高经济增长质量和效益。把解决“三农”问题放在突出位置,因地制宜推进农业结构调整,加大大江大河大湖治理、农村电网改造、国家储备粮库建设等投入,加强农村扶贫开发,实施农村“费改税”和乡镇机构、县乡财政体制等改革,保障农民减负增收,促进城乡协调发展。                   核心概念:思维链(Chain of Thought,CoT)                    CoT是第一个、也是最基础的结构化思考流程。它的核心作用在于,强制模型将一个复杂的、需要一步到位的“猜测式”任务,分解成了一系列简单的、线性的“推理式”子任务。采取一系列扩大对外开放、鼓励出口的政策措施,坚持人民币不贬值,实施市场多元化战略和以质取胜战略,加大打击走私力度,积极吸引外资,参与国际经济技术合作和竞争,更好地利用国内国际两个市场、两种资源。坚决支持香港特别行政区政府维护联系汇率制度,巩固国际金融中心地位,稳定各界信心,使香港经济迅速恢复,经受住了严峻考验。

十七 | 坚持走可持续发展道路,加大生态环境保护和建设力度,在长江流域通过平垸行洪、移民建镇等举措实施大规模退田还湖,强化对土地、矿产、淡水、海洋和生物等资源的管理,集中力量对重点流域、区域等污染进行治理,加强环境基础设施建设,促进经济发展与人口、资源、环境相协调。它如同一个缰绳,拉住了试图“跳步”的思维野马,强迫它把注意力集中在当前这一步,利用上一步的结论,推导出下一步的结果,从而极大地降低了模型产生幻觉的概率。                   Wei, J., Wang, X., Schuurmans, D., Bosma, M., Chi, E., Le, Q., & Zhou, D. (2022). Chain-of-Thought Prompting Elicits Reasoning in Large Language Models.                    阶段三:细心人                    小明又进步了。他不仅会打草稿,还学会了一个新技能。当他提前答完所有题目,抬头一看,发现离考试结束还有十分钟,他会启动一个全新的“心智模式”:交卷前检查。

十八 | 此刻,他不再是“答题者”,而是一个苛刻的“检查者”,用批判性的眼光审视自己的答案,主动寻找可能的错误并加以修正。                   核心概念:自我反思(Self-Reflection)                    Reflexion框架的本质,是为Agent引入了一套“先行动、再复盘、后修正”的自我迭代流程。

十九 | 始终高度关心人民群众切身利益,持续改进公共服务,提高人民健康水平,增加城乡居民收入,下大力气解决拖欠职工工资、下岗职工再就业等问题,加强社会治安综合治理,建立安全生产责任制。深入转变政府职能,推进政府机构改革,实施较大力度的国务院机构改革方案,进一步把综合经济部门改组为宏观调控部门,调整和减少专业经济部门,强化市场执法监管部门职能,改变了长期以来在计划经济体制下形成的政府机构框架。

| 着力加强政府自身建设,不断提高依法行政水平,转变工作方式和工作作风,增强政府工作透明度。  担任国务院总理后,朱镕基同志还先后兼任中央专委会主任、国家经济体制改革委员会主任、国家科技教育领导小组组长、国务院三峡工程建设委员会主任、国家国防动员委员会主任、国务院西部地区开发领导小组组长等,在经济体制改革、科技、教育、西部大开发、国防工业等领域倾注了大量心血。它让Agent在完成一次任务后,先不急着输出最终结果,而是生成一段对刚才执行过程的“复盘笔记”。他坚持实施科教兴国、人才强国战略,加大科技、教育投入,完善国家科技评价体系和奖励制度,初步建立起科技成果转化和产业化的有效机制,优化人才培养、引进、使用的制度措施,不断提高科技创新能力和国民素质。推动实施西部大开发战略,积极发展特色经济和优势产业,加强东、中、西部地区的经济交流合作,先后组织实施西电东送、青藏铁路、西气东输等一批重大工程项目,有力促进西部地区经济发展和社会进步。  朱镕基同志担任国务院副总理和国务院总理期间,我国正处于从计划经济体制向社会主义市场经济体制转变的关键时期。在下一次尝试时,这段“错题本”一样的信息会作为重要参考,被一同放进上下文中,引导Agent避免重蹈覆辙。

|                    关键数据证明:通过这套迭代流程,Reflexion在HumanEval代码生成任务上取得了91%的准确率,超越了当时GPT-4的80%记录,无可辩驳地证明了“流程”优化的巨大杠杆效应。在以江泽民同志为核心的党中央坚强领导下,他组织实施一系列重大改革,推动建立起社会主义市场经济体制基本框架。主持财税体制改革,全面实施以公平税负和简化税制为核心的重大税制改革,实行合理划分中央与地方事权基础上的分税制财政体制,建立中央税收和地方税收体系,推行以增值税为主、营业税和消费税为辅的流转税制度,对所得税进行归并整合,有效增强政府宏观调控能力和提供基本公共服务能力。                   Shinn,N.,Cassano,F.,Gopinath,A.,Narasimhan,K.,& Yao,S. (2023). Reflexion: Language Agents with Verbal Reinforcement Learning.                    阶段四:战略家                    随着考试难度的提升,小明意识到,光有解题能力和细心还不够。积极推进金融体制改革,进一步规范中央银行职能,加强金融监管,推动国家专业银行向商业银行转变,建立政策性银行,在有条件的大中城市组建城市合作银行,推动建立全国统一开放、有序竞争、严格管理的金融市场体系。

| 他开始在拿到试卷的第一分钟,不再埋头做题,而是快速通览全局,在脑中形成一个作战计划:哪些题是送分题要先拿稳,哪些题是硬骨头要放到最后,并为每个部分预估时间。在答题过程中,如果发现某道题耗时超预期,他还会动态调整这个计划。把国有企业改革作为经济体制改革的中心环节,按照“产权清晰、权责明确、政企分开、管理科学”的要求,加快现代企业制度建设,从战略上调整国有经济布局和改组国有企业,通过实施债转股等措施减轻企业负担和历史包袱,提高企业现代化管理水平,基本实现国企三年改革和脱困目标,使国有经济在国民经济中更好发挥主导作用。

|                    核心概念:规划(Planning)                    这是更高阶的宏观流程设计。在处理一个复杂任务时,具备规划能力的Agent不再是走一步看一步,而是会先将宏大目标分解成一系列逻辑清晰的子任务,形成一个计划清单。这个清单就是它行动的蓝图,确保了它的每一步都是在为最终目标服务,极大地提升了执行效率和确定性。推动确立统一、规范、完善的社会保障体系框架,逐步建立国有企业下岗职工基本生活保障、失业保险和城镇居民最低生活保障的“三条保障线”制度,要求不折不扣确保国有企业下岗职工基本生活费按时足额发放、确保企业离退休人员基本养老金按时足额发放,千方百计促进下岗失业人员再就业,深化城镇职工基本养老、基本医疗保险制度、医疗卫生体制改革,为维护社会稳定、促进经济发展提供有力支撑。扎实推进住房制度改革,逐步实行住房分配货币化,建立和完善多层次城镇住房供应体系,加快解决城镇住房困难居民的住房问题。这是大多数高级Agent框架的核心组件。                   阶段五:学者                    后来,小明进入了大学,开始做真正的研究。持续深化粮食流通体制改革,推行按保护价敞开收购农民余粮、国有粮食购销企业顺价销售、粮食收购资金实行封闭运行,逐步放开主销区粮食收购市场和价格。主持完成我国加入世界贸易组织的艰苦谈判,促进对外开放向广度和深度拓展,为我国赢得更广阔的发展空间,对推进经济体制改革和现代化建设产生深刻影响。他的任务不再是解答有标准答案的考题,而是去探索一个开放性的前沿课题,比如“分析近年国内新能源汽车市场的渗透率变化趋势”。  朱镕基同志对人民群众饱含深情,时刻把群众疾苦放在心上,强调政府工作人员要牢记自己是人民的公仆,不能搞特殊化,对国内考察、精简会议、参加事务性活动提出“约法三章”。他求真务实,开拓进取,敢于说真话,不怕得罪人,以强烈的责任担当主动挑重担子、啃硬骨头,全力推进为人民群众谋利益、办实事。他注重调查研究,善于倾听群众呼声,调动和发挥各方面积极性,多次亲临一线调度指挥抗洪救灾工作,强调要把保障人民群众生命安全放在第一位,尽最大努力减少损失。                   面对这个课题,他脑中的课本知识(模型的静态权重)显然已经过时。他将著书所得全部捐助用于扶贫济困、助学育人,向农村义务教育学校学生、特困学生等提供资助。

| 于是,他启动了一套全新的工作模式,这正是Agent最强大的工具使用(Tool Use)能力的完美体现。  2003年3月,朱镕基同志不再担任国务院总理职务。从领导岗位上退下来以后,他坚决拥护和支持以胡锦涛同志为总书记的党中央,党的十八大以来,他坚决拥护和支持以习近平同志为核心的党中央,一直关心中国特色社会主义伟大事业,坚定支持党风廉政建设和反腐败斗争。而其核心,并非工具本身,而是《ReAct》框架所揭示的那套将思考与行动深度绑定的、里程碑式的工作流程:思考 -> 行动 -> 观察。                   首先,他思考(Thought):“我的知识库里只有几年前的旧数据,无法直接回答这个问题。  朱镕基同志是中共第十三届中央候补委员,第十四届、十五届中央委员、中央政治局委员、常委。我必须获取最新的行业报告和数据。  在70多年的革命生涯中,朱镕基同志始终忠于党、忠于人民、忠于共产主义事业。”                    这个思考驱动了他采取行动(Act)。他没有凭空猜测,而是选择了一个工具——走向图书馆,打开知网和行业数据库,输入关键词进行检索。他具有坚定的共产主义理想信念和坚强党性,讲政治、顾大局,始终把党和人民的利益放在首位,为党和人民事业兢兢业业、不懈奋斗。这对应Agent调用`search_api("中国新能源汽车2023-2025市场渗透率报告")`。他认真学习马克思列宁主义、毛泽东思想、邓小平理论、“三个代表”重要思想、科学发展观,深入学习贯彻习近平新时代中国特色社会主义思想,坚决贯彻执行党的路线方针政策,坚定不移在思想上政治上行动上同党中央保持高度一致。                   紧接着,他观察(Observe) 到了行动的结果:几篇最新的报告和数据图表出现在屏幕上。党的十八大以来,他牢固树立政治意识、大局意识、核心意识、看齐意识,坚决维护习近平总书记党中央的核心、全党的核心地位,坚决维护党中央权威和集中统一领导。他坚持实事求是、一切从实际出发,创造性地运用马克思主义的立场观点方法分析问题、解决问题、指导实践、推动工作。他坚持真理、坚持原则,具有很强的政治敏锐性和政治鉴别力,在大是大非问题上旗帜鲜明,切实做到对党忠诚、为党分忧、为党尽职、为民造福。这是他之前完全不知道的、来自外部世界的新信息,是客观事实。

| 他勤于修身、严于律己,清正廉洁、光明磊落,对家属和身边工作人员严格要求,坚决反对腐败行为和不正之风,始终保持共产党人的政治本色。他尊重知识、尊重人才,关心同志、爱护干部,深受广大干部群众的尊敬和爱戴。

|                    最后,他带着观察到的新知,回到 再次思考(Thought)的环节:“原来最新的数据是XX%,主要增长动力来自二线城市,并且某项技术革新是关键变量。  朱镕基同志的一生,是革命的一生、战斗的一生、光辉的一生,是全心全意为人民服务、献身于共产主义事业的一生。

| 现在,我可以基于这些事实进行分析和论证了。他的逝世,是党和国家的重大损失。”                    这个循环,将AI从一个封闭的“大脑”,变成了一个能与现实世界持续互动的“行动者”。它通过工具打破了自身知识的局限,用真实、即时的信息来校准和迭代自己的思考,从而将成果的质量和可靠性提升到了一个全新的高度。                   至此,小明的进化之路走到了终点。我们要化悲痛为力量,学习他的革命精神、崇高品德和优良作风,更加紧密地团结在以习近平同志为核心的党中央周围,高举中国特色社会主义伟大旗帜,全面贯彻习近平新时代中国特色社会主义思想,深刻领悟“两个确立”的决定性意义,增强“四个意识”、坚定“四个自信”、做到“两个维护”,坚定信心、同心同德,为以中国式现代化全面推进强国建设、民族复兴伟业而团结奋斗。  朱镕基同志永垂不朽!。他从一个只靠天赋的“原生天才”,最终成长为一位懂得规划、反思、并善用工具解决复杂问题的学者。而他一路习得的这些能力——打草稿(思维链)、复盘检查(自我反思)、谋篇布局(规划)、查阅资料(工具使用)——正是构成一个强大AI Agent的核心组件。                   这,就是从Chatbot到Agent的完整进化路径。                   核心概念:工具使用(Tool Use)与 ReAct 框架                    ReAct框架的伟大之处,不在于工具本身,而在于它定义了一套将“思考”和“行动”深度绑定的交互式工作流程:思考 -> 行动 -> 观察。                   这个循环,将AI从一个封闭的“大脑”,变成了一个能与现实世界持续互动的“行动者”。它通过工具打破了自身知识的局限,用真实、即时的信息来校准和迭代自己的思考,从而将成果的质量和可靠性提升到了一个全新的高度。                   Yao, S., Zhao, J., Yu, D., Du, N., Shafran, I., Narasimhan, K., & Cao, Y. (2022). ReAct: Synergizing Reasoning and Acting in Language Models.                    三、从“优雅的独白”到“可靠的行动”                    说完了小明的进化史,我们回到那个被各家 Agent 用烂了的旅行规划例子,用刚刚建立的视角,重新审视一下,Agent 究竟强在哪。                   “帮我规划一个北京周末三人游,要求包含故宫和一个适合孩子的科技馆,并给出预估的总预算。”                    (是的,我知道,又是这个烂大街的旅行规划例子。我们在此也无法免俗地用它来“公开处刑”,因为它实在太经典、太能说明问题了。

| )                    Chatbot的答卷:一个“博学但健忘”的秘书                    你向ChatGPT提出这个问题。就像最开始的那个小明,不带任何犹豫,它“噼里啪啦”就为你生成了一篇堪称完美的攻略:                              攻略格式工整、文采飞扬、语气贴心,甚至还带上了emoji。

| 它看起来就像任何一篇你在小红书上能刷到的旅行攻略。                   然而,如果我们仔细检查这份“攻略”,就会发现它华而不实,漏洞百出:                    1. 信息过时(幻觉):它引用的故宫门票信息,可能来自其训练数据中的某个陈旧网页。它根本不知道,在旅游旺季的当下,故宫早就换了预约方式。

|                    2. 信息虚构(幻觉):它提到的“北京儿童科技探索馆”听起来很不错,但如果你真的去搜索,会发现这个地方根本不存在。

| 这是模型基于“北京”、“儿童”、“科技馆”等关键词,在统计概率上“创造”出的一个最像答案的组合。

|                    3. 缺乏可执行性:那个“1500元”的预算,只是一个模糊的概数,你无法信任它,更无法基于它做出任何决策。                   这就是Chatbot的本质:一次“优雅的文本统计模仿”。因为它执行的是一个静态的、一次性的生成流程,它没有机制去验证、去反思、去与现实交互。                   AI Agent的答卷:一个“有点刻板但极其可靠”的行动派                    现在,我们把同样的任务交给一个AI Agent。你不会立刻得到一份混杂着emoji的攻略。相反,如果你能打开它的详细执行过程,你会看到一场动态的、目标导向的行动正在上演。                   它会像一个真正的项目经理那样,直播它的“内心独白”与“行动”:                              这个 `Think -> Act -> Observe` 的循环会不断持续,直到它完成计划中的所有步骤。最终,它呈现给你的报告可能不那么“文采飞扬”,但却百分之百基于事实、完全可用:                              这时候再回看,Chatbot与Agent的天壤之别已无需多言。                   前者看起来很美,但你永远不敢用它上考场,因为它只是在复刻答案;后者过程虽然笨拙缓慢,但真的能做出成果,因为它是在执行一个发现答案的流程。

|                    四、Agent的核心驱动:以“流程”驾驭模型之力                    很多人初次接触Agent,打开它的运行日志时,会产生一种反直觉的困惑:                    “怎么感觉它这么‘慢’,这么‘笨拙’?查个东西来来回回好几轮,远不如我直接问ChatGPT一秒出答案来得‘聪明’啊!”                    这种“慢”,恰恰是通往Agent强大能力的第一扇门。它揭示了一个深刻的转变:我们正在从追求大语言模型(LLM)那种一次性的、直觉式的 “快思考”,转向设计一种结构化的、可验证的 “慢思考”。                   而这套“慢思考”的核心,就是我们为AI设计的流程(Process)。                   Agent的核心驱动力,并非源于模型自身的又一次智力爆炸,而是源于我们为它设计的这套工作流程。开发者所做的一切,本质上都是在用“更多的计算步骤”和“更长的思考时间”,去交换一个在真实商业世界里至关重要的东西——结果的“高质量”与“确定性”。                   这套流程,究竟为Agent带来了什么?                    第一重价值:用“结构”对抗“混沌”——为思考建立脚手架                    首先,我们必须承认,LLM原生的思考方式是“发散的”、“扁平的”。它就像一个知识渊博但思维跳跃的天才,在面对一个真正复杂的任务时,它的长链条推理非常脆弱,很容易在中间某个环节“跑偏”,或者干脆“忘记”了最初的目标。                   而我们设计的规划(Planning)、思维链(CoT)、甚至更复杂的树状思维(Tree of Thoughts)等流程,其本质,就是在为AI混乱的思考过程,强行建立一套“逻辑脚手架”。

|                    规划(Planning) 流程,如同建筑师手中的总设计蓝图。它在任务开始时,就将一个宏大到无法一次性思考的目标(“建一栋摩天大楼”),分解为一系列清晰、有序、可执行的步骤(“第一步:打地基;第二步:建主体;第三步:封顶……”)。它确保了AI的每一步行动都服务于最终目标,这是在“宏观”层面,用结构对抗混沌。                        思维链(CoT),则更像是现场工人的施工手册。

| 它保证了每一步内部的逻辑是严谨的(“钢筋要这么绑,混凝土必须是C50标号”)。它强制AI的推理过程必须环环相扣、步步为营,这是在“微观”层面,用结构对抗混沌。

|                         这套“脚手架”的存在,确保了AI在处理复杂问题时,不会因为思维的发散而半途坍塌。它极大地提升了AI解决复杂问题的能力上限。                   第二重价值:用“迭代”对抗“遗忘”——为记忆打造压缩算法                    LLM最致命的短板,莫过于它有限的“注意力”,也就是我们常说的上下文窗口(Context Window)。

| 它就像一条记忆只有7秒的鱼,既无法一次性处理海量的信息,也记不住漫长的历史教训。                   而我们设计的反思(Reflection)、总结(Summarization)等流程,本质上是在为AI的记忆,量身打造了一套“高效的压缩算法”。

|                    让我们回到那个旅行规划的例子。当Agent通过工具查询后,得知“故宫门票售罄”时,`Reflexion`流程被触发了。它做了什么?                    它并没有把官网返回的所有HTML代码、弹窗提示等冗长的、原始的信息,全都塞进自己本就宝贵的“记忆”里。如果是那样,它的上下文窗口很快就会被垃圾信息撑爆。

|                    相反,这个流程启动了一次 “记忆压缩”。

| 它将这次失败的交互过程,提炼成了一句高信息密度的结论,并将其作为一条“经验”存入记忆:                    “经验:故宫门票需提前一周预订,本周不可行。”                    这个过程,是一次有损但极其有效的压缩。它丢弃了99%的无关细节,却用极小的上下文空间,保留了对未来决策100%关键的信息。正是这个小小的“经验便签”,让AI在后续的规划中,能够“吃一堑,长一智”,实现真正的学习与迭代。                   这套“压缩算法”,让AI拥有了动态演化的“长期记忆”,使其能够在有限的注意力范围内,处理更长的时间线,完成更复杂的任务。                   第三重价值:用“交互”对抗“虚无”——为模型连接现实世界                    一个流程,无论内部设计得多么精妙,如果它与现实世界完全隔离,那它就是在“空转”。它所有的输出,都可能只是建立在模型内部“幻觉”之上的、逻辑完美的空中楼阁。                   因此,流程必须拥有与世界交互的能力。在这里,我们才需要顺理成章地引入工具(Tool)。                   工具不是一个与流程并列的概念。

| 它更像是流程这条“中枢神经”末端的“神经触手”。                   `ReAct`框架之所以伟大,就在于它并非一个工具框架,而是一个将“思考”与“行动(调用工具)”深度绑定的流程。在这个流程的驱动下,AI在思考过程中如果意识到“我的内部知识不足以支撑下一步决策”,它就会主动伸出`search_api()`这个“触手”,去真实地“触碰”一下互联网,然后把感知到的“温度”(也就是客观事实)传回大脑,再继续下一步的思考。                        这个机制,确保了我们“用时间换质量”的策略,最终能够换回“真实的质量”,而非“高质量的幻觉”。工具,作为流程的延伸,拓宽了AI能够发挥作用的能力边界。                   结论:重新定义上下文(Context)                    至此,我们再回看“上下文工程”这个时髦的词,就会有全新的理解。                   上下文不是需要我们去“填充”的目标,而是我们设计的卓越流程所“产出”的结果。面对LLM有限的注意力窗口这一核心枷锁,一个好的流程,天然就是一位“上下文架构师”。它通过两大核心机制来对抗遗忘和混乱:                    1. 高效的信息压缩:如`Reflexion`流程,它不会把冗长的失败日志直接塞入记忆,而是将其提炼成一句高信息密度的“经验教训”(例如:“经验:故宫门票需提前一周预订”)。这是一种有损但高效的压缩,用极低的Token成本保留了最关键的决策信息。                   2. 精准的选择性注入:流程在每一个`Think`环节之前,会像一位顶级外科手术的器械护士,精准地判断“此时此刻,LLM这个‘主刀医生’最需要哪一条历史经验?最需要哪一个工具的观察结果?”然后,它会将这些信息组合成一个干净、高效的“数据包”,递给LLM进行处理。

|                    因此,我们工作的重心,不是去“堆砌”一个越来越长的上下文,而是去设计一个能够动态构建、剪裁和管理上下文的智能流程。                   我们作为开发者,正在完成一次深刻的角色转变。我们的核心工作,不再是“提示词工程师”,而是“Agent 流程架构师”。我们的核心价值,体现在我们为AI设计的思考结构、记忆机制和世界交互的范式上。                   当你不再纠结于如何写出一个能让AI惊艳四座的提示词(Prompt),而是开始为它设计一套能够自我规划、自我纠错、自我迭代的工作流时,你才真正推开了Agent时代的大门。                   五、回归本质:Agent为何有效?                    我们已经从实践的层面,解释了Agent是什么,以及它是如何工作的。

| 但这留下了一个核心问题:为什么“思考 -> 行动 -> 观察”这个循环,从根本上就是有效的?                    要回答这个问题,我们需要暂时跳出AI的范畴。其科学基础,建立在两个经典的理论之上:                    控制论(Cybernetics):它解释了系统如何通过反馈来达成目标,体现了 Agent “逼近”解决方案的过程。                        信息论(Information Theory):它解释了信息与不确定性的关系,体现了 Agent “探索”问题空间的过程。                        控制论视角:从开环到闭环的进化                    为了理解Agent的有效性,我们首先要区分两种根本不同的系统:开环系统(Open-loop System)与闭环系统(Closed-loop System)。                             一个典型的开环系统,是那种只带定时器的老式暖气。你设定它“运行一小时”,期望它能让房间变得温暖。但它没有感知“当前室温”的能力。

| 因此,它的行为是盲目的:                    如果今天恰好有太阳,一小时后房间会闷热难耐。                        如果恰逢寒流来袭,一小时后房间可能依然冰冷。                        开环系统的根本缺陷在于缺乏反馈。它只能单向地执行指令,而对执行的结果一无所知,因此无法根据实际情况进行自我调整。

| 这正是标准Chatbot的工作模式——它接收指令并一次性生成结果,却无法验证这个结果是否真正解决了问题。

|                    而一个闭环系统则通过引入反馈机制,解决了这个问题。

| 让我们来看一个经典的闭环系统范例——冰箱。                   冰箱的核心任务是“维持冷藏室恒定在5°C”。它不依赖“猜测”或固定的时间表,而是运用了一套可靠的反馈机制,这正是控制论思想的体现:                    1. 目标(Set Point):用户设定的“5°C”。                   2. 传感器(Sensor):内部的温度计,它持续观察(Observe)当前的实际温度。                   3. 控制器(Controller):温控芯片,它思考(Think)的唯一问题就是“当前温度和目标温度之间是否存在偏差?”                    4. 执行器(Actuator):压缩机。

| 一旦控制器发现偏差(比如温度上升到6°C),就会命令压缩机行动 (Act)。

|                    5. 反馈闭环(Feedback Loop):压缩机工作导致温度下降,传感器将新温度反馈给控制器,控制器发现偏差消失(回到5°C),于是命令执行器停止。                   现在,我们可以清晰地看到,Agent的工作流程与这个闭环系统一一对应。它本质上就是一个软件形式的闭环控制系统:                    目标(Set Point):用户的指令                         传感器(Sensor):`Observe` 环节,获取工具返回的结果                         控制器(Controller):`Think` 环节,LLM进行推理和规划                         执行器(Actuator):`Act` 环节,调用工具                         反馈闭环(Feedback Loop):将`Observe`的结果,作为输入传给下一轮`Think`                         `Observe` 环节,正是这个系统的“传感器”。它的存在,是Agent实现从开环到闭环进化的关键。它赋予了Agent感知“行动结果”的能力,从而能够像冰箱一样,在动态变化的环境中,通过不断的“行动-观察-修正”循环,持续地、稳定地逼近并最终达成目标。                   信息论视角:在“战争迷雾”中进行熵减                    如果说控制论解释了Agent如何“逼近”一个目标,那么信息论则揭示了它在探索未知问题时究竟在“做什么”。                   这里,我们需要理解一个核心概念:熵(Entropy)。信息论将熵定义为对不确定性的度量。

| 一个系统的信息量越大,其不确定性就越小,熵值也就越低。所有解决问题的过程,本质上都可以视为一个通过获取信息来降低不确定性(即“熵减”)的过程。                   这个概念听起来可能有些抽象,但我们可以通过一个非常直观的例子来理解它——在《星际争霸》或《王者荣耀》这类游戏中驱散“战争迷雾”。

|                    游戏开局时,除了基地周围的狭小视野,整个地图都处于未知状态。这在信息论中被称为 “高熵”状态——系统充满了极高的不确定性。

| 你的任务(摧毁敌方基地)是明确的,但通往任务的路径是完全未知的。                   你的每一个动作,都是一个信息探索的过程:                    你派出一个侦察单位(Act)进入黑暗区域。                        这个单位的视野点亮了地图的一部分,让你看到了地形、资源或敌方踪迹(Observe)。                        这个“观察”的结果,就是信息。它让你对这片区域的认知,从“完全不确定”变成了“确定”。                        这个“用信息消除不确定性”的过程,就是“熵减”。信息论的奠基人克劳德·香农(Claude Shannon)为“信息熵”给出了数学定义:                              这个公式的数学细节无需深究,但其核心思想至关重要:一个系统的可能性越多、越平均,其不确定性(熵)就越高。而获取信息的价值,就在于它可以排除掉一些可能性,从而降低系统的总熵。                   Agent的工作,正是在一个抽象的“问题空间”中,进行着一场严谨的熵减行动。它的每一次 `Act-Observe` 循环,都是一次科学实验,目的就是为了获取能最大程度降低问题不确定性的信息。

| 当不确定性被完全消除,通往答案的唯一路径也就清晰地浮现出来。                   综上所述,Agent的有效性并非偶然。

| 控制论为它提供了目标导向的纠错能力,确保它在复杂的执行路径中“不跑偏”;而信息论则定义了它探索未知空间的核心任务——通过行动获取信息,系统性地消除不确定性。                   这两个理论共同为Agent框架的可靠性与有效性,提供了坚实的科学基石。

|                    六、你的新角色:从“提示词工程师”到“Agent流程架构师”                    至此,我们从一个“高考重考”的遗憾出发,跟随“学霸小明”的脚步,见证了解题流程的步步演进;在“旅行规划”的强烈对比中,我们亲身体会了动态流程与静态生成的本质区别;我们深入解构了流程作为核心驱动力的三重价值——以结构对抗混沌,以迭代对抗遗忘,以交互对抗虚无;最后,我们从控制论和信息论的视角,找到了这套流程有效性的科学基石。                   结论,已不言自明——LLM 应用的未来,其竞争力的核心,已不再是模型本身的参数大小或某个提示词的精巧,而是我们围绕模型所设计的那套智能流程的优劣。                   这不仅仅是认知上的转变,更是一次深刻的职业角色进化。                   定义你的新角色:Agent流程架构师                    “提示词工程师(Prompt Engineer)”这个短暂的、在LLM蛮荒时代应运而生的角色,正迅速成为历史。当行业跨越了“与AI巧妙对话”的浅滩,我们开发者真正的战场早已转移。

| 我们的工作,不再是“对话者”,而是“系统设计者”。                   欢迎来到你的新角色:Agent 流程架构师(Intelligent Process Architect)。                   这个角色的核心职责,不再是雕琢语言,而是构建系统。具体来说,包含三大核心:                    1. 设计AI的思考流程(Cognitive Workflow):你将定义AI如何进行规划、拆解、推理与反思。你设计的不是一个提示词,而是AI的“心智内核”与“行事准则”。                   2. 赋能AI的行动工具(Toolbox):你将为AI锻造与物理世界和数字世界交互的“双手双脚”。你需要敏锐地识别流程中的信息瓶颈,并创造或接入合适的工具,让AI的能力边界得以延伸。                   3. 构建AI的决策上下文(Context Architecture):你不再是上下文的“搬运工”,而是“建筑师”。优秀的流程天然就是上下文管理的大师。你将通过精妙的流程设计,确保在每一个决策瞬间,AI的“注意力”不多不少,恰好聚焦在最有价值的信息上。                   踏入Agent时代的门槛:从实现“心跳”到构建“大脑”                    我们正在迈向一个激动人心的未来:我们创造的,将不再是“回答问题的机器”,而是“解决问题的伙伴”。                   但在此之前,我们必须建立一个至关重要的认知:今天我们所熟知的 `Think -Act -Observe` 循环,并非 Agent 设计的终点。它更像是 Agent 的“心跳”——那个维持智能体与世界进行交互的、最基础、最核心的原子节律(Agentic Loop)。                   我们作为架构师的核心工作,不是去替换这个心跳,而是要为这个心跳设计一个强大的“大脑”与“神经系统”。

| 然而,这套强大的“慢思考”流程在提升结果质量的同时,也带来了新的、不可回避的工程挑战——执行效率。                   我们如何化解这种“慢”带来的延迟,让Agent在追求高质量的同时,也能拥有高性能?这正是“Agent 流程架构师”必须面对的第一个现实课题:Agent的性能工程。

| 前沿的工程实践正从以下几个关键层面寻求突破:                    架构选型与剪枝(Architectural Pruning): 并非所有任务都需要复杂的 `ReAct` 循环。业界发现,对于能通过一两步直接解决问题的场景,使用LLM内置的工具调用(Tool-Calling)范式会更高效。

| 这类Agent省去了显式的“思考”文本生成环节,直接输出结构化的函数调用指令,显著降低了token消耗和端到端延迟,是架构师在设计流程时进行的第一层性能优化。                        并行化执行(Parallel Execution):这是最显著的提速手段。

| 当Agent的规划结果中包含多个没有依赖关系的子任务时(例如,“查询北京的天气”和“搜索热门饭店”),现代Agent框架如LangChain已经支持并行工具调用(Parallel Tool Calling)。它利用异步I/O (`asyncio`) 的能力,将原本需要串行等待的多个API请求并发出去,从而将总耗时从“所有任务耗时之和”缩短为“最长任务的耗时”,极大地提升了执行效率。                        模型特化与路由(Model Specialization & Routing):“一招鲜,吃遍天”的单一模型策略正在被淘汰。更优的实践是采用混合模型策略。例如,使用一个轻量、高速的模型(如gemini-2.5-flash, claude-haiku-4.5)来承担流程中“规划”、“路由”或简单工具选择等高频、低复杂度的任务,仅在遇到需要深度推理的复杂节点时,才调用重量级、高成本的核心模型(如gpt-5-pro, gemini-2.5-pro)。

| 这种分层策略能以更低的成本和延迟,完成大部分流程步骤。

|                         高效的记忆架构(Efficient Memory Architecture):Agent的性能瓶颈,往往出现在它与记忆的交互上。LLM有限的上下文窗口决定了我们不可能将所有历史信息塞入提示。因此,设计一个高效的 “记忆检索”机制至关重要。

| 这不仅仅是技术选型(如使用向量数据库),更是策略设计:如何将对话历史、过往的行动轨迹、成功的经验与失败的教训进行压缩、提炼并结构化存储。一个优秀的记忆架构,就像一位顶级图书管理员,能在Agent需要时,精准、快速地从海量信息中提取出“此时此刻最需要的那一条知识”,并以最低的Token成本注入上下文。这直接决定了Agent能否快速做出正确决策,避免在冗余信息中迷失方向,从而在根本上提升其运行效率与智能水平。

|                         当我们通过精良的工程实践,为Agent的“心跳”装上了“加速器”之后,我们才能真正着手去构建那个更宏观、更智能的“大脑”——一套能够驾驭这个心跳的认知架构(Cognitive Architecture)。                   满足于实现一个基础循环,就像满足于让一颗心脏跳动,却没给它构建一个能思考、能协作的躯体。真正的价值创造,发生在这些基础节律之上。

| 当前,业界最前沿的探索,正聚焦于以下几个方向:                    1. 认知调度中心:智能工作流编排(Intelligent Workflow Orchestration)一个成熟的 Agent,应当像一位经验丰富的项目经理,面对不同的任务,能自主地规划并编排最优的执行流程。这正是“动态流程编排”的核心思想,而 Anthropic 最新发布的 “Skills” 功能,是这一思想的最佳行业实践。

| 它允许开发者定义一套丰富的“技能”(即工具集),模型则能自主理解用户的宏观意图,并像一个指挥家一样,智能地选择、组合并依次调用多个“技能”以协作完成复杂目标。这代表着 Agent 的`思考`环节,已从“下一步做什么”的战术决策,进化为“如何分步达成最终目标”的战略规划。                   2. 从“单兵”到“团队”:规约驱动的分层架构(Spec-Driven)对于超越单体 Agent 能力的复杂任务,分层与分治是必然选择。

| 其关键在于如何保证团队高效、可靠地协作。

| 答案正在从“即兴的角色扮演”走向更严肃的工程范式——“规约驱动”。在这种架构下,一个“规划Agent”的首要任务是生成一份详尽、明确的技术规约(Specification),它如同工程蓝图,成为所有下游“执行Agent”工作的唯一契约。

| 这正是以 AI IDE Kiro、GitHub 开源的 SpecKit 等为代表的前沿项目所探索的核心思想,它标志着 Agent 协同正在进化为可追溯、可验证的“现代软件工程”。                   3. 从“使用工具”到“创造工具”:即时代码生成(On-the-fly Code Generation)传统工具使用是让 Agent 在固定的工具箱里做选择题。未来的方向是,让 Agent 自己创造工具。CodeAct (`CodeAct: A Multi-Turn Code Agent with In-Context Learning`) 等研究正在引领这一趋势。

| 当面对没有现成工具可用的问题时,这类 Agent 会动态地生成一段 Python 代码(一个微型工具),在隔离环境中执行它,并根据执行结果推进任务。这让 `Act` 环节从简单的“API调用”,进化为具备无限可能的“代码生成与执行”,从而实现了 Agent 能力边界的动态扩展。                   这些,才是“Agent 流程架构师”未来几年最激动人心的工作。我们不再是基础“心跳”的实现者,而是这些高级认知架构的“创造者”。

|                    所以,从今天起,忘掉提示词的奇技淫巧。去为你手头的任务,画出第一张流程图吧。这,就是成为一名Agent 流程架构师的开始。                   参考与延伸阅读资源库:          Part 1: 核心学术论文          1. 思维链 (Chain of Thought, CoT)          标题: Chain-of-Thought PromptingElicitsReasoning in Large Language Models          链接: `https://arxiv.org/abs/2201.11903`          简介: 首次系统性地证明,通过在提示中加入“思考过程”的范例,可以激发大语言模型解决复杂推理任务的能力,是结构化提示的奠基性工作。

|                    2. 思维树 (Tree of Thoughts, ToT)          标题: Tree of Thoughts:DeliberateProblem Solving with Large Language Models          链接: `https://arxiv.org/abs/2305.10601`          简介: 将线性的思维链扩展为树状的多路径探索。它允许 Agent 在一个思考节点上探索多个不同的推理路径,并使用自我评估来决定最优解,是更强大的结构化思考流程。                   3. Reflexion框架          标题: Reflexion: Language Agents withVerbalReinforcementLearning          链接: `https://arxiv.org/abs/2303.11366`          简介: 首次将“自我反思/复盘”这一概念框架化、自动化。

| 它证明了 Agent 可以通过对过往失败进行“语言反思”来迭代优化自身行为,而无需重新训练模型。                   4. ReAct框架          标题: ReAct:SynergizingReasoning and Acting in Language Models          链接: `https://arxiv.org/abs/2210.03629`          简介: 提出了里程碑式的 `Thought -> Act -> Observe` 框架,将“思考”(Reasoning)和“行动”(Acting)深度交织,是现代 Agent 框架与外部世界交互的理论基石。                   5. CodeAct 框架          标题: CodeAct: A Multi-Turn Code Agent with In-Context Learning          链接: `https://arxiv.org/abs/2402.01030`          简介: 雄辩地证明了 Agent 的 `Act` 环节可以从“调用预定义工具”进化到“即时生成代码并执行”,极大地扩展了 Agent 的能力边界。

|                    Part 2: 行业资料与实践资源                    1. 奠基性的综述:Lilian Weng的《LLM-poweredAutonomousAgents》          链接: `https://lilianweng.github.io/posts/2023-06-23-agent/`          简介: OpenAI 应用研究负责人撰写的、行业内引用最广泛的 Agent 综述文章,是建立该领域全局认知地图的第一站。                   2. 核心思想:“LLM操作系统” by Andrej Karpathy          简介: Andrej Karpathy (OpenAI创始成员) 在多个演讲中极具前瞻性地提出,LLM 是新型计算范式的“CPU”,而 Agent 框架则扮演了“操作系统(OS)”的角色。                   3. 主流开发框架:LangGraph & LlamaIndex          链接: `https://www.langchain.com/langgraph` 和 `https://www.llamaindex.ai/`          简介: 当下构建 Agent 应用的两大事实标准库。LangGraph 侧重于流程(Chain & Agent),LlamaIndex 侧重于数据(RAG),是开发者。

|

Current article:http://7u2.senchuoshaozaodidia.shop/list_znf6t/i6z8y.html

Published on:10:11:37