掌握LLM决策奥秘：5种Agent模式带你从小白进阶大模型收藏必看

程序员糖仔

424人浏览 · 2026-04-11 14:29:38

程序员糖仔 · 2026-04-11 14:29:38 发布

本文揭秘LLM如何通过Agent实现决策，核心在于五大模式：CoT思维链、ReAct循环、Reflexion自我反思、Planning任务分解及CodeAct动态编程。关键在于结构化输出与工具调用，而非模型本身能力。通过System Prompt约束与模型路由优化，可大幅提升效率与降低成本。Agent的闭环特性使其能动态调整策略，适应变化。掌握这些技巧，即使是小白也能轻松驾驭大模型。

◆ 核心问题

LLM 只是在预测下一个 token，为什么能“做决策”？它在 Agent 里的边界在哪？

用户给出一句复杂指令，Agent 自动拆解为“扫仓库→列影响面→拆任务→改代码→跑CI→提PR”的完整行为链。每一步都由 LLM 预测下一个 token 驱动，但通过工程闭环，最终表现出了项目经理级的规划与执行能力。

一、LLM 的能力边界

LLM 的核心优势在于语言理解和模式匹配，但它在精确计算、实时信息、持久记忆和直接操作外部世界方面存在天然短板。Agent 的工程层正是为了补齐这些短板：将计算、查询、存储、执行都封装成工具，让 LLM 通过调用工具来间接完成。理解这个边界，是设计 Agent 的第一步。

二、让 Agent 变聪明的五种模式

从最简单的 CoT（思维链）到 ReAct 闭环、Reflexion 自我反思、Planning 任务分解，再到 CodeAct 动态编程，复杂度逐级提升。关键数据：Reflexion 让 GPT-4 在 HumanEval 上从 80% 提升到 91%，证明流程设计比模型大小更重要。

模式 1：CoT 思维链（一步步思考）

CoT（Chain-of-Thought）通过要求模型“逐步推理”，在一次调用内显式展开中间步骤。它实现成本最低，适合作为 Agent 推理增强的起点。

模式 2：ReAct 循环（思考→行动→观察）

ReAct 让 LLM 在“思考→行动→观察→更新状态”之间循环。每次观察（Observation）都为下一步决策提供新信息，逐步降低任务的不确定性。这是 Agent 区别于一次性 Chatbot 的核心机制，也是“从预测 token 到做决策”的直接体现。

模式 3：Reflexion（评估→反思→重试）

Reflexion 让 LLM 先写出方案，再对自己进行结构化评估。如果不通过，则根据评估中的批评意见修改后重试。在 HumanEval 代码生成任务上，这种方法将 GPT-4 的 80% 准确率提升到 91%。关键在于：同一个模型分饰“写作者”和“评审员”，流程设计放大了模型能力。

模式 4：Planning（先规划再执行）

Planning 先让模型输出结构化计划，再按依赖顺序执行子任务。它适合多步骤、强依赖的复杂任务，能显著降低直接执行时的混乱和返工。

模式 5：CodeAct（动态写代码）

当预置工具覆盖不了问题时，CodeAct 允许 Agent 临时生成并执行脚本，把结果回填为 Observation，再继续决策。这是处理非常规任务的关键补位能力。

三、结构化输出：Function Calling 是工程基石

前面的模式都依赖同一件事：让 LLM 输出结构化工具调用（JSON），而不是自由文本。模型只负责“决定调用什么工具、传什么参数”，真正执行仍由宿主系统完成。

{
"name": "search_codebase",
"description": "在代码仓库中搜索关键词",
"parameters": {
"type": "object",
"properties": { "query": {"type":"string"} },
"required": ["query"]
}
}

调用链路是：用户输入 → 注入工具定义 → LLM 输出 tool call JSON → 宿主执行函数 → 执行结果回填给 LLM。LLM 本身没有“手脚”，是工程系统给了它行动能力。

四、模型路由：成本与质量的平衡

不是所有步骤都需要最强模型。Claude Code 的实践：探索搜索用轻量 Haiku，规划编码用 Sonnet/Opus。这种异构架构每月可节省数十万美元 API 费用。研究表明，正确的模型路由可以在性能损失不到 1% 的情况下降低 60% 的成本。

五、System Prompt：约束比能力更重要

优秀的 System Prompt 不是教模型变聪明，而是教它少犯错。通过明确角色边界、工具使用原则、不确定处理方式和记忆规范，可以大幅降低 Agent 的危险行为。Claude 的系统提示经历了 50 多个版本的迭代，最终演变为数千字的操作手册，核心就是“约束比能力更重要”。

六、控制论视角：开环 Chatbot vs 闭环 Agent

Chatbot 是开环系统：输入一次，输出一次，没有反馈。Agent 是闭环系统：感知→决策→行动→再感知，持续循环。闭环让 LLM 能够根据执行结果动态调整策略，这是它能“做决策”的根本原因。控制论告诉我们：没有反馈的系统无法适应变化，而 Agent 正是通过每次观察来降低不确定性。

◆ 反直觉洞察：让 LLM 做“更少但更关键的事”

最好的 Agent 不是让 LLM 做更多事，而是做更少但更关键的事，把所有确定性、可验证的部分交给代码和工具。

如何学习大模型 AI ？

由于新岗位的生产效率，要优于被取代岗位的生产效率，所以实际上整个社会的生产效率是提升的。

但是具体到个人，只能说是：

“最先掌握AI的人，将会比较晚掌握AI的人有竞争优势”。

这句话，放在计算机、互联网、移动互联网的开局时期，都是一样的道理。

我在一线科技企业深耕十二载，见证过太多因技术卡位而跃迁的案例。那些率先拥抱 AI 的同事，早已在效率与薪资上形成代际优势，我意识到有很多经验和知识值得分享给大家，也可以通过我们的能力和经验解答大家在大模型的学习中的很多困惑。我们整理出这套 AI 大模型突围资料包：

✅ 从零到一的 AI 学习路径图
✅ 大模型调优实战手册（附医疗/金融等大厂真实案例）
✅ 百度/阿里专家闭门录播课
✅ 大模型当下最新行业报告
✅ 真实大厂面试真题
✅ 2026 最新岗位需求图谱

所有资料 ⚡️ ，朋友们如果有需要 《AI大模型入门+进阶学习资源包》，下方扫码获取~
在这里插入图片描述

① 全套AI大模型应用开发视频教程

（包含提示工程、RAG、LangChain、Agent、模型微调与部署、DeepSeek等技术点）
在这里插入图片描述

② 大模型系统化学习路线

作为学习AI大模型技术的新手，方向至关重要。正确的学习路线可以为你节省时间，少走弯路；方向不对，努力白费。这里我给大家准备了一份最科学最系统的学习成长路线图和学习规划，带你从零基础入门到精通！
在这里插入图片描述

③ 大模型学习书籍&文档

学习AI大模型离不开书籍文档，我精选了一系列大模型技术的书籍和学习文档（电子版），它们由领域内的顶尖专家撰写，内容全面、深入、详尽，为你学习大模型提供坚实的理论基础。
在这里插入图片描述

④ AI大模型最新行业报告

2025最新行业报告，针对不同行业的现状、趋势、问题、机会等进行系统地调研和评估，以了解哪些行业更适合引入大模型的技术和应用，以及在哪些方面可以发挥大模型的优势。
在这里插入图片描述

⑤ 大模型项目实战&配套源码

学以致用，在项目实战中检验和巩固你所学到的知识，同时为你找工作就业和职业发展打下坚实的基础。
在这里插入图片描述

⑥ 大模型大厂面试真题

面试不仅是技术的较量，更需要充分的准备。在你已经掌握了大模型技术之后，就需要开始准备面试，我精心整理了一份大模型面试题库，涵盖当前面试中可能遇到的各种技术问题，让你在面试中游刃有余。

以上资料如何领取？

在这里插入图片描述

为什么大家都在学大模型？

最近科技巨头英特尔宣布裁员2万人，传统岗位不断缩减，但AI相关技术岗疯狂扩招，有3-5年经验，大厂薪资就能给到50K*20薪！

不出1年，“有AI项目经验”将成为投递简历的门槛。

风口之下，与其像“温水煮青蛙”一样坐等被行业淘汰，不如先人一步，掌握AI大模型原理+应用技术+项目实操经验，“顺风”翻盘！
在这里插入图片描述

这些资料真的有用吗？

这份资料由我和鲁为民博士(北京清华大学学士和美国加州理工学院博士)共同整理，现任上海殷泊信息科技CEO，其创立的MoPaaS云平台获Forrester全球’强劲表现者’认证，服务航天科工、国家电网等1000+企业，以第一作者在IEEE Transactions发表论文50+篇，获NASA JPL火星探测系统强化学习专利等35项中美专利。本套AI大模型课程由清华大学-加州理工双料博士、吴文俊人工智能奖得主鲁为民教授领衔研发。

资料内容涵盖了从入门到进阶的各类视频教程和实战项目，无论你是小白还是有些技术基础的技术人员，这份资料都绝对能帮助你提升薪资待遇，转行大模型岗位。
在这里插入图片描述

以上全套大模型资料如何领取？

在这里插入图片描述

AtomGit开源社区

AtomGit 是由开放原子开源基金会联合 CSDN 等生态伙伴共同推出的新一代开源与人工智能协作平台。平台坚持“开放、中立、公益”的理念，把代码托管、模型共享、数据集托管、智能体开发体验和算力服务整合在一起，为开发者提供从开发、训练到部署的一站式体验。

更多推荐

ArkTS（Stage 模型）与 Vue3 生命周期详细对比

维度ArkTS 生命周期Vue3 生命周期设计目标适配移动 / 物联网设备的全场景应用适配 Web 浏览器的组件化开发覆盖范围应用、模块、窗口、页面、组件应用、组件核心关注点资源管理、前后台切换、多设备协同DOM 渲染、组件复用、状态更新严格性非常严格，系统直接管理生命周期相对宽松，依赖浏览器环境最佳实践提前加载数据，及时释放资源按需渲染，减少不必要的更新。