同一句「帮我处理 X」,可能对应三种完全不同的任务形状——配方做错,后面全错。
01 · 先认任务的「形状」是问答,还是规划,还是计算?
每个场景都有它的任务形态:是即时问答 + 单步查询(时延敏感)?是多步、多约束的长流程规划?是必须精确、不能估算的计算?是结论得能溯源到出处的检索?还是高风险、必须有人把关的判断? 任务形态决定该用哪一类模式——即时问答偏 ReAct,长流程偏 Plan-and-Execute,精确计算偏 CodeAct,溯源偏 Agentic RAG,高风险偏 Human-in-the-Loop。认错形态,选什么模式都白搭。
02 · 单一模式几乎不够真实场景要的是组合
纸面上一个场景对一个模式,现实里几乎都要组合。「对账」既要精确计算(CodeAct),又要在异常处自我复核(Reflexion);「售后」主体是边想边查的 ReAct,但碰到退款超额,就得切到人审(HITL)。 配方的实质,是把几种通用模式拼成这个场景的一条专属流程。
03 · 组合是有讲究的谁主谁辅、在哪一步切换
模式怎么嵌套、哪个是主干哪个是兜底、在哪一步从一种切到另一种——这些没有标准答案,是做过几十个场景才沉淀出来的判断。这也是为什么我们把这套判断力,连同每个领域验证过的配方,沉淀成可复用的 Agent Skill:做过的越多,下一个场景的配方就越快、越准。