Fri Jul 24 2026 08:00:00 GMT+0800 (China Standard Time)·2 min readAI Architecture吃透 AI Agent 开发
Context Engineering 与 Memory
把 System Prompt 变成可测试的行为配置
System Prompt 应该具备模块边界、优先级、版本和评测用例,而不是一段临时拼接的长文本。
#Prompt Engineering#Context#Evaluation
提示词工程进入产品阶段后,重点从“怎么写得像人”变成“怎么让行为稳定”。身份、任务目标、工具约束、输出格式、拒答策略和业务规则应该拆成可版本化模块。
评测方法
为每个模块准备正常、边界和对抗样例,记录工具选择、格式正确率、拒答准确率、Token 和延迟。修改一段规则后重新跑回归集,避免一次优化破坏另一类场景。
项目落点
内容运营 Agent 用结构化输出约束选题、文案和配图节点;销售模型微调则通过盲评检查表达风格,再把动态业务事实留给 RAG。提示词不再独自承担所有能力。
结论
Prompt 不是一次性文案,而是需要版本、测试和回滚的行为配置。