这张卡介绍正在取代提示词工程话语位的工程视角:管好模型的注意力预算。
核心拆解:上下文工程是围绕每次调用,系统性决定窗口内容的学科——放什么、不放什么、以什么形态放:检索结果要不要重排、历史要不要摘要、工具返回要不要裁剪、指令放头还是放尾。最容易误用的地方是把上下文工程等同于写更长的提示词,实际它的核心动作常常是删:删噪音比加说明更能提升质量。
增量判断:智能体越长程,上下文管理越是决定成败的工程,这一点国内实践与硅谷共识一致。FDE 的增量视角是把内容进出规则写成显式设计文档——什么触发写入、什么触发淘汰,让评测与排障都有据可依,而不是散在代码注释里。
行动建议:为你系统的每次调用画一张窗口内容清单,逐项标注保留理由与淘汰条件。这份清单本身就是排障时的第一手证据。
—— FDEChina编辑部 · 实战派
定义
上下文工程(Context Engineering)指为每一次模型调用,系统性决定上下文窗口里放什么、不放什么、以什么形态放的工程方法,涵盖检索内容的选择与重排、历史对话的摘要压缩、工具返回的裁剪与指令的排布。
展开
它是提示词工程的升级视角:提示词工程管「怎么问」,上下文工程管「让模型看见什么」——而后者往往决定前者能发挥几成。智能体系统尤其依赖它:多轮工具调用会把窗口塞满低信息密度的返回值,不裁剪就撞窗口、裁错了就丢关键状态。最容易误用的地方是把上下文工程理解成往提示词里塞更多说明,实际核心动作常常是删——删掉噪音比追加指令更能提升输出质量。FDE 交付要点是把内容进出规则显式化:什么触发写入、什么触发摘要、什么触发淘汰,写成设计文档让评测与排障有据可依;与记忆机制的辨析是,跨会话持久化属于记忆层设计,上下文工程管的是每次调用窗口内的取舍。