Skip to content

什么是原则?

原则是从真实经验中抽象出的、可以跨越具体场景指导未来行为的高层次认知。

原则回答的是:"这种情况下我该如何思考?"

而不是:"我必须执行哪个具体动作?"

在 PD 中,原则来自 Agent 的真实行为:反复出现的行为偏差被捕捉为证据,经反思提炼,并在 Owner 审批之后才成为原则。

原则 vs 规则

原则和规则不是同义词。它们是同一枚硬币的两面——一面指向泛化,另一面指向具体。(这一区分来自我们的文章《软硬转换炼金术》。)

原则规则
目的引导判断约束动作
来源经验的抽象操作性要求
范围通用具体
回答我该怎么思考?我该怎么做?

说"原则是更好的规则"没有抓住要点:

原则引导判断。

规则约束具体动作。

一条类似"行动前先了解现状"的原则,适用于不同项目、工具和场景——它需要解释与权衡。一条类似"未拉取远程分支前禁止推送"的规则则是具体的、机械的,几乎没有解释空间。

两者协同工作。当反复的经验证明某条底线绝不能被遗忘时,Owner 可以把一条原则硬化为运行时层的可执行规则——先以影子模式试运行,经显式审批才激活,且始终可回滚。候选规则可以由系统自动起草,但硬化从不会自行发生:生成只产出提案,决定权和上线键始终在 Owner 手里。

原则 vs 记忆

记忆回答:发生了什么?
原则回答:从发生的事情里,应该学到什么?

记忆负责存储和检索信息。原则则从经验中蒸馏而来,并改变 Agent 下一次的行为方式——所以会话记忆仍由宿主负责,而行为改进是 PD 的事。

原则 vs 提示词

提示词:在执行之前,告诉 Agent 该做什么。
原则:从执行之后实际发生的事情中学习而来。

提示词是提前写好的指令。原则是从真实结果中抽象出的认知——它跨会话、跨任务、跨场景持续有效,而不是活在某一段对话里。

原则在 PD 中如何生效

一条通过审批的原则会经由治理通道生效:当下主要是提示词引导;对少数关键底线,则由 Owner 提升为运行时层的可执行规则。完整旅程见从经验到原则