外观
目标(Goals)和评分标准(rubrics)帮助 Deep Agents Code 检查其工作是否满足你所关心的标准。对于目标驱动的、智能体应该帮助定义验收标准的工作,请使用目标;当你已经知道标准时,请使用评分标准。
选择目标还是评分标准
当你有一个可衡量的目标,并希望 Deep Agents Code 在开始之前起草验收标准时,使用目标。目标有一个生命周期:一旦被接受,它会在各个轮次中保持激活,直到你暂停它、智能体将其标记为已完成或被阻塞,或者你将其清除。你也可以在无需重启工作的情况下修订一个激活中的目标。
当你已经知道想让智能体接受评分的标准时,使用评分标准。评分标准可以只适用于下一轮,也可以跨未来轮次持久存在。
常见模式:
- 单一目标,智能体起草标准:使用
/goal <objective>。 - 每一轮都持久存在的标准:使用
/rubric set <criteria>。 - 存储在文件中的标准:使用
/rubric file <path>。 - 单轮质量门控:使用
/rubric next <criteria>。
使用目标
当你知道想要的结果,但希望 Deep Agents Code 在工作开始前提出验收标准时,使用 /goal。目标对于开放式工作很有用:智能体将一个目标转化为具体的完成定义,然后不断迭代,直到这些标准得到满足。
txt
/goal add OAuth refresh handlingDeep Agents Code 会在开始任务前起草验收标准以供审查。
在内联审查中,你可以接受提案、编辑标准、请求另一次修订,或取消它。在你接受标准之后,目标会跨轮次保持激活,直到被暂停、完成、阻塞或清除。
这种方法让你可以在多个轮次中朝着更大的目标努力:
txt
/goal migrate auth callbacks to the new API
start with the OAuth callback
now update the tests
check the docs too输入框上方的目标面板显示当前目标以及它处于激活、暂停、阻塞还是已完成状态。使用 /goal show 检查当前目标,使用 /goal clear 将其移除。
修订、暂停和恢复目标
在不取消当前任务和重放工作的情况下引导进行中的目标:
/goal amend <feedback>提议对目标和标准进行协调更新。修订会经过同样的内联审查(接受、编辑、修订或取消)后才最终确定。/goal pause保存目标,但不让它驱动工作或评分,因此其间穿插的提示词会在没有它的情况下运行。/goal resume重新激活已保存的目标,并从现有对话继续。
txt
/goal amend remove JSON export, add streaming CSV support, keep the CSV tests
/goal pause
/goal resume完成与评分
在各项工作完成之前,每个后续轮次都会对照目标的验收标准进行评分。
- 当目标的完成被批准时,Deep Agents Code 会清除该目标
目标命令参考
- `/goal <objective>`:根据自然语言目标起草验收标准,并在工作开始前审查它们。
- `/goal amend <feedback>`:提议对目标和标准进行协调更新以供审查。
- `/goal pause`:保存目标,但不让它驱动工作或评分。
- `/goal resume`:重新激活已暂停的目标,并从现有对话继续。
- `/goal show`:检查当前目标、其状态及其标准。
- `/goal clear`:移除激活中的目标。
- `/goal model [provider:model|clear]`:设置或清除为目标评分所用的模型。
- `/goal max-iterations <N|clear>`:设置或清除目标的最大评分迭代次数。
使用评分标准
当你已经知道验收标准,并希望它们作为智能体工作的质量门控时,使用 /rubric。
txt
/rubric set tests pass; no unrelated files changed; help text is updated
/rubric next only change the auth callback; do not refactor unrelated code
/rubric file acceptance.md粘性评分标准(sticky rubric)适用于未来的轮次,直到被清除。下一轮评分标准(next-turn rubric)只适用于下一个提交的任务。
评分标准命令参考
- `/rubric show`:检查激活中的评分标准。
- `/rubric clear`:移除激活中的评分标准。
- `/rubric model <provider:model>`:设置为评分标准结果评分的模型。
在非交互式模式下使用评分标准
非交互式运行无法暂停以进行目标审查。对于标准已知的任务,请使用 `--rubric`:
bash
dcode -n "implement OAuth refresh handling" --rubric "tests pass; no unrelated files changed"
dcode -n "implement OAuth refresh handling" --rubric @acceptance.md 你也可以设置评分模型和最大评分迭代次数:
bash
dcode -n "implement OAuth refresh handling" \
--rubric "tests pass; no unrelated files changed" \
--rubric-model openai:gpt-5.5 \
--rubric-max-iterations 3