| title | Agent 能力与工具 |
|---|---|
| type | reference |
| status | current |
| owner | maintainers |
| updated | 2026-09-10 |
本页定义开发任务所需的推理能力和工具证据。它不替代 Workforce 产品中的 RuntimeCapability、Task requiredCapabilities 或节点 placement。
Workforce 已使用 T00–T17 作为开发任务编号,因此推理能力使用 R1–R4,避免混淆。
| 等级 | 适用任务 |
|---|---|
| R1 | 定向读取、机械修改、格式整理、运行已有检查 |
| R2 | 默认工程任务:普通实现、测试、修复和局部重构 |
| R3 | 根因不明、复杂状态流、并发、恢复、跨 package 契约等深推理 |
| R4 | 基础假设可能错误、多方案深度取舍、多次有证据的尝试仍无法解释问题 |
选择能可靠完成任务的最低等级,可以直接从预计需要的等级开始。风险决定验证强度,不等于推理难度;文件数量、运行时间和测试数量不自动触发升级。
遇到推理瓶颈时,记录已验证事实、仍无法解释的矛盾和升级理由。关键判断完成后,可把机械实现、测试或整理交回较低等级。Planner、Developer、Reviewer 是职责,不固定模型或等级。
开发 Agent 的 R1–R4 与产品运行时能力是两层概念:
开发治理:任务需要多少推理能力
产品调度:Task requiredCapabilities
执行事实:WorkerVersion + RuntimeDescriptor + validate
最终权限:Policy + WorkspaceGrant + PermissionGrant
后续接入模型选择时,应将推理等级映射为 Task/Worker 的结构化要求,再由 placement matcher 匹配当前机器上已验证的 Runtime。不要用模型名称代替能力,也不要因为 Runtime 声称支持某能力就跳过 Policy。
- 使用当前环境实际提供的工具、模型标识和接口。配置存在、工具声明支持、执行成功是不同证据,不能互相替代。
- 模型不可选时,使用当前模型完成能力范围内的工作;不可假称已经切换模型。
- 无子 Agent 或不支持并发时,顺序完成可做部分;需要的独立审查仍应标为未完成。
- 启动失败、权限不足、依赖缺失和 Runtime 不可用属于环境证据,不应直接归类为代码缺陷,也不能靠升级模型绕过。
- 对真实 Runtime、平台、账号或付费请求没有执行证据时,状态写“未验证”,不能从 Mock 结果推断通过。
首次接入新开发 Agent、升级运行环境或发现规则加载异常时,执行一次只读检查:
在仓库根目录读取 AGENTS.md。根据任务触发条件,实际读取对应指南;报告所读路径、触发理由、当前模型/工具可确认事实和缺失项。不要修改文件、运行真实 Runtime 或启动外部动作。
显式读取成功不代表自动加载、模型切换、并发或独立审查能力已经可用;分别以实际运行证据确认。