Skip to content

Latest commit

 

History

History
57 lines (40 loc) · 2.99 KB

File metadata and controls

57 lines (40 loc) · 2.99 KB
title Agent 能力与工具
type reference
status current
owner maintainers
updated 2026-09-10

Agent 能力与工具

本页定义开发任务所需的推理能力和工具证据。它不替代 Workforce 产品中的 RuntimeCapability、Task requiredCapabilities 或节点 placement。

推理等级

Workforce 已使用 T00–T17 作为开发任务编号,因此推理能力使用 R1–R4,避免混淆。

等级 适用任务
R1 定向读取、机械修改、格式整理、运行已有检查
R2 默认工程任务:普通实现、测试、修复和局部重构
R3 根因不明、复杂状态流、并发、恢复、跨 package 契约等深推理
R4 基础假设可能错误、多方案深度取舍、多次有证据的尝试仍无法解释问题

选择能可靠完成任务的最低等级,可以直接从预计需要的等级开始。风险决定验证强度,不等于推理难度;文件数量、运行时间和测试数量不自动触发升级。

遇到推理瓶颈时,记录已验证事实、仍无法解释的矛盾和升级理由。关键判断完成后,可把机械实现、测试或整理交回较低等级。Planner、Developer、Reviewer 是职责,不固定模型或等级。

与产品能力的关系

开发 Agent 的 R1–R4 与产品运行时能力是两层概念:

开发治理:任务需要多少推理能力
产品调度:Task requiredCapabilities
执行事实:WorkerVersion + RuntimeDescriptor + validate
最终权限:Policy + WorkspaceGrant + PermissionGrant

后续接入模型选择时,应将推理等级映射为 Task/Worker 的结构化要求,再由 placement matcher 匹配当前机器上已验证的 Runtime。不要用模型名称代替能力,也不要因为 Runtime 声称支持某能力就跳过 Policy。

工具证据

  • 使用当前环境实际提供的工具、模型标识和接口。配置存在、工具声明支持、执行成功是不同证据,不能互相替代。
  • 模型不可选时,使用当前模型完成能力范围内的工作;不可假称已经切换模型。
  • 无子 Agent 或不支持并发时,顺序完成可做部分;需要的独立审查仍应标为未完成。
  • 启动失败、权限不足、依赖缺失和 Runtime 不可用属于环境证据,不应直接归类为代码缺陷,也不能靠升级模型绕过。
  • 对真实 Runtime、平台、账号或付费请求没有执行证据时,状态写“未验证”,不能从 Mock 结果推断通过。

接入检查

首次接入新开发 Agent、升级运行环境或发现规则加载异常时,执行一次只读检查:

在仓库根目录读取 AGENTS.md。根据任务触发条件,实际读取对应指南;报告所读路径、触发理由、当前模型/工具可确认事实和缺失项。不要修改文件、运行真实 Runtime 或启动外部动作。

显式读取成功不代表自动加载、模型切换、并发或独立审查能力已经可用;分别以实际运行证据确认。