使用工具不等于运营体系
运行 Codex 或 Claude Code 并不会自动明确需求、设计、验证和发布责任。
Consulting
Why it matters
运行 Codex 或 Claude Code 并不会自动明确需求、设计、验证和发布责任。
没有范围和停止条件时,Agent 可能修改无关文件、依赖项或部署设置。
除了生成速度,还要记录谁批准了什么、最新变更通过了哪些验证。
Principles
从需求到运营,定义输入、完成标准、Agent 与人的责任以及进入下一阶段的条件。
将角色、Skill、证据和审批规则与特定供应商分离。
根据产品族、法规、安全暴露和变更影响调整质量门禁与审批强度。
测量基线和失败模式,再根据实际证据扩大范围。
Lifecycle
确认来源、验收标准、影响边界和禁止事项,由 Planner 组织工作与验证计划。
评审架构、接口、数据流和安全影响,高风险设计由人批准。
先建立失败测试和完成标准,Implementer 仅在批准的文件与命令范围内最小化修改。
Reviewer、Tester、Security Reviewer 分别检查意图、回归、测试充分性、漏洞和数据暴露。
在最新 head 验证静态分析、复杂度、coverage、依赖审计和 E2E,仅使用批准的分支和部署流程。
记录决策、命令、测试和部署证据;证据或权限不足时按 fail closed 停止并升级。
Agent & Skill Architecture
组织需求、影响、风险、工作单元、验证和审批点。
在批准的计划和最小权限内按 TDD 实现,不扩大请求范围。
独立检查需求符合性、设计一致性、复杂度与可维护性。
设计正常、边界、失败和回归验证,并在最新 head 复现结果。
检查秘密、个人信息、依赖项、外部通信、权限和部署变更。
封装重复活动的流程、检查表、工具、所需证据和停止条件。
Guardrail & Human in the Loop
只允许必要范围,禁止破坏性操作和未经批准的依赖变更。
控制秘密、个人信息、客户数据、日志、网络、外部服务和信息传出。
分别定义分支、提交、PR、最新 head CI、合并、QA、Production 和运营权限。
由人确认验收标准并批准共享架构、数据、认证和授权变更。
确认必要性、许可证、漏洞、数据流和责任后再允许。
遇到歧义、政策冲突、验证失败、秘密或越权工作时停止并升级给责任人。
Quality & Security Gates
按产品风险、法规和仓库政策定义完成标准
以 TDD、100% statement 与 branch coverage 目标及 no exclusion 作为严格示例
自动执行复杂度、静态分析、类型检查、代码评审和安全规则
审计依赖漏洞与许可证并阻止未批准的软件包
在最新 head 执行单元、集成、E2E、可访问性和 CI/CD 验证
验证、证据或权限不足时 fail closed 并升级
Pilot & Enablement
评估开发流程、产品风险、仓库规则、工具、质量指标和审批结构。
在代表性任务中应用 Agent、Skill、Guardrail 和 Human in the Loop,测量质量、交付时间和失败模式。
开发、评审、QA、安全和负责人练习责任、证据、审批与升级。
根据 Pilot 结果改进 Skill 和政策,确定产品范围、责任和扩展路线图。
Deliverables
各阶段 AI 角色、人的责任、输入输出与完成标准。
实现、评审、测试、安全、审批和升级的 Agent 与人员责任。
Subagent 和重复 Skill 的目的、工具、证据、权限与停止条件。
AGENTS.md 等政策、分支提交规则、命令、数据、网络、合并与部署边界。
基于风险的 Human in the Loop 清单以及角色培训、工作坊和辅导。
依据实际结果、失败、改进和剩余风险制定扩展计划,不预先保证速度或成本数字。
FAQ
不需要。Codex 和 Claude Code 只是示例,并非必选产品或合作服务。我们选择适合客户环境的工具,同时让阶段、角色、Skill、Guardrail 和审批证据独立于供应商与 IDE。
不需要。先诊断现有需求、设计、评审、测试、CI/CD 和审批,保留经过验证的流程,从适合 Agent 辅助的小范围开始。
不只在最后。验收标准、高风险设计、新依赖、安全与个人信息、合并、部署和运营变更都需要人批准或停止。
用 Guardrail 限制文件、命令、数据、外部通信和部署权限,并结合 TDD、coverage、静态分析、依赖审计、独立评审与最新 head CI。证据不足时停止。
选择小而具有代表性的任务并测量现状。应用 Agent、Skill、审批规则和证据记录后,比较质量、交付时间、失败与返工,再按实际结果确定改进目标和扩展范围。