外观
Coding Agent
Coding Agent 的共同能力是读取代码、提出计划、修改文件和运行验证。真正影响结果的是上下文、权限、任务边界和成功标准,而不是对话框长什么样。
Claude Code
Claude Code 是终端式 Coding Agent,适合在本地仓库中搜索、编辑、测试和使用工具。把长期项目规则写入其支持的项目指令文件,任务 Prompt 只保留当前目标;查看权限设置和工具调用,不要默认允许读取密钥或执行生产操作。
Codex
Codex 是 OpenAI 的软件开发 Agent,可通过 CLI、IDE 等界面处理代码。仓库中的 AGENTS.md 会作为持久指导,更靠近目标文件的指令优先;其中应写构建、测试、目录边界和审查要求,而不是空泛风格口号。
Codex 使用沙箱和审批策略控制命令与文件访问。默认权限适合开始使用,只在可信仓库和明确需要时放宽;让它完成“阅读—修改—验证—解释 diff”的闭环,并要求对未验证部分明确说明。
OpenCode
OpenCode 是开源终端 Coding Agent,适合希望选择模型提供商和检查工具实现的用户。配置模型、工具和权限时,把 Provider Token 放在环境或凭据存储中;升级后检查配置格式和默认权限是否变化。
Gemini CLI
Gemini CLI 提供终端中的 Agent 工作流。使用前确认认证方式、上下文文件、工具权限和配额;大型仓库先限定相关目录和可验证目标,避免把“理解整个项目”作为没有退出条件的任务。
Aider
Aider 围绕 Git diff 和提交进行结对编程,适合明确文件范围的小步修改。开始前保持工作区状态可辨认,完成后查看 diff 和测试;是否让工具自动提交应服从团队 Git 规则。
GitHub Copilot 与 Cursor
Copilot 深度集成编辑器和 GitHub 工作流,Cursor 则把代码库检索、聊天和 Agent 能力放进 AI 编辑器。内联补全适合局部样板,跨文件 Agent 适合有测试的独立任务。任何自动应用的修改都应进入普通代码审查流程。
一份有效的任务交接
text
目标:修复断点恢复后学习率错误。
证据:最小复现命令、期望值、实际值和日志。
范围:训练状态加载和对应测试;不要改变配置格式。
完成标准:新增回归测试,相关测试与类型检查通过。把核心研究逻辑、数据清洗与评价协议列为人工重点审查区。Agent 说“完成”不等于实验正确;检查 diff、运行命令、使用小数据核对输入输出。
多 Agent 与 Herdr
并行任务应满足低耦合、不同文件或不同 worktree、各自有验证。Herdr 可以保持会话并显示 working/blocked/done,Git worktree 隔离目录;最终仍由一个负责人整合、解决冲突并运行全量检查。
参考:Claude Code 文档、Codex 文档、OpenCode 文档、Gemini CLI、Aider 文档、Herdr。