浏览 AI 知识库
第一次 AI 编程任务怎么选:30 分钟内能验收、能撤销
第一次 AI 编程任务不要从“重做整个网站”开始。选一个改动范围清楚、结果看得见、测试跑得完、出错能撤销的任务,更容易判断工具是否真的帮上忙。
先比较关键条件,再作选择
把自己的条件代入判断项;没有证据的维度保留未知,不用印象替代结论。
第一个任务选得太大,往往连错在哪里都看不出来
第一次任务就让 Agent“重做公司官网”,两小时后改了 47 个文件,页面打不开也不知道从哪一步开始错。合适的首次任务应该在半小时内看到 diff、测试和撤销结果。
- 30 分钟内能看到可验收结果
- 失败可局部撤销
- 不会改变外部或生产状态
三个候选里,只有错误提示适合第一次做
| 候选任务 | 范围 | 验证 | 风险 | 决定 |
|---|---|---|---|---|
| 修正登录页空密码提示 | 1 个源文件 + 1 个测试 | 现有单测和浏览器步骤 | 低,可直接回滚 | 采用 |
| 重构全站导航 | 模板、样式、脚本和数百生成页 | 需要全站回归 | 高,边界不清 | 暂缓 |
| 把生产数据库升级一版 | 数据、服务和回滚链 | 需要备份恢复与停机方案 | 高且不可作为练习 | 禁止作为首次任务 |
陌生人拿到这张卡也能开始、停止和验收
| 字段 | 本例内容 |
|---|---|
| 问题 | 空密码和错误密码都显示‘登录失败’,用户不知道要补字段 |
| 实际输入 | 邮箱 [email protected];密码留空 |
| 允许范围 | src/login/validation.ts、tests/login/validation.test.ts |
| 禁止动作 | 不安装依赖、不改接口、不提交、不碰现有其他 diff |
| 完成标准 | 空密码提示准确;错误密码行为不变;相关测试通过 |
| 停止条件 | 真实文案来自服务端、基线测试失败或需要改公共错误体系 |
| 回滚 | 恢复本次两个文件的具体补丁并重跑原测试 |
先把本例的条件、限制和目标摆出来
| 需要确认 | 本例内容 |
|---|---|
| 现有材料 | 候选任务有修改一个按钮文案、补空状态测试、升级框架和重做导航;工作区当前可构建但未完全干净。 |
| 不能越过的边界 | 任务只选一个可观察结果,改动文件少,验证命令已知,不涉及数据库、部署和大规模依赖升级。 |
| 要交付的结果 | 首次任务卡与完成标准 |
AI 编程第一次做什么,哪些条件会改变最后选择
| 判断条件 | 本例怎么核对 |
|---|---|
| 选可见问题 | 例如修一处错误提示、补一个缺失状态、为现有函数加一个测试,结果能在页面或命令输出中观察。 |
| 限制修改面 | 写允许读取和编辑的目录、不能碰的生成物、依赖和配置,避免任务自然膨胀。 |
| 先定义完成证据 | 指定测试、构建、截图、diff 或手工步骤,验证方式在开始前就存在。 |
| 设置停止条件 | 遇到需要新依赖、权限、生产数据、结构重写或无法复现的错误时停下汇报,不继续猜。 |
| 完成后回顾 | 检查实际耗时、越界动作、验证和撤销是否有效,再决定下一次是否扩大任务。 |
AI 编程第一次做什么:按本例条件得到的结论
首次任务卡与完成标准
首次任务选为“修复空搜索提示并补测试”:预计 1-2 个文件,验收为定向测试通过与 390/1440px 页面可见,撤销为恢复这两个文件。框架升级和导航重构被明确推迟。
边界变化后需要重新判断
如果连构建命令和改动归属都不清楚,应先做只读仓库检查,而不是勉强挑一个写操作。
为什么“任务看起来很小,却需要跨越多个未知系统”还不能交付
任务看起来很小,却需要跨越多个未知系统
- 原因
- 标题小不等于依赖少
- 怎么改
- 先画影响文件与外部状态,涉及认证、数据库或发布就换成更小任务
