浏览 AI 知识库

第一次 AI 编程任务怎么选:30 分钟内能验收、能撤销

第一次 AI 编程任务不要从“重做整个网站”开始。选一个改动范围清楚、结果看得见、测试跑得完、出错能撤销的任务,更容易判断工具是否真的帮上忙。

先比较关键条件,再作选择

把自己的条件代入判断项;没有证据的维度保留未知,不用印象替代结论。

先别急着选

第一个任务选得太大,往往连错在哪里都看不出来

第一次任务就让 Agent“重做公司官网”,两小时后改了 47 个文件,页面打不开也不知道从哪一步开始错。合适的首次任务应该在半小时内看到 diff、测试和撤销结果。

  • 30 分钟内能看到可验收结果
  • 失败可局部撤销
  • 不会改变外部或生产状态
先筛任务

三个候选里,只有错误提示适合第一次做

候选任务范围验证风险决定
修正登录页空密码提示1 个源文件 + 1 个测试现有单测和浏览器步骤低,可直接回滚采用
重构全站导航模板、样式、脚本和数百生成页需要全站回归高,边界不清暂缓
把生产数据库升级一版数据、服务和回滚链需要备份恢复与停机方案高且不可作为练习禁止作为首次任务
可交付任务卡

陌生人拿到这张卡也能开始、停止和验收

字段本例内容
问题空密码和错误密码都显示‘登录失败’,用户不知道要补字段
实际输入邮箱 [email protected];密码留空
允许范围src/login/validation.ts、tests/login/validation.test.ts
禁止动作不安装依赖、不改接口、不提交、不碰现有其他 diff
完成标准空密码提示准确;错误密码行为不变;相关测试通过
停止条件真实文案来自服务端、基线测试失败或需要改公共错误体系
回滚恢复本次两个文件的具体补丁并重跑原测试
本例材料

先把本例的条件、限制和目标摆出来

需要确认本例内容
现有材料候选任务有修改一个按钮文案、补空状态测试、升级框架和重做导航;工作区当前可构建但未完全干净。
不能越过的边界任务只选一个可观察结果,改动文件少,验证命令已知,不涉及数据库、部署和大规模依赖升级。
要交付的结果首次任务卡与完成标准
决定依据

AI 编程第一次做什么,哪些条件会改变最后选择

判断条件本例怎么核对
选可见问题例如修一处错误提示、补一个缺失状态、为现有函数加一个测试,结果能在页面或命令输出中观察。
限制修改面写允许读取和编辑的目录、不能碰的生成物、依赖和配置,避免任务自然膨胀。
先定义完成证据指定测试、构建、截图、diff 或手工步骤,验证方式在开始前就存在。
设置停止条件遇到需要新依赖、权限、生产数据、结构重写或无法复现的错误时停下汇报,不继续猜。
完成后回顾检查实际耗时、越界动作、验证和撤销是否有效,再决定下一次是否扩大任务。
代入本例

AI 编程第一次做什么:按本例条件得到的结论

可以确认

首次任务卡与完成标准

首次任务选为“修复空搜索提示并补测试”:预计 1-2 个文件,验收为定向测试通过与 390/1440px 页面可见,撤销为恢复这两个文件。框架升级和导航重构被明确推迟。

仍需确认

边界变化后需要重新判断

如果连构建命令和改动归属都不清楚,应先做只读仓库检查,而不是勉强挑一个写操作。

常见失败

为什么“任务看起来很小,却需要跨越多个未知系统”还不能交付

任务看起来很小,却需要跨越多个未知系统

原因
标题小不等于依赖少
怎么改
先画影响文件与外部状态,涉及认证、数据库或发布就换成更小任务
验收方式

首次任务卡与完成标准通过哪些检查才算完成

进一步核对

Agent 起步:参考资料与核对入口