让 AI Agent 自己跑网页验收还不够:Kery 如何把测试结论变成可复查的浏览器证据
前端改动交给 AI 编程 Agent 后,最难确认的往往不是代码有没有生成,而是页面是否真的仍能完成业务流程。单元测试能覆盖函数,端到端脚本能覆盖预先写好的选择器;可一旦需求是“下单页应清楚展示价格”...
最新内容
前端改动交给 AI 编程 Agent 后,最难确认的往往不是代码有没有生成,而是页面是否真的仍能完成业务流程。单元测试能覆盖函数,端到端脚本能覆盖预先写好的选择器;可一旦需求是“下单页应清楚展示价格”...
前端改动交给 AI 编程 Agent 后,最难确认的往往不是代码有没有生成,而是页面是否真的仍能完成业务流程。单元测试能覆盖函数,端到端脚本能覆盖预先写好的选择器;可一旦需求是“下单页应清楚展示价格”...
AI 编程 Agent 很适合长时间跑在开发机上:读仓库、改文件、执行测试、等待下一步。但人并不总在终端前。把 Agent 接到 Discord、Telegram 或 Slack,表面上只是“远程发消...
前端改动交给 AI 编程 Agent 后,最难确认的往往不是代码有没有生成,而是页面是否真的仍能完成业务流程。单元测试能覆盖函数,端到端脚本能覆盖预先写好的选择器;可一旦需求是“下单页应清楚展示价格”...
团队同时使用 Claude Code、Codex 和 Gemini CLI 时,真正难管的通常不是某一次提示词,而是工程边界:不同成员装了不同版本;MCP 服务要重复配置;一次任务里的研究、实现和测试...
让编码 Agent “修好一个问题”之后,最容易得到的证据是一段自然语言总结。但对工程流程而言,这种总结并不充分:它有没有读到正确的配置文件?是否真的运行过测试?有没有在不该改动的文件中留下副作用?不...
当 Claude Code、Codex 和 OpenCode 同时在 tmux 的不同 pane 里运行时,真正消耗注意力的通常不是再开一个 Agent,而是“巡视”。你得在 session 之间切换...
团队同时使用 Claude Code、Codex 和 Gemini CLI 时,真正难管的通常不是某一次提示词,而是工程边界:不同成员装了不同版本;MCP 服务要重复配置;一次任务里的研究、实现和测试...
TypeScript 项目里最难清理的往往不是明显的 any,而是看起来“已经有类型”的补丁式代码:把值连续 as 成目标类型;先标注成 unknown 或宽泛的 Record,过几行再断言回来;对来...
团队同时使用 Claude Code、Codex 和 Gemini CLI 时,真正难管的通常不是某一次提示词,而是工程边界:不同成员装了不同版本;MCP 服务要重复配置;一次任务里的研究、实现和测试...