别把 Git 当成 Agent 的安全网:revertly 如何为本地编码会话准备可审计的撤销层
让 Claude Code、Codex 一类编码 Agent 直接操作真实项目,效率往往来自它们拥有和开发者相同的权限:能改代码、运行脚本、读配置、删除生成文件。风险也在同一处。一次错误的“清理”、不...
最新内容
让 Claude Code、Codex 一类编码 Agent 直接操作真实项目,效率往往来自它们拥有和开发者相同的权限:能改代码、运行脚本、读配置、删除生成文件。风险也在同一处。一次错误的“清理”、不...
让编码 Agent 改一个按钮颜色、补一个表单校验,最常见的交付证据仍是“已完成”或一张截图。问题不在于截图没有价值,而在于它通常不能回答三个工程问题:当前页面是否真加载了新代码?某个交互后的状态是否...
线上事故发生时,信息并不总在一个可检索的地方。你可能刚在 Grafana 面板看到一次尖峰,又在日志窗口扫到半截 trace ID;切去 Slack 回答同事后,原来的面板被覆盖,下一分钟已很难复述「...
AI 编程进入多会话、多工具协作后,最容易反复消耗上下文的并不是“代码在哪”,而是“为什么当时这样决定”。例如,一个会话已经确认限流器必须用 Redis、某条迁移方案试过但应放弃、某个目录不能直接改;...
本地运行大模型时,最常见的失败路径是先下载十几 GB 的 GGUF,再反复改 -ngl、上下文长度和量化等级。最后即使能启动,也未必知道瓶颈在显存、系统内存带宽、磁盘,还是模型的 MoE 专家层。更麻...
当团队开始给 Claude Code、桌面客户端和浏览器里的 AI 服务接入网关时,最容易忽略的一段链路是:请求究竟能不能稳定地抵达网关。 传统做法通常依赖客户端支持自定义 Base URL、代理或企...
让 AI Agent 打开网页、采集信息、填写表单,看起来像是浏览器自动化的常规任务。但真正上线后,故障往往不在“能否点击按钮”,而在三件更具体的事:站点触发反爬或验证码、任务需要登录态而 Agent...
把 Claude Desktop、Cursor 或 Cline 接到本地仓库后,最容易被忽略的问题不是“模型会不会写代码”,而是“它到底能碰到哪里”。如果 MCP 服务只有读取、搜索和补丁能力,风险尚...
让 AI 编程助手修改一个成熟仓库,最危险的时刻往往不是它不会写代码,而是它写得“太整齐”。两个分支看似重复、两个状态处理看似可以合并、同步和异步流程看似只差一个 await:这些判断如果只依据局部文...
终端里的 AI 编程助手常见有两种极端:要么它只是一段没有现场上下文的聊天窗口,需要你不断复制日志、路径和命令;要么它被授予了直接执行 Shell 的能力,虽然省事,却把一次误判变成了真实副作用。对日...