别把 Agent 的运行记录当成授权证据:用 SHACKLE 给工具调用加可复现的熔断门
Agent 的事故并不总是从“模型答错”开始。更常见的路径是:某次工具调用得到 401、超时或格式错误;Agent 把失败信息塞回上下文后再试一次;随后继续调用同一个工具、重复提交同一个请求,或者在没...
最新内容
Agent 的事故并不总是从“模型答错”开始。更常见的路径是:某次工具调用得到 401、超时或格式错误;Agent 把失败信息塞回上下文后再试一次;随后继续调用同一个工具、重复提交同一个请求,或者在没...
给 Agent 加 JSON Schema、工具白名单和权限策略后,很多团队会觉得“写操作已经被管住了”。但在退款、转账、删改资源这类动作上,真正棘手的失败并不一定是 Agent 调了不该调的工具,而...
AI 编程 Agent 经常在不止一台机器上工作:本机生成测试报告,远程 VPS 跑构建,另一台环境负责部署或验收。文件一旦要跨机器,最常见的临时方案是把对象存储链接、聊天附件或长期 API Toke...
给 AI 编程 Agent 配 GitHub、Slack、云平台或内部 API 凭据,最常见的做法仍是把长效 Token 写进环境变量。它足够省事,却把两类本应独立的问题绑到了一起:正在发起请求的进程...
让 Claude Code、Codex 一类编程 Agent 直接操作本地仓库,效率很高,但它们默认继承的是启动它们的 shell 权限。这个事实比“模型会不会写错代码”更需要优先处理:一个被错误指令...
让 Claude Code、Codex 一类编程 Agent 直接在开发机上执行命令,最容易犯的错不是“没有装 Docker”,而是把几个不同的问题混成一个问题:误删文件、提示注入诱导外传、以及恶意依...
问题:AI Agent 修漏洞,为什么总修不干净? 让 Claude Code 或 Codex CLI 去修复项目的依赖漏洞,结果往往两极分化:小项目能修到 99%,但一旦遇到多模块的大型项目,修复率...
传统 SAST 工具每天都在给你报假阳性:一个 eval() 标记为高风险,一个 SQL 拼接被标为 SQL 注入风险,但工程师花 20 分钟验证后发现根本不可利用。安全团队和开发团队的信任就在这种&...
你的 Claude Code、Cursor 或 Windsurf 正在连接多少个 MCP 服务器?这些服务器有没有安全漏洞?如果你像大多数 AI Agent 用户一样,从社区拉取了各种 MCP 服务器...
你的 Claude Code 正在通过 terraform destroy 清空生产环境,而你正在喝咖啡——这不是恐怖片剧本,这是 2026 年每个使用 AI 编码 Agent 的团队每天都在面对的真...