Molt 实战:在测试环境里给 AI Agent 加上单次、限额、可核验的购买权限
让 Agent 搜索商品、生成购物清单,和让它真正提交订单,是两个安全等级完全不同的问题。前者出错通常只是答案不佳;后者一旦被提示注入、错误路由或上下文污染影响,就可能把外部动作带到不该去的商家、金额...
最新内容
让 Agent 搜索商品、生成购物清单,和让它真正提交订单,是两个安全等级完全不同的问题。前者出错通常只是答案不佳;后者一旦被提示注入、错误路由或上下文污染影响,就可能把外部动作带到不该去的商家、金额...
漏洞扫描的职责是发现“组件版本与已知漏洞相交”的可能性;它通常不知道你的程序是否走得到那条代码路径、发行版是否已在上游打了补丁,或某个可选功能是否根本没有启用。于是,安全团队会遇到一种尴尬的重复劳动:...
应用代码没有改动,不代表交付物没有新增风险。一个 Node 项目可能从 package-lock.json 带入受影响的间接依赖;服务打包进镜像后,又会继承基础镜像里的系统包。更棘手的是,开发机能联网...
让一个编码 Agent 调用部署、数据库或支付工具时,真正棘手的并不只是“要不要弹确认框”。现实中的任务会继续拆分:人把工作交给主 Agent,主 Agent 再委派给测试、检索或执行子 Agent。...
企业给 Agent 接上 CRM、工单、云盘和知识库后,最容易被低估的问题不是“能不能搜到”,而是“谁能搜到什么”。传统 RAG 往往先把资料切块、向量化,再让应用层在结果出来后做过滤;一旦调用方身份...
AI 编码 Agent 已经能定位数据问题、生成迁移脚本,甚至通过 MCP 发起数据库查询。真正棘手的并不是它会不会写 SQL,而是如何把「提出一条 SQL」和「带着生产凭据执行它」拆开。把连接串交给...
Rust 项目升级依赖时,团队常见的判断只有两种:cargo update 能否解析,以及漏洞扫描有没有命中已公开的 CVE。它们都很重要,但都没有回答另一个工程问题:当前锁定的第三方 crate,是...
让编码 Agent 做安全审查,最常见的失败不是它完全不知道安全常识,而是它把泛化建议套到了错误的依赖版本上。比如项目已经锁定某个框架的小版本,Agent 却引用了另一代 API 的配置方式;又或者它...
GitHub Actions 往往被放在仓库边缘:它只是几份 YAML,能跑通构建就很少再被认真审查。但工作流实际拥有读取仓库、写入 release、发布包、访问密钥乃至调用云端 API 的能力。把来...
给 AI Agent 接上 MCP 以后,真正棘手的问题并不是「它能不能调用工具」,而是「谁能证明这一次调用确实遵守了批准过的规则」。普通网关可以记录 allow/deny 结果,但策略引擎、日志和被...