上篇我写了 Agent 安全方案——工具调用权限怎么管控、prompt 注入怎么防、数据隔离怎么做。搭好之后我盯着那套方案看了半天,脑子里冒出一个问题:我到底怎么知道它真的有用?
安全方案这东西有个尴尬的地方——没出事的时候看不出效果,出事了就知道哪里没防住。但等到真出事了才暴露...
神棍
2周前 (07-26) 66℃ 0评论
1喜欢
场景——踩坑开端
上篇写完多 Agent 协作之后,我在自己的 demo 系统上跑了一个简单场景:主 Agent 调用搜索 Agent 查资料,搜索 Agent 再去抓网页内容。跑了几天,发现了一个让我后背发凉的事——搜索 Agent 抓到一个网页,网页里藏着一行小字:̶...
神棍
2周前 (07-23) 95℃ 0评论
0喜欢