• 欢迎关注我的微信公众号“ Falost ” 右边扫描关注 --->>

 分类:AI / 大模型

上下文工程收官:怎么管住一次请求的 token 花销?我做了一张“上下文预算表”

上下文工程收官:怎么管住一次请求的 token 花销?我做了一张“上下文预算表”
上下文工程这个系列写到今天,该收尾了。前几篇我一直在算账:KV Cache 那篇算显存账,提示缓存+压缩那篇算钱账,Lost in the Middle 那篇算准确率账。三本账算完,我却发现账是分开记的——缓存开关在配置里,压缩阈值在代码深处,检索条数在另一个函数里。真被问到“一...

神棍 2天前 21℃ 0评论 0喜欢

Lost in the Middle:为什么上下文越长,模型越容易“迷路”?我的三层解法(位置管理+检索精减+路由分流)

Lost in the Middle:为什么上下文越长,模型越容易“迷路”?我的三层解法(位置管理+检索精减+路由分流)
最近在写上下文工程这个系列,前两篇我把两本账算完了:KV Cache 那篇讲的是显存账——长上下文的显存到底烧在哪;提示缓存 + 上下文压缩那篇讲的是钱的账——让同一段前缀只算一次钱。今天算第三笔,也是最容易被忽略的一笔:准确率的账。 起因是有读者在后台问我:”我把公...

神棍 5天前 45℃ 0评论 0喜欢

Agent 安全测试与红队实战:用自动化工具给你的 Agent 系统做渗透测试

Agent 安全测试与红队实战:用自动化工具给你的 Agent 系统做渗透测试
上篇我写了 Agent 安全方案——工具调用权限怎么管控、prompt 注入怎么防、数据隔离怎么做。搭好之后我盯着那套方案看了半天,脑子里冒出一个问题:我到底怎么知道它真的有用? 安全方案这东西有个尴尬的地方——没出事的时候看不出效果,出事了就知道哪里没防住。但等到真出事了才暴露...

神棍 1个月前 (07-26) 262℃ 0评论 1喜欢

Agent 安全实战:工具调用权限、数据隔离与防注入——Agent 能调工具之后,你的系统还安全吗?

Agent 安全实战:工具调用权限、数据隔离与防注入——Agent 能调工具之后,你的系统还安全吗?
场景——踩坑开端 上篇写完多 Agent 协作之后,我在自己的 demo 系统上跑了一个简单场景:主 Agent 调用搜索 Agent 查资料,搜索 Agent 再去抓网页内容。跑了几天,发现了一个让我后背发凉的事——搜索 Agent 抓到一个网页,网页里藏着一行小字:̶...

神棍 2个月前 (07-23) 232℃ 0评论 0喜欢