宋振华
第 12 篇:安全防护体系 —— 三层 Guardrails 与权限分离原则
原创
关注作者
腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
宋振华
社区首页
>
专栏
>
第 12 篇:安全防护体系 —— 三层 Guardrails 与权限分离原则
第 12 篇:安全防护体系 —— 三层 Guardrails 与权限分离原则
宋振华
关注
修改于 2026-08-07 12:00:03
修改于 2026-08-07 12:00:03
148
0
举报
概述
2025 年 6 月,安全研究人员披露了 EchoLeak 漏洞(CVE-2025-32711,CVSS 9.3)——这是首个在生产环境 LLM 系统中被武器化、造成实际数据泄露的 Prompt Injection 攻击。
文章被收录于专栏:
后端agent harness学习路径
后端agent harness学习路径
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系
cloudcommunity@tencent.com
删除。
腾讯云开发者社区
深圳同盟
腾讯云架构师技术同盟
目录
一、场景切入:一封邮件偷走了你的机密
二、三层 Guardrails 架构
2.1 输入防护层(Input Guardrails)
2.2 工具防护层(Tool Guardrails)
2.3 输出防护层(Output Guardrails)
三层对比
三、Tripwire 机制:并行 vs 阻塞
并行模式(默认)
阻塞模式
选型决策
四、权限与推理分离原则
4.1 核心问题:为什么不能让模型自己管权限?
4.2 Google DeepMind 的 CaMeL 架构
4.3 权限分离的实现原则
五、Claude Code 的权限模型
5.1 三阶段权限流程
5.2 Auto Mode 的双层防御
5.3 OS 级沙箱
六、Prompt Injection 防御策略
6.1 Spotlighting 技术
6.2 防御最佳实践
七、后端视角映射
八、代码实战:三层 Guardrails 中间件
代码设计要点
九、总结与下篇预告
本文核心要点
下篇预告
参考文献
问题归档
专栏文章
快讯文章归档
关键词归档
开发者手册归档
开发者手册 Section 归档