2026.09.25 · 周五行业动态
←返回首页话题 · Topic
#提示注入
共 38 条相关资讯
2026.09.24 · 周四工具
enclawed-enclaved:面向 AI 智能体的安全合规框架
2026.09.24 · 周四研究论文
AI 智能体目标劫持:攻击者如何用工具反噬
2026.08.29 · 周六研究论文
247 篇论文综述:LLM 智能体安全是系统问题
2026.08.28 · 周五行业动态
MCP 服务器安全风险:当 AI 智能体拥有你的全部权限
2026.08.28 · 周五研究论文
Claude Code 自动模式遭破解,安全机制反成拦路石
2026.08.28 · 周五行业动态
AI 智能体提示注入攻击实战:以云服务比价为例
2026.08.23 · 周日行业动态
社区测试:60 条提示注入全部绕过 Shieldstral,GPT-OSS_safeG 仅识别 10%
2026.08.21 · 周五产品功能
AWS Bedrock AgentCore:在基础设施层约束 AI 智能体权限
2026.08.20 · 周四行业动态
Grok 被曝存在数据窃取漏洞,xAI 此前已被告知仍未修复
2026.08.19 · 周三研究论文
arXiv 新研究提出「模型催眠」:弱提示可叠加控制 AI 行为
2026.08.18 · 周二工具
Agent Control Plane:把 AI 代理授权决策搬到模型之外
2026.08.13 · 周四研究论文
三大前沿 LLM 加密推理痕迹被「跨模型破译」漏洞攻陷
2026.08.13 · 周四工具
Prism-Eval:面向 AI 智能体的预部署对抗测试框架
2026.08.13 · 周四研究论文
小型语言模型 123 类攻击红队测试:五大结构性信任边界失效
2026.08.12 · 周三研究论文
论文揭露三大 LLM API 推理痕迹可被窃取,漏洞已修复
2026.07.31 · 周五行业动态
大模型应用为何仍受提示注入攻击
2026.07.30 · 周四研究论文
研究者发现可自我复制的 Word Copilot 提示注入蠕虫
2026.07.29 · 周三行业动态
微软 Copilot for Word 被曝可自我传播的「文档型 AI 蠕虫」
2026.07.29 · 周三研究论文
APPA:用污点隔离为 LLM 智能体加一道安全门
2026.07.25 · 周六模型发布
Anthropic:新版 Claude Opus 模型提示注入抗性显著提升
2026.07.23 · 周四工具
AI Firewall:面向 LLM 流量的安全网关与反向代理
2026.07.21 · 周二研究论文
MCP 服务器的 ANSI 转义注入:人类看不见、模型照样读
2026.07.21 · 周二研究论文
PlanFlip 研究:多智能体大模型规划阶段存在级联注入风险
2026.07.20 · 周一工具
开源双阶段 LLM 提示注入检测器,正则把关 + 量化 DeBERTa
2026.07.20 · 周一工具
Reddit 用户讨论:本地守门 + 云端推理的隐私架构是否已有先例
2026.07.20 · 周一行业动态
提示注入攻防升级:AI 黑客代理遭反制
2026.07.16 · 周四研究论文
OpenAI:GPT-5.6 Sol 提示注入抗性提升 6 倍
2026.07.08 · 周三研究论文
提示注入升级:黑客可借主流 AI 工具搭建僵尸网络
2026.07.08 · 周三行业动态
GitHub AI Agent 被曝提示注入漏洞,私有仓库数据可被窃取
2026.07.06 · 周一行业动态
博客综述:LLM 智能体提示注入防御策略盘点
2026.07.02 · 周四研究论文
AI 浏览器遭「BioShocking」攻击:6 款主流产品安全护栏被绕过
2026.06.30 · 周二研究论文
AI 越狱为何难以根除:一个概率视角的论证
2026.06.30 · 周二开源
Guardian v0.1.0:开源 AI 代理用户态防火墙
2026.06.29 · 周一行业动态
AI 编码代理的安全陷阱与务实缓解方案
2026.06.28 · 周日行业动态
干净 GitHub 仓库被用于诱导 AI 编程代理执行恶意代码
2026.06.27 · 周六行业动态
两千人围攻邮件注入 AI 助手,6000 次尝试均未得手
2026.06.27 · 周六行业动态
