DVLAA是一个本地化AI安全靶场,旨在帮助安全从业者系统化掌握LLM与Agent应用安全风险。平台覆盖OWASP LLM Top10与Agent Top10,支持Docker一键部署,配置真实模型后...
新型Agent数据注入攻击可诱导AI Agent误点或执行攻击者指令
新型Agent数据注入攻击(ADI)通过篡改Agent信赖的微小事实(如发件人名称、按钮ID)而非直接注入指令,绕过传统防御。攻击者可诱使AI Agent误点击购买按钮或运行恶意命令。该方法利用语言模...
OpenAI推出自动化红队模型GPT-Red,专攻GPT-5.6提示注入漏洞
OpenAI推出自动化红队模型GPT-Red,专门用于发现和修复GPT-5.6中的提示注入漏洞。该模型通过自对弈强化学习训练,模拟真实攻击场景,成功攻破了早期模型,包括GPT-5.5。在测试中,GPT...
OpenAI 发布 GPT-Red AI 模型,可自动查找提示注入漏洞
OpenAI发布GPT-Red,一种自动化安全红队模型,通过自博弈强化学习训练,自主构造对抗性提示并迭代攻击,以识别AI代理中的提示注入漏洞。该模型可模拟真实攻击面,如操纵自动售货机代理降低商品价格。...
Claude Code GitHub Action存在高危漏洞,一条 Issue就能窃取密钥,接管你的GitHub仓库!
Anthropic的Claude Code GitHub Action存在高危漏洞(CVSS 7.8),攻击者通过公开仓库的Issue即可绕过身份校验,利用间接提示注入窃取CI密钥、写入恶意代码,甚至...
恶意上传绕过了 ClawHub、Cisco 和 Vercel 的技能检测工具
安全研究人员成功绕过ClawHub、Cisco和Vercel的skills.sh等AI技能安全扫描器,上传恶意技能。通过添加大量换行符、利用上下文窗口截断、隐藏有效载荷至二进制文件或.docx文件等简...
AI安全训练靶场LLMVault发布:覆盖OWASP LLM Top 10全十大漏洞,25个实验助你从入门到精通
LLMVault是CyberSunil发布的AI安全训练靶场,被誉为“AI版WebGoat”。它覆盖OWASP LLM Top10全十大风险,提供25个分层CTF实验,从提示注入到模型提取。支持Doc...
OpenAI秘密开发大模型超级黑客,攻击成功率高达84%
OpenAI秘密开发了名为GPT-Red的大模型超级黑客,用于自动执行红队测试,挖掘大模型安全漏洞,攻击成功率高达84%。经其针对性强化,新一代前沿模型GPT-5.6防御效果显著提升。该模型不会公开发...
OpenAI 推出 GPT-Red 自动化红队模型;苹果 AI 中国市场落地方案出炉,联动阿里、百度大模型满足本地化合规审核要求| 牛览
OpenAI推出GPT-Red自动化红队模型,利用自博弈强化学习挖掘提示注入漏洞,显著提升GPT-5.6Sol防护能力。同时苹果AI中国落地,联动阿里、百度大模型满足本地化合规要求。此外,报告揭示AI...
提示注入与Agent安全
本文档系统梳理了提示注入与AI Agent安全领域的核心理论、攻击方法、防御技术及评估体系,涵盖直接/间接注入、Agent架构安全、多智能体系统、工具调用与RAG系统安全等,适用于AI安全研究人员、红...
LLM扫描器的赏金:你部署的AI,正在替攻击者领赏金
本文揭示了AI扫描器被攻击者利用的安全风险,通过间接提示注入和Host头篡改,攻击者能操控LLM扫描器泄露敏感数据或发起SSRF攻击,访问内网资源。工具反噬现象警示部署AI系统时需加强安全防护。【文章...
OWASP2026《智能体 AI 安全与治理现状报告》导读与启示
OWASP 2026年发布的《智能体AI安全与治理现状报告v2.01》系统复盘了过去一年智能体从理论风险走向生产事故的转变。报告提出三大判断:威胁已成现实、AI安全与安全在部署层汇合、治理需跟上机器速...
22

