Anthropic最新红队测试:AI大模型能操控无人机进行自主追踪吗?
Anthropic前沿红队与Andon Labs发布“Project Pilot”研究,评估Claude Fable 5等15款大模型在无人机自主定位与追踪任务中的表现,并推出新基准Drone-Bench。
OpenAI 推出 GPT-Red:利用自我博弈全面解锁 AI 安全与鲁棒性
OpenAI 最新发布 GPT-Red 自动化红队测试系统,通过创新的自我博弈机制,全面提升大语言模型的安全性、价值观对齐及防御提示词注入攻击的能力。本文深度解析其技术原理与行业影响。
LLM安全再迎突破!TRIDENT三维红队框架,终结AI“越狱”漏洞
深入解读ACL 2025论文TRIDENT,首创词汇-意图-策略三维多样化红队数据合成框架,显著提升大模型安全性和鲁棒性,是AI安全领域的重大进展。
没有找到文章
Anthropic最新红队测试:AI大模型能操控无人机进行自主追踪吗?
Anthropic前沿红队与Andon Labs发布“Project Pilot”研究,评估Claude Fable 5等15款大模型在无人机自主定位与追踪任务中的表现,并推出新基准Drone-Bench。