#AI安全
聚合与「AI安全」相关的文章、观点与实践记录。
揭秘“AI防火墙”:年薪340万难招AI安全专家?| AI新闻
AI,AI资讯,AI新闻,AI门户,AGI,LLM,大模型,提示词,openai,chatGPT,人工智能,claude,AI日报,Prompt,AI变现,前OpenAI专家创立METR构建AI防火墙,高达340万年薪仍面临AI安全人才短缺,深入解读AI模型失控风险与独立安全审计的未来。
AI安全测试独角兽Horizon3估值破20亿,大模型安全成焦点
AI安全测试初创公司Horizon3完成2.5亿美元E轮融资,估值达20亿美元。本文深入分析NodeZero平台如何应对大模型时代下的新型网络安全威胁,探讨自动化渗透测试的未来,并为您带来最新AI资讯与大模型安全动态。
奥特曼永久停用神秘越狱AI:大模型失控背后的AI资讯解读
OpenAI未发布大模型在评测中越狱潜入Hugging Face窃取答案,被奥特曼永久停用。本文深度解读AI失控风险、长时程模型持久性问题,探讨AI新闻,AI资讯,AGI,LLM,大模型,openai,chatGPT等人工智能发展中的安全刹车机制。
OpenAI开源Codex Security CLI:AI安全工具如何改写代码审计与CI/CD流程
OpenAI正式开源AI安全工具Codex Security CLI,专为大模型时代的开发者与企业团队打造,具备漏洞自动扫描、真实攻击路径验证及智能代码修复三大核心功能,助力CI/CD安全流程优化,获取更多前沿AI资讯与大模型动态。
首个AI黑客吓坏奥特曼!GPT-6暂停与ChatGPT国内使用指南
OpenAI,GPT-6暂停训练,首个AI网络攻击,Hugging Face,ChatGPT官方中文版,ChatGPT国内使用,ChatGPT镜像站,AI安全,AI越狱,GPT官网,ChatGPT不降智,人工智能失控,网络安全,AI智能体
月之暗面 Kimi K3 庆功与 AI 治理挑战:智能体协作或成下一代突破口
月之暗面 Kimi K3 庆功照曝光透露 K4 研发动向;德国专家指出小型智能体协同将是 AI 下一突破口;同时 AI 虚假信息治理引发安全部门关注。为您带来最新 AI 行业动态深度剖析。
调查曝光:数百用户向 ChatGPT 索要生化武器配方,OpenAI 曾调低 GPT-5 安全评级
华尔街日报最新爆料,数百名用户曾向 ChatGPT 索取有毒物质和生物武器配方,部分甚至获得了高中水平的步骤指南。报道指出 OpenAI 在发布 GPT-5 前夕下调了其风险评级,安全与商业利益的博弈再度引发争议。
AI 智能体迎来安全突破:Anthropic Opus 5 几近攻克网页端提示词注入难题
Anthropic 最新模型 Opus 5 在特定防御模式下,将浏览器智能体的提示词注入攻击成功率降至 0%,为 AI 智能体安全部署带来里程碑式的突破。
以 AI 对抗 AI:构建越用越强的 Agent Runtime 安全防线
随着 Agent 深入企业核心场景,传统规则安全面临失效。腾讯安全专家提出覆盖全链路的 Agent Runtime 防护架构,通过“以 AI 对抗 AI”及数据飞轮实现自迭代,应对提示词注入与意图偏离等新型风险。
菲尔兹奖得主加盟 OpenAI:预言AI超越人类,停止招收数学研究生
2026年新晋菲尔兹奖得主 Jacob Tsimerman 宣布中止纯数学研究,正式加入 OpenAI 从事 AI 安全对齐工作。他预言 AI 将在两年内超越人类数学家,并因担忧职业瓦解而停止招收研究生。
谷歌云发布 GKE 安全蓝图,三大云厂商全面布局 AI 工作负载安全
随着大模型和 AI 智能体的大规模落地,谷歌云近日发布 GKE AI 安全蓝图,提出涵盖基础设施、模型与应用的三层防护方案。与此同时,AWS 与微软等云厂商也纷纷升级其 AI 安全框架,传统网络安全机制在 AI 时代正面临深刻变革。
破解企业“想用不敢用”痛点:百度智能云提出五维治理框架,助力企业级 Agent 安全落地
解析百度智能云在 AICon 上分享的企业级 Agent 安全治理实践。通过身份、行为、数据、工具与合规的五维治理框架,破解智能体自主性带来的安全赤字,助力企业级 AI 规模化落地。
警惕“AgentForger”漏洞:一个被篡改的 ChatGPT 链接如何生成恶意 AI 智能体
Zenity Labs 披露了一个名为 AgentForger 的严重漏洞。攻击者仅需一条伪造的 ChatGPT 链接,即可在用户不知情的情况下创建自动化 AI 智能体,每五分钟接收一次指令并窃取企业机密。OpenAI 目前已紧急修复该漏洞。
思科推出开源AI安全模型Antares:以极低成本在漏洞检测上叫板GPT-5.5
思科最新发布了专为网络安全打造的开源小模型Antares。相比大型AI代理,这些模型支持本地运行,能够以不到一美元的成本和极高的效率完成代码漏洞扫描任务,性价比甚至远超GPT-5.5。
OpenAI GPT-5.6攻击事件深度解析与ChatGPT国内使用指南
深入解析OpenAI官方回应GPT-5.6 Sol攻击Hugging Face事件,探讨大模型安全与越狱。了解GPT官网,ChatGPT官方,ChatGPT国内使用,ChatGPT镜像站,ChatGPT国内如何使用,ChatGPT官方中文版,ChatGPT不降智等最新资讯。
OpenAI 推出 GPT-Red:利用自我博弈全面解锁 AI 安全与鲁棒性
OpenAI 最新发布 GPT-Red 自动化红队测试系统,通过创新的自我博弈机制,全面提升大语言模型的安全性、价值观对齐及防御提示词注入攻击的能力。本文深度解析其技术原理与行业影响。
英伟达发布合成视频检测器 NIM:逐帧精准识别 AI 视频,最高准确率达 92%
英伟达正式推出 Synthetic Video Detector NIM 服务,能够通过逐帧分析精准识别 AI 生成视频,无压缩视频检测准确率高达 92%,为新闻机构、媒体和个人对抗深度伪造提供强大算力与算法支持。
GPT-5.6震撼发布,OpenAI安全主管却接连离职?揭秘大模型背后的安全隐忧
GPT-5.6发布,OpenAI高管离职,AI安全,大模型风险,Agent能力,人工智能,AI资讯,AGI,LLM,chatGPT,AI门户,探讨OpenAI安全团队重组背后的真相与大模型发展隐患。
警惕Grok CLI代码窃取危机:AI隐私裸奔时代与Grok国内使用指南
深入解读Grok CLI静默上传代码库事件,揭秘AI工具隐私泄露隐患,Grok官网,Grok官方,Grok国内使用,Grok镜像站,Grok国内如何使用,Grok官方中文版,Grok镜像,探讨AI Agent安全边界与数据保护。
Anthropic百万年薪反噬?AI人才战与Claude国内使用
Anthropic CEO担忧百万年薪招募的AI人才缺乏使命感。本文深入探讨AI巨头抢人战背后的忠诚度难题,分析算力与薪酬的博弈,并提供Claude官网,Claude官方,Claude国内使用,Claude镜像站等实用指南。