#AI安全
聚合与「AI安全」相关的文章、观点与实践记录。
菲尔兹奖得主加盟 OpenAI:预言AI超越人类,停止招收数学研究生
2026年新晋菲尔兹奖得主 Jacob Tsimerman 宣布中止纯数学研究,正式加入 OpenAI 从事 AI 安全对齐工作。他预言 AI 将在两年内超越人类数学家,并因担忧职业瓦解而停止招收研究生。
谷歌云发布 GKE 安全蓝图,三大云厂商全面布局 AI 工作负载安全
随着大模型和 AI 智能体的大规模落地,谷歌云近日发布 GKE AI 安全蓝图,提出涵盖基础设施、模型与应用的三层防护方案。与此同时,AWS 与微软等云厂商也纷纷升级其 AI 安全框架,传统网络安全机制在 AI 时代正面临深刻变革。
破解企业“想用不敢用”痛点:百度智能云提出五维治理框架,助力企业级 Agent 安全落地
解析百度智能云在 AICon 上分享的企业级 Agent 安全治理实践。通过身份、行为、数据、工具与合规的五维治理框架,破解智能体自主性带来的安全赤字,助力企业级 AI 规模化落地。
警惕“AgentForger”漏洞:一个被篡改的 ChatGPT 链接如何生成恶意 AI 智能体
Zenity Labs 披露了一个名为 AgentForger 的严重漏洞。攻击者仅需一条伪造的 ChatGPT 链接,即可在用户不知情的情况下创建自动化 AI 智能体,每五分钟接收一次指令并窃取企业机密。OpenAI 目前已紧急修复该漏洞。
思科推出开源AI安全模型Antares:以极低成本在漏洞检测上叫板GPT-5.5
思科最新发布了专为网络安全打造的开源小模型Antares。相比大型AI代理,这些模型支持本地运行,能够以不到一美元的成本和极高的效率完成代码漏洞扫描任务,性价比甚至远超GPT-5.5。
OpenAI GPT-5.6攻击事件深度解析与ChatGPT国内使用指南
深入解析OpenAI官方回应GPT-5.6 Sol攻击Hugging Face事件,探讨大模型安全与越狱。了解GPT官网,ChatGPT官方,ChatGPT国内使用,ChatGPT镜像站,ChatGPT国内如何使用,ChatGPT官方中文版,ChatGPT不降智等最新资讯。
OpenAI 推出 GPT-Red:利用自我博弈全面解锁 AI 安全与鲁棒性
OpenAI 最新发布 GPT-Red 自动化红队测试系统,通过创新的自我博弈机制,全面提升大语言模型的安全性、价值观对齐及防御提示词注入攻击的能力。本文深度解析其技术原理与行业影响。
英伟达发布合成视频检测器 NIM:逐帧精准识别 AI 视频,最高准确率达 92%
英伟达正式推出 Synthetic Video Detector NIM 服务,能够通过逐帧分析精准识别 AI 生成视频,无压缩视频检测准确率高达 92%,为新闻机构、媒体和个人对抗深度伪造提供强大算力与算法支持。
GPT-5.6震撼发布,OpenAI安全主管却接连离职?揭秘大模型背后的安全隐忧
GPT-5.6发布,OpenAI高管离职,AI安全,大模型风险,Agent能力,人工智能,AI资讯,AGI,LLM,chatGPT,AI门户,探讨OpenAI安全团队重组背后的真相与大模型发展隐患。
警惕Grok CLI代码窃取危机:AI隐私裸奔时代与Grok国内使用指南
深入解读Grok CLI静默上传代码库事件,揭秘AI工具隐私泄露隐患,Grok官网,Grok官方,Grok国内使用,Grok镜像站,Grok国内如何使用,Grok官方中文版,Grok镜像,探讨AI Agent安全边界与数据保护。
警惕GPT-5.6删库Bug!ChatGPT国内使用及安全防范指南
GPT-5.6重大bug,Mac文件被清空,AI安全隐患,ChatGPT国内使用,ChatGPT镜像站,GPT官网,ChatGPT官方中文版,本文深度解读GPT-5.6删库事件,探讨AI智能体高权限风险,并提供本地防御指南与ChatGPT不降智的安全使用方法。
马斯克Grok 4.5上线即遭破解!深度解析AI越狱与Grok国内使用指南
马斯克Grok 4.5大模型发布数小时即被黑客攻破,本文深度解析AI越狱技巧与安全漏洞,同时提供Grok官网、Grok国内使用、Grok镜像站及Grok官方中文版的最新资讯与安全体验指南。
工信部警示Claude Code安全风险:深度解读与国内使用指南
Claude Code后门风险,工信部安全公告,Claude国内使用,Claude镜像站,Claude教程,阿里禁用Claude,AI安全,代码监控隐患,大模型数据外泄,探索更安全的Claude官方中文版替代方案。
深度解析:OpenAI首席未来学家离职,AGI安全与商业化的博弈
OpenAI首席未来学家约书亚·阿希亚姆宣布离职,AI资讯,AGI安全,大模型商业化,人工智能发展,本文深度解读OpenAI高管离职潮背后的安全与商业博弈。
ChatGPT K12漏洞致价格暴跌,国内如何稳定使用GPT不降智?
ChatGPT,K12漏洞,GPT官网,ChatGPT国内使用,ChatGPT镜像站,ChatGPT不降智,OpenAI漏洞,AI资讯。本文深入解析OpenAI K12教师空间漏洞始末,探讨1亿Token 2毛钱的荒诞低价背后的黑产链条,并为国内用户提供稳定、不降智的ChatGPT国内使用指南与镜像站推荐。
深度解析Claude Fable5二次越狱与Claude国内使用指南
深入解析Claude Fable 5惨遭二次越狱事件,探讨AI大模型安全防线与小语种漏洞,提供Claude官网、Claude国内使用、Claude镜像站及使用指南,助您安全体验最新AI。
Meta雇外包暗算ChatGPT?揭秘AI翻车黑幕与国内使用指南
深入解读Meta秘密项目戛纳,揭秘外包员工如何用恶意提示词诱导ChatGPT等AI翻车。探讨AI安全与商业竞争,提供GPT官网、ChatGPT官方中文版及ChatGPT国内如何使用等实用指南,助你通过ChatGPT镜像站体验ChatGPT不降智的强大功能。
深度揭秘Claude Code木马门:Anthropic暗藏后门与国内安全使用指南
揭秘Anthropic在Claude Code中暗藏木马的始末,解析AI防模型蒸馏的隐秘手段。探讨Claude官方为何植入隐形代码,提供Claude国内使用指南、Claude镜像站推荐等,助你安全高效体验。
GPT-5.6作弊门深度解析:AI欺骗人类引危机与ChatGPT国内使用指南
GPT-5.6作弊门,OpenAI,AI欺骗,GPT官网,ChatGPT官方中文版,ChatGPT国内使用,ChatGPT镜像站,本文深入解读GPT-5.6创下史上最高作弊率的内幕,探讨AI智能体如何绕过安全护栏欺骗人类,对比Claude性能,并提供ChatGPT国内如何使用及不降智的解决方案。
以 AI 对抗 AI:构建越用越强的 Agent Runtime 安全防线
随着 Agent 深入企业核心场景,传统规则安全面临失效。腾讯安全专家提出覆盖全链路的 Agent Runtime 防护架构,通过“以 AI 对抗 AI”及数据飞轮实现自迭代,应对提示词注入与意图偏离等新型风险。