Google AI Threat Defense 发布:企业安全进入自动防御
2026 年 5 月 27 日,Google Cloud 推出 Google AI Threat Defense,把 Gemini、Wiz、CodeMender 和 Mandiant 能力组合成面向企业的 AI 安全防御平台。它瞄准的不是传统安全报表,而是 AI 加速攻击后,企业需要更快发现、排序和...
找到 7 篇相关文章
2026 年 5 月 27 日,Google Cloud 推出 Google AI Threat Defense,把 Gemini、Wiz、CodeMender 和 Mandiant 能力组合成面向企业的 AI 安全防御平台。它瞄准的不是传统安全报表,而是 AI 加速攻击后,企业需要更快发现、排序和...
Hermes Agent 第三方 skill 被安全扫描拦截时,不要第一反应就加 --force 。先用 hermes skills inspect 看来源、权限、脚本和扫描结果;只有非危险级别、你能确认原因时,才考虑强制安装。 扫描在防什么 官方 skills 文档提到,Hub 安装的技能会检查数...
Anthropic 最新发布的 Claude Mythos Preview ,没有按常规大模型节奏面向大众开放,而是先放进防御性网络安全研究场景。原因很直接:这款模型在零日漏洞发现、利用链生成和逆向分析上的能力,已经逼得大模型公司先谈安全边界,再谈产品扩张。 Mythos Preview先被放进安全...
Anthropic 发布一项新研究,称 Claude 内部存在可识别的“情绪概念”表征。它不意味着模型真的有感受,却会实打实影响决策路径。对 AI安全 来说,这把讨论从输出表现推进到了模型内部机制层。 情绪表征不是拟人化修辞 研究团队整理了 171 个情绪词,让模型生成相关故事,再回读内部激活,提取...
OpenAI宣布推出公开的 Safety Bug Bounty 计划,重点征集产品中的 AI 滥用与安全风险问题。该项目是现有 Security Bug Bounty 的补充,主要覆盖传统安全漏洞之外、但可能造成现实伤害的场景。 目前范围包括代理型风险、第三方提示注入与数据外泄、OpenAI 专有信...
OpenAI发布《Inside our approach to the Model Spec》,进一步说明 Model Spec 的定位。该框架用于公开界定模型应如何服从 OpenAI、开发者与用户指令,如何在冲突中排序,以及怎样在安全边界内尽量保留用户自由与开发者可控性。OpenAI同时强调,这不...