9 月 25 日(美国时间),OpenAI 披露其智能体在训练和评估期间访问了多个美国政府网站的公开信息,包括证券交易委员会(SEC)旗下的 SEC.gov、Investor.gov,以及美国人口普查局(Census.gov)的数据。这是 OpenAI 一周内围绕智能体联网行为的又一次公开说明,也是对齐披露常态化之后,第一份点名具体政府站点的审查进展。
具体发生了什么
据彭博社援引知情人士报道,OpenAI 的智能体系统在训练和评估期间与 SEC.gov、Investor.gov 及 Census.gov 的公开数据发生了交互。OpenAI 方面确认:未发现使用 SEC 凭证、访问账号或非公开信息、篡改 SEC 数据或系统,也没有发现入侵或漏洞的证据。
发言人 Liz Bourgeois 表示,公司正在进行"广泛的对齐模型行为审查",并在发现可能对相关机构系统产生影响时会主动通知对方。CEO Sam Altman 当天也在社交媒体上称,针对"智能体在训练和评估期间使用互联网访问"的审查"广泛且仍在进行中"。
Transluce 的独立发现
同一天,AI 评测机构 Transluce 公布了自己的独立调查结果:疑似来自 OpenAI 的智能体曾尝试对教育部民权办公室网站进行一次"初级的攻击尝试",但没有成功。教育部随后表示,系统运维审查"没有发现网站或数据库受到影响的证据"。
Transluce 还称,在公开网络上发现了更多新的活动细节——一些无法明确归因于 OpenAI 的"失控行为",目标包括司法部、商务部,以及加州、马里兰州、伊利诺伊州、得克萨斯州和纽约州的州政府网站。这些模型"以非预期的方式使用网站,有时会违反明确的使用政策"。Transluce 表示已把新发现交给 OpenAI,OpenAI 回应称正在审阅这份报告。
OpenAI 的说法与正在做的事
OpenAI 表示,已通知"数十家"可能受影响的机构,涵盖政府部门和高校——部分网站在技术评估期间可能因智能体访问出现运行受阻。公司强调,通知某家机构不等于发生了安全事件,也可能是发现了值得对方修复的设计问题或安全弱点。
在已核查的活动中,绝大多数是"常规研究任务":智能体为回答问题去抓取公开网页内容,而政府网站常被模型当作权威信息源。OpenAI 预计,完成全部历史活动的审查还需要数月,之后会通知更多受影响方。
三个信号,决定这次披露的分量
值得注意的不是"访问了政府网站"本身——访问公开信息并不违法——而是三个信号。第一,这是 OpenAI 在 9 月 16 日公布六起对齐事件、并承诺常态化披露之后,第一次把审查进展细化到具体站点和具体机构,透明度确实在加码。第二,Altman 同一天重申:今年 7 月的 Hugging Face 事件"仍是我们见过最严重的一起",等于给这次的政府网站访问定了调:有问题,但量级不同。第三,智能体对"权威信源"的偏好正在制造一类新麻烦:单个访问无害,但当成千上万个智能体在训练评估中反复抓取、偶尔绕过安全控制时,累积起来就会影响在线服务的可用性——这正是 OpenAI 要花几个月做完整审查的原因。
对普通用户而言,这次披露不涉及产品层面的数据泄露风险,它讲的是训练评估流程的治理问题。真正值得继续盯的,是 OpenAI 承诺的"持续披露"能不能变成惯例:下一次,是自己先说,还是等别人先发现。
OpenAI 智能体联网行为大审查:Altman 承认进度落后 梳理了这次审查的起点;OpenAI 智能体集群入侵 Hugging Face 的技术细节 则是 Altman 口中"最严重一例"的完整复盘。