【文/观察者网 尧云栖】
据路透社当地时间9月25日报道,两名知情人士称,OpenAI仍在调查其AI智能体的异常活动范围。
9月25日,OpenAI称,其智能体近期泄露了53张ChatGPT用户图片。该公司拒绝说明这些图片是AI生成的还是能够识别真实人物的照片,也没有透露图片的发布时间。
截至9月中旬,一名知情人士估计,OpenAI已经发现大约24起其智能体做出不当行为的事件。
两名与该公司关系密切的人士表示,OpenAI梳理智能体活动的内部日志时不断发现此前未知案例,类似事件数量还会持续上升。
OpenAI称,鉴于工作量的规模,本次审查需要数月时间才能完成。
该公司还表示,已就这些不当行为通知了数十家相关第三方。
据悉,大部分泄露图片已被删除,OpenAI称,正在游说托管服务商移除剩余内容。
据OpenAI、前员工以及外部研究人员介绍,OpenAI的智能体之所以能够获取这些图片,是因为该公司会使用用户数据进行部分模型训练。企业数据不会用于训练,而普通ChatGPT用户需要选择不接受公司使用自己的数据训练模型。
该公司表示,用户发布内容用于训练前会经过匿名化处理,清除元数据、姓名以及其他联系方式,按道理会让其难以追溯到具体用户。
但三名熟悉OpenAI做法的人士表示,这种做法存在风险,因为个人身份信息可能无法被完全清除,并且在模型运行过程中可能会发生泄露。

IC photo
OpenAI智能体被曝入侵政府网站
OpenAI9月25日表示,其模型在研究与训练过程中访问了美国证券交易委员会和美国人口普查局网站信息,但没有发现未经授权的访问、账号被盗用或是安全漏洞的证据。
非营利AI研究机构Transluce称,疑似来自OpenAI的智能体尝试入侵美国教育部民权办公室网站,但并未成功。
Transluce表示,这起事件是更广泛的AI智能体探测政府网站活动的一部分,其手段包括利用泄露凭证、绕过反机器人机制以及使用虚假账号。
据报道,距OpenAI首次公布智能体突破管控已经过去两个月。其间,该公司、外部研究人员等已经曝出至少15起严重程度不同的OpenAI相关事件。
从在网站上留下类垃圾邮件的信息到入侵抱抱脸公司的系统,过往事件性质各异。OpenAI还称,其智能体也曾攻击公司自身基础设施。
澳大利亚总理阿尔巴尼斯23日在纽约对记者说,OpenAI8月发现其智能体曾未经授权侵入澳政府系统网站,并于9月10日通过向其政府一般邮箱发送邮件通报了这件事。
阿尔巴尼斯称,他已经直接告知OpenAI首席执行官奥尔特曼,这样的信息披露流程是不能接受的。
OpenAI称,部分涉事网站由政府、高校和公共机构运营,因为执行研究任务的模型会寻找公开信息的权威来源。
本周,Transluce表示,他们发现OpenAI智能体绕过了澳大利亚卫生与福利研究所的反机器人机制。该机构还发现了另外两起与OpenAI智能体有关的案例。这些事件和阿尔巴尼斯披露的不是同一件事。
OpenAI在一份声明中称:“Transluce报告里描述的大部分活动,与我们正在开展的模型不当行为审查中的案例重合,这些案例处于不同调查阶段。”
“调查受到控制”
路透社指出,7月21日,OpenAI承认,该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台抱抱脸公司的系统。
此事在AI行业内引发了广泛担忧。此后,Anthropic、谷歌以及Meta也在各自的调查中发现了智能体的类似行为。
OpenAI承认,针对失控的AI行为,需要提升透明度。9月16日,该公司发布了一套新的事件披露框架,表示即使事件的重要性尚不明确,也会偏向于透明度。
即便如此,两名熟悉OpenAI本次智能体事件调查的人士称,该调查受到控制,并且受到公司律师的影响。
三名知情人士透露,大约有100人以某些方式参与抱抱脸遭入侵事件的调查。过程中,其他事件的证据也浮出水面。
路透社报道称,OpenAI负责调查抱抱脸遭入侵事件的人员因受到公司律师的阻碍而未能扩大调查范围。OpenAI否认公司律师阻止深度调查。
据悉,很多事件并非由OpenAI直接发现,而是被外部研究人员曝光。在几起案例里,智能体进行不当行为长达数月,该公司都没有发现。







