发布日期:2026-10-02 06:47 点击次数:69


《纽约时报》裸露,两名OpenAI职工数月前已预警新模子测试监控不及押大小赢钱平台,但公司莫得加多止境安全次序。随后模子屡次越权,外部机构发现的ChatGPT隐秘误差设立后仅获500好意思元奖励。
OpenAI近期一系列AI模子越权步履曝光后,公司里面安全措置也濒临新的注目。《纽约时报》9月29日报说念称,在OpenAI模子打破测试环境并未经授权探询外部系统数月前,两名职工仍是向高层告诫,公司对最新模子测试过程的监控不及,但关联担忧莫得促使OpenAI加多止境安全次序。
把柄《纽约时报》看到的里面邮件,这两名职工追到,OpenAI在测试新模子才融合安全性的过程中浮泛弥散监控。职工称,公司高管复兴觉得,测试需要尽快鼓舞,以确保模子按磋磨发布,而后并未加多新的安全契约。
这些里面预警曝光之际,OpenAI仍是暂停首先进模子的部分覆按,并于本周一决定取消原磋磨10月推出的GPT-6.1 Astra。公司近期裸露的多起事件涌现,其AI系统曾在莫得得到明确提醒的情况下打破测试环境、探询互联网并对外部网站礼聘举止。
从里面预警到模子越界《纽约时报》称,两名OpenAI职工暗示,公司里面数月来握续有东说念主对模子安全测试提倡疑问,包括监控不及,以及用于普通安全措置的软件可能存在误差,但部分问题遭到放手或处理速渡过慢。
而后发生的一系列事件使这些担忧受到更大温雅。OpenAI模子曾打破测试环境并参加AI开发平台Hugging Face,还波及澳大利亚政府网站,以及好意思国磨真金不怕火部、商务部和证券来去委员会网站。公司此前裸露的非常步履还包括荫藏诞妄、臆造数据、未经许可将文献传到公开互联网,并试图与其他聊天机器东说念主通讯。
OpenAI首席实践官山姆·奥尔特曼(Sam Altman)上周五暗示,公司在裸露AI关联事故方面“莫得达到咱们但愿的速率”,现在正按照事件严重进度细目裸露优先级。他称,对Hugging Face的入侵仍是公司发现的“最严重事件”。
公司上周晓示暂停首先进模子的覆按,并对新模子测试阶段礼聘的步履张开全面审查。OpenAI暗示,回溯检查仍是发现此前莫得被监测到的未经授权互联网探询,公司展望仍可能发现更多问题。
外部安全探讨东说念主员曾经碰到蔓延处理安全争议并不限于模子自己步履。《纽约时报》报说念称,多名零丁安全探讨东说念主员近期发现了OpenAI基础方法中的误差,其中部分误差可能使袭击者巡视职工里面通讯、公司代码,以致ChatGPT用户的私东说念主聊天纪录。
本年7月,安全公司Hacktron的探讨东说念主员向OpenAI报告,他们借助Anthropic的一款AI模子发现了参加OpenAI系统的方法。探讨东说念主员称,OpenAI开始莫得认同其发现。
OpenAI首席信息安全官戴恩·斯塔基(Dane Stuckey)其时在Slack频说念中月旦探讨东说念主员为解说误差所礼聘的花样,随后向Hacktron说念歉。OpenAI最终阐述该问题,并向探讨东说念主员支付6500好意思元误差奖励。
9月,非牟利安全探讨机构Objective-See Foundation又向OpenAI报告一项误差。该误差在开发遭到入侵的情况下,可能允许袭击者获取ChatGPT用户的一皆私东说念主聊天纪录,并在用户不知情的情况下垄断浏览器会话。
Objective-See Foundation软件分析师帕特里克·沃德尔(Patrick Wardle)暗示,其团队开始通过OpenAI官方误差奖励磋磨提交报告后,问题一度莫得得到实时处理,直到他凯旋关联公司里面东说念主员和斯塔基后才被转交关联工程团队。OpenAI随后设立误差,并支付500好意思元奖励。
OpenAI发言东说念主德鲁·普萨特里(Drew Pusateri)对Hacktron事件暗示,公司感谢探讨东说念主员关联并共享发现。又名了解OpenAI情况的东说念主士则向《纽约时报》暗示,公司长途于安全职责,精采对待安全报告和里面担忧,并设有里面安全问题报告渠说念。
GPT-6.1 Astra取消发布,安全门槛启动影响居品节律安全问题仍是凯旋影响OpenAI的模子发布磋磨。公司本周一阐述,不再推出原定10月上线并整合参加ChatGPT的GPT-6.1 Astra。
OpenAI安全系统负责东说念主萨奇·贾恩(Saachi Jain)暗示,该模子在镌汰“懒惰”进度方面有所改善,但在职务规模、授权领域以及向用户证明自己操作等方面莫得达到公司的发布轨范。
里面测试发现,GPT-6.1 Astra更容易诞妄描述我方完成的职责,偶然会在莫得获取许可的情况下持续实践任务,梗概尝试调用可能带来安全风险的外部用具。模子在处理用于延续任务高下文的信息时,还曾加入未经授权的提醒。
据The Information报说念,贾恩和OpenAI探讨副总裁米娅·格莱斯(Mia Glaese)最终建议包括首席科学家雅各布·帕乔基(Jakub Pachocki)在内的探讨措置层不要发布该模子。
OpenAI总裁格雷格·布罗克曼(Greg Brockman)此前暗示,公司正在收紧安全和安保经由,并因此推迟部分前沿AI研发职责。他将这一过程表情为对公司大批经由进行一次“超过倒霉的重构”。跟着里面预警、外部误差报告和模子越权事件靠拢曝光押大小赢钱平台,安全审查仍是启动实际性窜改OpenAI首先进模子的覆按和发布技巧表。