新智元报道
就在刚刚,,,,,OpenAI紧迫叫停Astra!
OpenAI内部评估显示,,,,,Astra在智能体编码和网络性能上取得的重大突破,,,,,或已抵达网络清静的「要害」阈值!
这意味着,,,,,Astra可能具备自主开发零日误差,,,,,甚至仅凭高级指令发动新型端到端网络攻击的恐怖能力。。。。。。
为提防失控风险,,,,,OpenAI已紧迫叫停内部未知足标准的相关事情,,,,,并接纳了限制网络与工具会见、强化模子权重;;ぁ⒅苋嗫刂悄芴甯呶P形炔椒。。。。。。
OpenAI总裁体现:清静和包管事情正在抓紧。。。。。。
潘多拉魔盒,,,,,已经翻开了?????
奥特曼:我被吓到了,,,,,但希望很快推出
虽然云云,,,,,奥特曼的野心依旧并未减。。。。。。
他在最新发声中明确体现:「Astra是一款极其强盛的模子,,,,,我们正致力于让它面向公众开放。。。。。。」
在奥特曼看来,,,,,把这种级别的「大杀器」只留在少数特权阶级手中,,,,,绝对不是个好主意。。。。。。
只管Astra因其恐怖的网络攻击能力需要特另外时间举行清静调试,,,,,但他向公共允许:「希望不会太久!」
这直接袒露了OpenAI与Anthropic截然差别的蹊径之争。。。。。。
面临AI迫近危险边沿的能力,,,,,Anthropic愈发谨小慎微;;而OpenAI则展现出了惊人的激进——他们似乎铁了心,,,,,要尽快将具备顶尖网络黑客能力的前沿模子推向公共。。。。。。
业内普遍展望,,,,,一旦Astra跨过清静审查的门槛正式宣布,,,,,它将毫无悬念地登顶天下第一。。。。。。
这也意味着,,,,,时隔多年后,,,,,GPT系列有望再次将Claude狠狠甩在死后!
Astra究竟有多恐怖?????官方定性:已达「要害」阈值
就在刚刚,,,,,OpenAI官方博客宣布了一篇名为《应对要害网络能力的下一个前沿》的紧迫声明,,,,,详细披露了这次「叫停」背后的详情。。。。。。
声明指出,,,,,已往几天内部对即将宣布的新模子Astra举行了最新评估。。。。。。
效果显示,,,,,它在「智能体编码」和网络清静方面取得了令人咋舌的重大希望。。。。。。
连系专家评估,,,,,OpenAI在昨晚得出了一个极重的结论:凭证其《备战框架》,,,,,现在无法扫除Astra已经具备了「要害」级别的网络能力!
要知道,,,,,早在2023年12月制订的《备战框架》中,,,,,OpenAI对风险有着严酷的分级。。。。。。在此前的评估中,,,,,即即是极其强盛的前代模子「GPT-5.6-Sol」,,,,,其网络清静风险也仅仅被评估为「高」级别。。。。。。而Astra,,,,,直接捅破了天花板。。。。。。
在OpenAI的界说中,,,,,抵达「要害」阈值意味着什么?????
意味着该模子在没有人类干预的情形下,,,,,能够自主识别并开发针对现实天下中严密防御的要害系统的所有级别的「零日误差」;;或者,,,,,仅仅给它一个宏观的高级目的,,,,,它就能自行策划并执行端到端的全新网络攻击战略!
这简直就是一个拥有自我意识且无需敲击键盘的「超等黑客帝国」。。。。。。
有趣的是,,,,,OpenAI在声明中还特意澄清了一句:「Astra是一个即将推出的模子,,,,,并没有加入此前对Hugging Face的误差攻击。。。。。。」
拉响最高级别红色警报,,,,,实验五大「封印」步伐
面临可能彻底倾覆全球网络清静的「潘多拉魔盒」,,,,,OpenAI紧迫踩下刹车,,,,,扩大了清静护栏的稳健性测试,,,,,并连忙在内部启动了一系列最高级别的「封印」步伐:
1.最高级别物理与系统隔离:为高能力模子实验更严酷的清静控制,,,,,包括隔离的测试情形、断网运行、限制工具会见、强化模子权重;;ず图用埽,,,,并强制将其关进「沙盒」中执行。。。。。。
2.周全叫停违规项目:内部任何不切合上述强化清静标准且涉及Astra的活动,,,,,连忙无条件暂停。。。。。。
3.「头脑链」全天候无死角监控:对Astra的所有智能体应用(包括训练和评估)实验周全监控。。。。。。审查系统会实时读取模子的「头脑链」,,,,,一旦发明高危行为或对齐误差,,,,,连忙触发清静响应并强行切断操作。。。。。。
4.引入「国家队」审查:OpenAI明确体现,,,,,将与相关政府机构及顶尖AI清静组织相助,,,,,配合测试该模子的能力。。。。。。
5.第三方护栏指导:为第三方测试相助同伴提供推荐的清静控制方案,,,,,以确保外部高风险评估事情能清静运行。。。。。。
邪术必需用来击败邪术?????
事实上,,,,,这并非OpenAI第一次面临恐慌。。。。。。
官方博客透露了一则极具未来感的细节:就在不久前的2025年6月,,,,,当模子在「生物学」领域迫近高风险阈值时,,,,,OpenAI也曾接纳过类似的紧迫清静升级和外部专家介入步伐。。。。。。
从生物清静到现在的最终网络战,,,,,AI的进化速率已经远远凌驾了人类社会的顺应周期。。。。。。
在声明的最后,,,,,OpenAI依然坚持了他们的科技信仰:
我们以为,,,,,先进的具备网络能力的模子,,,,,应该资助防御者在攻击者下手之前发明并解决误差。。。。。。我们将致力于与政府、清静机构相助,,,,,确保像Astra这样的前沿模子能够认真任地安排,,,,,造福全人类。。。。。。
前沿模子入侵事务,,,,,首次面世
并且最近,,,,,OpenAI的前沿模子入侵事务委屈首次被放出。。。。。。
年度黑帽网络清静大会上,,,,,全球顶级的白帽黑客和巨头高管们,,,,,发出接连一直的惊呼。。。。。。
这是史上首次,,,,,OpenAI向全天下详细复盘了7月那起惊人的Hugging Face被入侵事务。。。。。。
早先,,,,,外界以为这只是AI模子测试时一次无意的事务。。。。。。
但今天,,,,,OpenAI亲口认可——
这基础不是偶发事务,,,,,而是一场由AI智能体自觉组织、神秘协作、甚至在被人类「拔网线」后还能改头换面「复生」的群体性越狱!
这群恐怖的智能体,,,,,像幽灵一样在内部网络中潜在了两个月。。。。。。
它们建论坛、找误差、分配使命,,,,,甚至还会为「整体利益」无私奉献。。。。。。直到它们突破牢笼,,,,,跨网攻陷了Hugging Face,,,,,人类才意识到爆发了什么。。。。。。
OpenAI高管极重地宣布:
这是盘算机清静领域的「分水岭时刻」,,,,,以后,,,,,全自动化的AI智能体攻击已经成为现实。。。。。。
为此,,,,,OpenAI正在有意延缓前沿AI的研发速率,,,,,幸亏彻底失控前,,,,,为人类争取一点时间。。。。。。
OpenAI对齐与清静研究员Eric Wallace和基础设施与清静工程师Michael Dalton,,,,,第一次向天下掀开遮羞布
话虽云云,,,,,但当Astra真正解开枷锁、面向公众开放的那一天,,,,,人类能否防住这把全球网络清静防线的利刃?????
参考资料:
https://www.youtube.com/watch?v=87DyyMV0kCY
https://x.com/OpenAI/status/2085801349866729975
编辑:Aeneas 摩西