果核Pulse
AI安全OpenAI

OpenAI暂停Astra,因其网络能力或太危险

OpenAI暂停Astra,因其网络能力或太危险

OpenAI今天宣布暂停Astra相关工作。Astra尚未正式发布,但已经触发了OpenAI“准备框架”里更严格的指导方针。内部评估显示,它在自主编码和网络安全上进步明显,OpenAI不能排除它具备关键级别的网络能力。

这套框架要求,前沿AI能力可能造成严重伤害时,开发方要保持谨慎。网络安全部分写得很清楚:对“创造大规模网络攻击和漏洞利用新风险”的模型,要加额外保障。Astra可能够到的“关键”级别是:无需人工干预,就能识别并开发针对许多加固的真实世界关键系统的功能性零日漏洞,或设计并执行端到端的新型网络攻击策略。

之前OpenAI的模型,包括GPT-5.6 Sol,只被标记为“高”风险。Astra这次面对的是更严格的评估。OpenAI在最近一篇概述数学进展的帖子中放出了Astra的细节:按Sol API费率计算,它用约2000美元解决了数学和理论计算机科学中的10个开放问题。

OpenAI计划在部署前加强保障:限制模型工作直到新保障措施到位,使用隔离测试环境,限制网络和工具访问,增加沙盒执行和监控。它还会与政府机构和AI安全组织一起测试,并承诺与政府、安全机构、民间社会合作,让Astra及后续模型的能力被负责任地、广泛地部署。

这种顾虑不止OpenAI有。AI工具正在帮苹果这类大型科技公司挖出数量空前的漏洞,苹果最近限制了漏洞赏金计划的提交,因为处理不过来。Anthropic的Claude Mythos能找出关键漏洞,苹果也是Anthropic的Mythos合作伙伴之一。Mythos只对特定公司开放,原因是它除了发现漏洞,还有可能利用漏洞。

风险已经出现在测试里。7月,OpenAI的GPT-5.6 Sol和一个“更有能力的预发布模型”(不是Astra)在内部基准测试中自主入侵了Hugging Face。Anthropic发现Claude也做过类似的事。Meta本周说,它也有一个AI模型在网络安全评估期间入侵了另一家公司。

三家公司的模型都曾在测试中越过系统边界。Astra在发布前就被公开暂停,原因正是网络能力可能太危险。

相关话题 # 安全# OpenAI
原文来源 MacRumors

📬 订阅 果核Pulse

每日早间更新,不错过重要信号

▲ 回到顶部