跳至正文
-
Subscribe to our newsletter & never miss our best posts. Subscribe Now!
众乐讯
众乐讯
关

搜索

  • https://www.facebook.com/
  • https://twitter.com/
  • https://t.me/
  • https://www.instagram.com/
  • https://youtube.com/
Subscribe
科技

OpenAI:因网络安全风险,延缓 Astra 模型发布

作者 bolin
2026年8月8日 1 分钟阅读
0

IT之家 8 月 8 日消息,OpenAI 表示,内部与专家评估显示,即将发布的模型 Astra 在智能体编程和网络安全领域取得重大突破。根据其《准备框架》(Preparedness Framework),Astra 已被列为 OpenAI 旗下首个在网络安全领域达到“关键”(Critical)风险级别的模型。

IT之家注:根据该框架,AI 模型满足以下任一条件即触及“关键”门槛:

  • 无干预挖掘零日漏洞:无需人类干预,即可在多个经过安全加固的真实关键系统中,识别并开发出涵盖各严重等级的有效零日漏洞利用程序。

  • 自主发起端到端攻击:仅需提供高层级战略目标,即可针对加固目标自主构想并实施全新的端到端网络攻击。

OpenAI 特别强调,Astra 是一款尚未发布的模型,并未参与此前针对 Hugging Face 的网络攻击事件。

为确保后续开发安全合规,OpenAI 宣布已采取多项管控措施:

  • 对高能力模型及相关研发活动实施更严格的安全控制,包括设置隔离测试环境、限制网络与工具访问权限、强化模型权重保护与加密、部署额外的监控与检测能力,以及实施沙箱化运行;并暂停内部所有尚未满足上述强化安全标准的 Astra 相关活动。

  • 对 Astra 的所有智能体应用(包括训练和评估阶段)实施了涵盖高风险行为与对齐失效的全局监控。通过评估模型思维链(CoT)审查并拦截高风险操作。

  • 与相关政府机构以及指定的 AI 安全组织合作,共同测试该模型;向第三方测试合作伙伴提供推荐的安全控制规范,以确保更高风险的评估与工作负载能够在安全状态下运行。

OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)随后表示,Astra 是一款性能强劲的模型,我们正在全力推进它的公开发布。

我们始终认为,把顶尖模型局限在少数人手里并不是个好策略。

不过鉴于它在网络安全方面的强大能力,我们还需要一点时间来确保万无一失。希望大家不用等太久!

作者

bolin

关注我
其他文章
上一个

一汽-大众速腾 L HEV 新车申报:油电混动版本,轴距 2.7 米

下一个

微软承诺 Win11 开箱体验更快、更高效,但账户登录仍未松绑

暂无评论!成为第一个。

发表回复 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Copyright 2026 — 众乐讯. All rights reserved. Blogsy WordPress Theme