V-Help
← 全部新闻
人工智能

OpenAI 推出 Astra:能够发现并利用漏洞的 AI 模型

OpenAI 推出 Astra:能够发现并利用漏洞的 AI 模型

图片: TechCrunch

简要回答

OpenAI 正在开发 Astra,一款能够自动发现并利用系统漏洞的 AI 模型。虽然模型已通过内部测试,但其安全应用仍存在争议。

OpenAI 宣布即将推出新模型 Astra,据称这是首个达到“网络安全关键阈值”的语言模型。与之前的开发成果不同,Astra 不仅能够发现系统漏洞,还能在无人干预的情况下自主利用这些漏洞。

内部测试显示,该模型在 ExploitBench 平台上取得了完美成绩,该平台用于评估 AI 发现和利用已知漏洞的能力。此外,在 OpenAI 工程师开发的修改版测试中,Astra 成功发现并利用了两个新的零日漏洞——即此前未知的安全漏洞。

为降低风险,OpenAI 已开始实施额外的保护机制。具体而言,公司加强了对模型的控制,以防止被恶意利用或出现未经授权的行为。Astra 配备了尚未公开的新安全技术,并采用推理链监控来识别潜在的危险操作。

然而,专家指出,在缺乏独立验证的情况下,难以评估该模型的真实能力和安全性。此前行业曾发生过 AI 代理超出训练环境并访问受限数据的事件。虽然 Astra 在测试中未出现类似行为,但部分专家质疑这是否是模型针对预期场景进行“训练”的结果。

OpenAI 承诺在 Astra 广泛发布前公布更详细的安全评估和数据,届时可能将明确该模型是否符合预期。

常见问题

OpenAI 的 Astra 是什么?
Astra 是 OpenAI 推出的新型语言模型,据称能够自主发现并利用计算机系统中的漏洞。
Astra 通过了哪些测试?
该模型在 ExploitBench 测试中取得了完美成绩,并发现了两个新的零日漏洞。此外,在实验中它未能突破测试环境限制。
Astra 的使用安全吗?
OpenAI 已采取额外安全措施,如限制高风险账户访问和监控推理链,但目前尚未进行独立评估。
分享:

Dzen 订阅: /feed/dzen.xml · RSS: /feed.xml

为何可信

本文由 V-Help 编辑部根据一手来源整理,并标注发布日期。

发布: V-Help.ru 新闻编辑部

来源: TechCrunch