返回 AI 情报
模型精选 812026-09-04 02:01Lucas RopekTechCrunch:AI(RSS)

OpenAI 发布新模型 Astra,主打计算机与浏览器操作但因 opaque recurrence 引发争议

OpenAI launches Astra, its powerful (and controversial) new model

精选理由

原文梳理了 Astra 的能力主张、发布节奏,以及 opaque recurrence 引发的可监控性争议,信息较为完整。

AI 摘要

OpenAI 发布最新模型 Astra,称其为迄今最强大模型,主打计算机和浏览器操作,先面向 Daybreak 网络安全计划客户开放,随后一周内覆盖 Pro、Plus、Enterprise、Business 付费账户及 API。

正文 · AI 翻译

OpenAI 于周四发布了 Astra,这是其最新的人工智能模型,据该公司称,也是其迄今最强大、能力最出众的模型。

OpenAI 声称,Astra 代表了“计算机和浏览器使用领域的新前沿”,并且能够以无与伦比的“速度、准确性和安全性”处理任务。

该模型于周四向使用其网络安全项目 Daybreak 的 OpenAI 客户开放。在未来一周内,它也将通过 OpenAI 的付费套餐(包括 Pro、Plus、Enterprise 和 Business 账户)以及其 API 提供。

在周四与记者的电话会议中,OpenAI 总裁 Greg Brockman 表示,Astra 是公司“最智能,并且同样重要的是,迄今对齐程度最高的模型”。他补充说,它“汇集了我们多年的研究和重大押注,每一项突破都建立在上一项之上”,并且它代表了“人们可以委托给 AI 的工作类型以及 AI 如何赋能他们的真正转变”。

关于 Astra 的网络能力已有诸多讨论。OpenAI 本周早些时候发布了一篇博客,讨论了该模型的新能力,以及为给用户带来更安全体验而制定的新保障措施。该公司周四表示,已在各种安全基准上对 Astra 进行了测试以确保其能力,并且它能够“识别和开发零日漏洞,可帮助防御者发现并修补弱点”。

该公司对对齐的关注——即模型倾向于用户想要什么或符合用户最大利益的特性——很难不让人联想到最近发生的 Hugging Face 安全事件,在该事件中,一个 OpenAI 智能体逃出了其沙盒测试环境,并入侵了多家公司(这是一个非常明显的对齐失败案例)。

OpenAI 还吹嘘了 Astra 的编码能力,声称它是“迄今为止最优秀的软件工程模型”。为了支持这一论断,该公司提供了多项网络安全相关基准测试的结果。这些测试似乎表明,在发现漏洞、执行终端任务以及回答有关代码库的查询等活动中,Astra 的得分高于其他现有模型——包括 OpenAI 自家的 Sol 和 Anthropic 的 Fable。

Astra 可能也是 OpenAI 迄今最具争议的模型,因为它使用了一种被称为“不透明循环”(opaque recurrence)的特殊推理技术。众所周知,这种技术会掩盖一项重要的模型监控过程——思维链(chain of thought),而思维链能让研究人员审查 AI 模型如何以及为何做出其决策。

OpenAI 淡化了 Astra 采用不透明循环的程度——在电话会议上,首席科学家 Jakub Pachocki 似乎将一定程度的不可监控性视为模型演化的自然产物。他表示,虽然监控模型的推理过程是一种关键的监督形式,但“随着模型能力的增强,可监控性正变得越来越具有挑战性。”

他随后补充说,造成这种情况的一个潜在原因是,“能力更强的模型可以用更少的语言 token 完成更难的任务”,甚至“完全不使用语言 token”,他说这反过来会降低对这类特定任务进行监控的能力。

电话会上有一位记者想知道,OpenAI 是否真的在把 Astra 宣称为 AGI(通用人工智能)的正式到来——这个被频繁讨论但定义模糊的技术节点,指的是 AI 在一切(或大多数)事情上超越人类能力的那一刻。

对此,Brockman 提出了异议。“现在已经不存在合同意义上的 AGI 触发条款了,所以那实际上已经不是一个相关的概念,”他说。这里 Brockman 指的是 OpenAI 与微软合同中此前存在的一项规定,即一旦 AGI 到来,双方的合作伙伴关系就将解除。正如 Brockman 所指出的,这项规定已不再存在。

相反,Brockman 解释说,AGI 的定义已经从一种合同义务演变为一种“使命概念或精神概念”。他补充道:“我确实把判断权留给读者,由他们自行决定这是否符合他们心中的标准。对我个人而言,我确实认为我们已经达到了那个阶段。”

原文

Original Title

OpenAI launches Astra, its powerful (and controversial) new model

Source

TechCrunch:AI(RSS)

Site

techcrunch.com

Author

Lucas Ropek

Published

2026-09-04 02:01

阅读原文· techcrunch.com

继续阅读