找回密码
 注册
搜索
查看: 49|回复: 0

[转贴] OpenAI最新模型,加速走向失控的算力怪兽?

[复制链接]
发表于 2026-9-6 03:43 PM | 显示全部楼层 |阅读模式


OpenAI最新模型,加速走向失控的算力怪兽?

Screenshot 2026-09-06 at 3.42.02 PM.png

OpenAI最新发布的旗舰模型GPT-6 Astra,标志着AI正从“陪你聊天”彻底跨越到“替你打工”,它不仅能以“超人”速度跑表格、搞自动化,更在复杂推理上超越前代模型。然而,在这场动用十万块GPU的算力豪赌背后,新架构带来的“黑盒效应”也让人类面临失去监控AI推理过程的失控风险。

当顶尖AI开始具备无人监督就能寻找网络漏洞的能力,我们究竟是迎来了生产力爆炸的黄金时代,还是正一步步迈向无法控制的算力怪兽?本文将拆解Astra带来的技术突破、安全争议及其背后的商业考量。


当地时间9月3日,OpenAI发布新一代旗舰模型GPT-6 Astra,其标志性功能之一名为“计算机使用”,旨在像人类一样操作计算机。

1.jpg

图片来源:Matt RAMEY—AFP/Getty Images


在OpenAI展示的一段视频中,一个人坐在椅子上,用语音指挥计算机,尽管有事先编排的痕迹,但整个过程的互动较为流畅自然。

OpenAI表示,这只是其众多全新高级功能之一,其他功能还包括数学运算能力、软件工程和网络安全防御。OpenAI联合创始人兼总裁格雷格·布罗克曼对记者表示,“计算机使用能力是这些新功能中尤为重要的部分。”他说,Astra能够以“超人”的速度处理电子表格、填写表单、浏览网页。

OpenAI将 Astra称为“目前全球最智能、且对齐程度最高的模型”,其发布的基准测试结果显示,Astra在广泛任务上均超越其此前表现最佳的模型GPT-5.6 Sol,以及Anthropic的最强模型Claude Fable 5.1。在一项难度较高的基准测试ARC-AGI-3中,Astra得分98.6%,而GPT-5.6 Sol仅得7.8%,Anthropic的Claude Opus 5得分为30%,该测试旨在衡量模型对未见情境的推理能力。在高难度的网络安全挑战ExploitBench中,Astra获得了满分,远超GPT-5.6 Sol的78.5%。

OpenAI并非首个推出可操控计算机的AI智能体的公司。2024年,Anthropic率先推出测试版程序;今年2月,Perplexity也构建了一个能够操控虚拟计算机完成用户任务的系统。

布罗克曼表示,自2015年加入OpenAI以来,他就在思考如何让AI像人类一样使用计算机。在他看来,计算机使用功能可被视为“AGI时代”的开端。AGI即通用人工智能,这一术语的确切定义至今仍然存在争议,人工智能研究人员对此看法不一。OpenAI曾将AGI定义为“能够在所有具有经济价值的工作中,达到或超越人类水平的自动化系统”。

“如果有人认为,我们当下已身处AGI时代,这种感受有一定的道理。如果你想说Astra是第一个AGI,那也是合理的。”布罗克曼指出,AGI的实现并非如他最初预测的那样一蹴而就,而是逐步积累的结果。

对多数人来说,这种操作方式仍未成为日常使用计算机工作的主流,计算机使用功能也不会一夜之间出现在所有办公室。OpenAI将 Astra 的发布范围限制在部分企业客户,包括其专注于网络安全的“Daybreak”项目的客户。OpenAI表示,Astra将在“未来几天内”向所有Plus、Pro和Enterprise用户开放,用户也可以通过 OpenAI API和AWS使用。该公司称,提供给这些客户的版本将无法执行“高级网络安全任务”。

OpenAI的发言人告诉《财富》杂志,Astra是“一个非常大的模型”,发布初期限制使用范围是为了扩展其计算能力。OpenAI研究副总裁艾丹·克拉克称,Astra的开发还涉及该公司“迄今为止最大规模”的训练,“这是我们首次在得克萨斯州Stargate数据中心使用超过10万块GPU进行预训练。”
 

OpenAI表示已增加更多网络安全保障措施



在7月Hugging Face遭智能体入侵事件后,OpenAI推迟了Astra的发布,以增加额外保障措施。此后,OpenAI加强了监控,并进一步隔离了训练环境,尽管有观点认为其新增的监控措施不够充分。

根据美国人工智能安全框架的条款,OpenAI在发布前将Astra提交美国政府审查。该框架是科技公司与特朗普政府之间的自愿协议,其细节尚未公开,并非正式的公开流程。

布罗克曼表示,OpenAI与政府进行了“标准测试流程”,当被追问流程细节时,布罗克曼透露更多。“我只是不想做出错误的表述,因为流程的具体运作方式存在细微差别。”

Astra也是OpenAI首个达到其“关键网络安全能力阈值”的模型,该阈值是根据OpenAI的“准备框架”制定的一项内部政策,规定了公司将根据模型存在的风险采取的安全防范措施。这意味着在合适的条件下,Astra能够在无人监督的情况下发现并利用此前未知的安全漏洞。

本周早些时候,OpenAI宣布,仅向部分合作伙伴开放Astra最先进的网络安全功能。提供给其Daybreak客户版本允许获批客户使用该模型执行常见的网络防御任务,但不得用于开发漏洞利用程序,或执行可能用于发起网络攻击的任务。
 

安全专家警告:Astra或使未来AI智能体更难监控



人工智能安全专家对OpenAI构建Astra的方式表示担忧,他们认为这可能加速人类失去监控AI智能体推理过程的能力。

在模型的内部架构中,OpenAI部分采用了一种被称为“循环深度”或“循环Transformer”的方法,能够显著提高人工智能模型的效率,因为它可以减少处理每个指令所需的计算能力。在众多企业抱怨使用最先进的AI模型成本高昂之时,这是一项宝贵的优势。

然而,新流程也意味着AI模型“思维链”(即其推理步骤)不再以自然语言表达,人类更难监控模型的行为及其动机。目前,思维链监控是确保AI智能体未采取意外行动或未经授权行动的方法之一。

OpenAI首席科学家雅库布·帕乔基表示,OpenAI限制了循环Transformer架构的使用范围,从而保证了模型推理过程的可读性。

帕乔基在X平台上写道,OpenAI深切关注思维链监控问题,并且“自我们最初的推理模型问世以来,OpenAI始终致力于维护和利用思维链监控”。帕乔基表示,OpenAI未来将分享更多关于Astra架构的细节。

帕乔基认为,思维链监控未来可能会变得更具挑战性,但这并非源于架构的改变,“我们可以采取措施来加强它,这是我们当前研究项目的核心目标之一,”他写道。

一些推动制定人工智能安全标准的组织同样表达了担忧。在帕乔基发声前,曾任OpenAI安全研究员、现任非营利组织Guidelight AI Standards负责人的史蒂芬·阿德勒在X上写道,“OpenAI似乎正在违反AI行业中为数不多的红线之一。”

总部位于华盛顿特区的智库AI政策网络政策总监彼得·威尔德福德告诉《财富》杂志,OpenAI使用循环深度技术“可能非常令人担忧而且不计后果”。

他指出,在7月Hugging Face遭智能体入侵事件中,OpenAI和外部AI评估公司能够拼凑出事情经过的几种方法之一,就是读取模型的思维链。OpenAI还表示,未来将投入大量资源进行实时思维链监控,以防止未来发生类似的失控人工智能事件。“如果OpenAI真的要放弃这种方法,那将是错误的方向,”他说。

一些AI安全专家对OpenAI在Astra中使用循环Transformer感到担忧,他们担心OpenAI此举将使这项技术常态化,开创先例,其他人工智能公司很可能会效仿并加以扩展,最终导致人工智能模型的推理过程对人类完全不透明。

前OpenAI治理研究员丹尼尔·科科塔伊洛回应帕乔基称,“即使OpenAI不进一步采用(使模型思维链更难理解的架构),其他公司也可能会这样做。”

科科塔伊洛敦促帕乔基牵头制定行业范围内的思维链可监控性标准,“要么阻止其走向衰落,要么更进一步,引领行业走向巅峰。我认为这不仅需要政治意愿,还需要深思熟虑的技术规范。”(财富中文网)






·AGI时代的办公场景重塑:GPT-6 Astra推出的“计算机使用”功能可跨软件自动执行复杂任务,标志着AI正从“文字对话”迈向“直接替人类打工”的实际落地阶段。引发办公效率革命的同时,也必然重塑职场技能价值标准。

·Astra引入“循环深度”技术降低成本,却导致“思维链”无法用自然语言呈现,使得人类监控其意图变得更加困难。如何在追求极致算力的同时保持对AI的可控性,是全球技术产业链必须共同面对的核心课题。

·由于计算资源和安全合规限制,Astra初期仅向少数企业客户开放,且高级网络安全能力受到严格管制。这种限制不仅突显了高端算力屏障,也为中国本土大模型与智能体应用在特定垂直场景中的快速跟进、落地及国产化替代创造了战略窗口。


财富中文网对原文有删减和调整


编辑:魏雨彤

您需要登录后才可以回帖 登录 | 注册

本版积分规则

手机版|小黑屋|www.hutong9.net

GMT-5, 2026-9-7 04:22 AM , Processed in 0.078793 second(s), 18 queries .

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表