新闻动态

  • Home
  • 全新发布!GPT-6引领智能时代的未来

全新发布!GPT-6引领智能时代的未来

2026-09-04 8090

刚刚,备受期待的GPT-6 Astra及其Pro版本正式推出!该模型被认为是全球最先进且最协作的人工智能,为计算机使用、浏览器应用、软件工程、网络安全以及科学与专业领域树立了新标杆。OpenAI亦宣布进入AGI(人工通用智能)时代。

在发布会上,OpenAI总裁Greg Brockman直接用一句“欢迎来到AGI时代”宣告了这一里程碑。随着Astra的启动,别的模型在网络上的表现也出现了下滑,显示出这款新模型的强大。

OpenAI充分显示了其研发的力量,Astra的训练规模在其历史上最大,在得克萨斯州的Stargate园区动用了超过10万块GPU进行预训练,并且首次由前代模型参与其监督训练。

GPT-6的API定价已公布,输入为每百万token 10美元,输出为50美元,相较于GPT-5.6 Sol,输入价格提高了2.5倍,而与新发布的Fable 5.1持平。

这次Astra的核心升级是从单纯的“回答问题”提升至“直接完成任务”。它不仅能够生成文本或代码,还能够在电脑和浏览器中执行多步骤操作,最终交付可供直接使用的文档、表格、演示文稿和其他各种项目。

其成绩单也令人惊讶,尤其是在以下几项测试中表现突出:在FrontierMath Tier 4 v2测试中得分为97.6%,在ARC-AGI-3中得到了99.9%的高分,尽管GPT-5.6 Sol仅为7.8%。同时在ExploitBench中获得满分100%。

ARC-AGI-3测试考验模型在陌生环境中的适应能力,研究显示Astra展现了出色的自主探索和学习能力。尽管该分数的获取是通过OpenAI的Responses API Harness框架,但显示出Astra的潜力。

在编程能力方面,Astra同样取得显著进展。在Terminal-Bench 4.0中得分为57.7%,在DeepSWE v1.1中为74.1%,都超越了前代模型。在数学和科学领域,Astra也表现不俗,例如在高难度数学测试中获得了97.6%。

Astra的升级还将代码能力与计算机使用结合,不仅能生成代码,还能在开发环境中执行、调试和修复问题。这种变化在实际环境中测试表现得更为明显,在Agents’ Last Exam中取得了59.3%的分数,而在更接近实际工作的AutomationBench中,成绩提升至41.4%。

在OSWorld 2.0的离线测试中,Astra表现亦十分优秀,获得72.6%的分数,大幅度提升了任务完成效率和准确度,相较于GPT-5.6 Sol,时长减少了近47%。这些成就表明,Astra在降低完成任务所需时间的同时,也提升了整体的工作效率。

发表评论