GPT‑6 Astra:是硬核真实力,还是啪啪打脸?
两份标题反差新闻刚好戳中这次发布最真实矛盾:专项能力大幅飞跃,但通用综合榜单没有登顶;局部达到新高度,但“进入AGI时代”属于口号化拔高。
✅ 实打实强的地方(不算吹)
1. 抽象推理、高阶数学、网络安全专项直接打穿榜单
ARC‑AGI‑3抽象推理从老版本7.8%飙升至99.9%;FrontierMath高阶数学97.6%;网络安全ExploitBench拿到100%,可以自主挖掘0day漏洞,是第一个Critical安全等级大模型 。
2. 核心进化:从聊天问答升级成“会操作电脑的智能体”
OSWorld 2.0电脑操作72.6%,可以接管浏览器、软件,自主完成一整套复杂工程任务,不再只是输出文字,能直接落地执行完整工作流,这是这代最大迭代点。
3. 在OpenAI自家体系内,它毫无疑问是最强,很多前沿科研任务已经可以解决过去的开放数学难题 。
⚠️ 被自媒体放大、属于部分营销号博流量
1. 总榜拿不到第一,通用综合能力并非全球第一
第三方权威综合榜单 Artificial Analysis Intelligence Index,Astra得分61.2,和上一代GPT‑5.6 Sol几乎持平,低于Claude Fable5.1的65.7分;部分综合考试Humanity's Last Exam同样落后对手。
逻辑:它在推理、数学、电脑操作专项杀到顶尖,但宽泛通识、多场景综合答卷上,没有完成全面碾压。
2. “人类进入AGI时代”是自家高管“王婆卖瓜”,不是行业共识
只是OpenAI内部观点,业内普遍认定:距离真正通用人工智能还很远,只是AGI路上的关键里程碑,不等于实现AGI。
3. 成本暴涨,价格贵出2.5倍
API价格大幅抬升,能力提升的代价是极高使用成本,普通用户还没开放,现在只有少量机构灰度内测,大众体验感还没落地。
📌一句话总结
专项硬实力真的炸裂,尤其AI智能体、电脑操作、数学推理这块是实打实跨台阶;但“全球全面第一、实现AGI”属于宣传口号。属于局部王者,综合第一没拿到。
对A股的简单映射
利好算力、液冷、AI智能体、Agent相关链;但不要被标题党情绪带节奏,要看后续实际落地、API调用数据验证,不能单纯看发布会新闻直接冲赛道。

