智通财经APP获悉,中国银河证券发布研究报告称 ,近日,OpenAI正式发布GPT-6 Astra,并称其为近来 全球最智能、且对齐程度比较高 的模型。GPT-6 Astra在数学能力 、网络安全与计算机操作表现上有显著提升 。OpenAI表示 ,虽然Astra的单Token费用 更高,但由于其能够以更少的输出Token完成复杂任务,在一些场景下 ,实际完成一个任务的成本反而低于此前模型。未来企业不会只关注token单价,而会关注完成一次任务需要付出的总成本,AI行业最终会从token定价转向任务成本衡量。

中国银河证券主要观点如下:
事件:近日 ,OpenAI正式发布GPT-6 Astra,并称其为近来 全球最智能、且对齐程度比较高 的模型 。
GPT-6 Astra在数学能力、网络安全与计算机操作表现上有显著提升:从评测结果来看,在代表高阶数学能力的Frontier Math Tier 4上 ,Astra得分达到97.6%,相比GPT-5.6 Sol的83.0%和Claude Fable 5.1的87.8%有显著提升;在强调陌生环境学习和抽象推理的ARC-AGI-3上,其成绩更是从GPT-5.6 Sol的7.8%跃升至99.9%。相比数学和抽象推理,Astra在网络安全上的跃升更具现实冲击力。在测试漏洞利用能力的Exploit Bench中 ,Astra得分达到100%,而GPT-5.6 Sol为78.5% 。Astra在理解用户意图和约束自身行为方面均取得显著进步:OpenAI借鉴 近期Hugging Face事件设计了一项新评估,用于测试当模型面对极其困难 、甚至无法完成的任务时 ,是否会为了达成目标而擅自突破用户授权边界。在没有生产环境安全措施的情况下,GPT-5.6 Sol有48%的情况会突破授权目标,而GPT-6 Astra的这一比例为0%。
此外 ,GPT-6 Astra在多项计算机操作和专业工作流基准中,Astra均取得领先成绩 。OpenAI表示,Astra操作计算机的能力可用于各领域的输出 ,包括但不限于将电子原理图转化为可制造的PCB、以约为人类冠军选手四倍的速度完成金融建模世界杯挑战、使用Unity进行游戏场景建模等。
十万卡集群确立算力壁垒,任务成本重构定价范式:Astra是OpenAI迄今规模最大的训练项目之一,该模型在美国Stargate德州基地使用超过10万张GPU进行预训练。其定价为每百万输入词元10美元 ,每百万输出词元50美元 。尽管与Anthropic对Fable 5.1的定价持平,仍是GPT-5.6 Sol的2.5倍。Astra还会提供一种“快速模式”,处理速度比较高 可达标准模式的2.5倍,费用 翻一倍。OpenAI表示 ,虽然Astra的单Token费用 更高,但由于其能够以更少的输出Token完成复杂任务,在一些场景下 ,实际完成一个任务的成本反而低于此前模型。未来企业不会只关注token单价,而会关注完成一次任务需要付出的总成本,AI行业最终会从token定价转向任务成本衡量 。
风险提示
AI发展不及预期的风险 ,政策与贸易摩擦风险等。
【免责声明】本文仅代表作者本人观点,与和讯网无关。和讯网站对文中陈述 、观点判断保持中立,不对所包含内容的准确性、可靠性或完整性提供任何明示或暗示的保证 。请读者仅作借鉴 ,并请自行承担全部责任。邮箱:zbb@staff.hexun.com





