GPT-6 Astra 在多个能力维度实现全面升级,专业工作与 Coding 能力突破,如 AutomationBench 得分 41.4%,BenchCAD 达到 95.9%;科研及网络安全能力突破,如 FrontierMath Tier 4 达到 97.6%,网络安全 ExploitBench 达到 100%;价格提升与效率改善,OSWorld 2.0 单任务用时减少约 47%
该报告显示 GPT-6 Astra 模型能力从通用问答和代码生成延伸至科研、网络安全及复杂专业任务,随着 Agent 逐步进入更高价值的专业工作场景,其商业化空间有望进一步打开,推动科技赛道在专业应用领域的深度发展
研报重点分析了 GPT-6 Astra 在专业工作与 Coding 能力、科研及网络安全能力、以及价格提升与效率改善三个方向的能力突破,并指出模型单 Token 价格提升的同时,复杂任务的完成速度和能力上限也在提升
当前市场对 GPT-6 Astra 这类技术的判断是,其能力提升显著增强了端到端 Agent 能力,并在多个专业领域展现出突破性进展,但价格提升也带来成本考量,需关注其在高价值场景的落地情况
研报提示的风险包括模型价格提升可能影响部分用户的接受度,以及 Agent 技术在实际专业工作场景中的应用效果和稳定性仍需持续验证,此外技术快速迭代也可能带来兼容性和适配性问题