GPT-5.2-Codex是OpenAI发布的最新智能体编码模型,在GPT-5.2基础上针对Codex智能体编码进行深度优化,提升长程任务执行能力和网络安全能力。主要改进包括:1)通过上下文压缩提升长程任务执行能力;2)在大规模代码变更中表现更优;3)在Windows环境下性能更佳;4)网络安全能力显著增强。
1.1 软件工程能力提升
GPT-5.2-Codex结合GPT-5.2专业优势和GPT-5.1-Codex-Max智能体编码能力,依托上下文压缩、强长上下文理解、可靠工具调用等特性,实现长程编码任务可信度与Token使用效率的双重提升。在SWE-Bench Pro测试中准确率56.4%,较GPT-5.2提升0.8%,较GPT-5.1提升5.6%;在Terminal-Bench 2.0测试中准确率64.0%,较GPT-5.2提升1.8%,较GPT-5.1提升5.9%。原生Windows环境下智能体编码表现更高效可靠。
1.2 网络安全能力显著增强
GPT-5.2-Codex是OpenAI已部署模型中网络安全能力最强的版本,在专业夺旗赛(CTF)评测中表现优异,实现网安能力的第三次显著跃升。在CVE-Bench评测中表现优于GPT-5.1-Codex-Max,在Cyber Range评测中综合通过率72.7%,在Irregular外部评估中漏洞研究与利用类成功率80%。尽管表现优异,但仍未达到Preparedness框架下的“高能力”等级,主要因在CVE-Bench评测中存在偶发错误,未满足“持续一致性”要求。
高频因子跟踪显示,价格区间因子、价量背离因子、遗憾规避因子今年以来整体表现优秀,价格区间因子多头超额收益率5.62%,价量背离因子5.32%,遗憾规避因子-0.03%。斜率凸性因子年度表现欠佳,多头超额收益率-6.16%。
基于三类高频因子等权合成的高频“金”组合中证1000指数增强策略,年化超额收益率10.10%,超额最大回撤6.04%。高频&基本面共振组合中证1000指数增强策略,年化超额收益率为14.12%,超额最大回撤4.52%,表现更优。
总体来看,GPT-5.2-Codex凭借长程任务执行、跨模态理解及网络安全能力的核心升级,有望推动金融领域复杂场景的技术落地,赋能金融科技创新与风险管控,提升金融机构研发效率与安全防护水平。