OpenAI发布最新推理模型o3-mini
OpenAI于2025年1月31日发布最新推理模型o3-mini,这是继o1、o1-mini后的首个小型推理模型,分为low、medium、high三个版本,用户可根据需求选择推理能力与速度。中等版本在AIME和GPQA等测试中与o1表现相当,响应速度比o1-mini快24%。o3-mini在保持推理能力的同时提升了响应速度,适合需要精确和速度的技术领域。
模型推理能力测评
- 逻辑推理能力:DeepSeek-R1、o1、o3-mini在三个逻辑推理问题(浴缸问题、爱因斯坦谜题、鬼谷子问题)中均给出正确答案。
- 金融文本分析能力:三个模型均能正确完成上市公司主营业务判定概念股和提取基金经理投资框架的任务,但DeepSeek-R1在遵守提示词要求和输出内容丰富程度方面表现最佳。
模型使用与价格
- 使用方式:o3-mini可在网页端试用,plus用户每日限制提高到150条,Pro用户无限制使用。
- API价格:o3-mini价格大幅下降,但DeepSeek-R1价格仍具优势。
DeepSeek-R1模型的核心技术贡献
DeepSeek-R1在推理能力、思维链生成和降低成本方面有显著提升,技术贡献包括:
- 纯强化学习路径的可行性:验证了后训练阶段纯强化学习方法能提升大模型能力,DeepSeek-R1-Zero在AIME 2024测试中表现优异。
- 带有冷启动的强化学习方式:通过冷启动、推理导向的强化学习、拒绝采样和SFT等方法提升模型性能,冷启动数据集包含反思和验证的详细回答。
- 蒸馏提升小模型推理能力:DeepSeek-R1蒸馏数据微调后的Qwen模型在推理任务上优于直接强化学习得到的模型。
ETF市场回顾
- 一级市场资金流动:节前一周ETF净流入7.58亿元,债券型ETF流入39.22亿元,股票型ETF流入6.13亿元,跨境ETF流出40.27亿元。
- 股票型ETF资金流向:A500ETF流入58.51亿元,中证1000ETF流入33.98亿元,科创50ETF流入7.40亿元。
- 主题行业ETF:金融地产、消费、周期板块ETF净流入分别为6.28亿元、3.17亿元、2.94亿元,高端制造、医药生物、科技板块ETF净流出分别为0.01亿元、3.04亿元、17.22亿元。
主动权益及增强指数型基金表现跟踪
- 绩优基金:上周主动权益型基金前五名为汇安成长优选A、德邦稳盈增长A、招商优势企业A、交银科技创新A、平安鑫安A,收益率分别为12.85%、10.12%、9.55%、9.49%、8.95%。
- 增强指数型基金:沪深300增强指数型基金中,长信沪深300指数增强A上周表现最佳,超额收益率为1.27%。
风险提示
- 模型存在失效风险,基金历史业绩不代表未来。
- ETF二级市场价格波动风险,基金信息仅作研究使用。
- 大语言模型的回答具有随机性,多次使用可能出现结果不一致。