核心观点与关键数据
太阳模型(Opus 5)定位与性能
- 定位并非取代Fable 5的绝对性能档,而是以Opus级价格逼近Fable级能力。
- 支持最大1M上下文和12.8万token输出。
性能提升分析
- Agent Coding能力接近Fable 5:FrontierBench得分43.3(较Opus 4.8翻倍),超过Fable 5(33.8)和GPT-5.6 Sol(34.4);CursorBench 3.2最大算力距Fable 5峰值不足0.5%,单任务成本减半。
- 知识工作与工具调用能力增强:GDPval-AA v2(1861 Elo)领先Fable 5(1747);OSWorld 2.0(70.6%)和BrowseComp(90.8%)均超Fable 5。
定价策略
- 价格与Opus 4.8一致(每百万Token 5/25美元),为Fable 5的50%。
模型优化与Agent提示词影响
- Claude Code团队精简系统提示词(删减超80%),核心编码指标未下降,显示基模进化后Agent提示词作用减弱。
研究结论
- Opus 5兼具Fable级性能与Opus级性价比,Agent提示词依赖性下降,模型对复杂任务处理效果提升显著。