字节跳动Seed团队正式发布了全新形式化数学推理专用模型Seed Prover 1.5,这一突破性模型通过大规模的Agentic RL训练,显著提升了数学推理能力和效率。
Seed Prover 1.5在多项国际数学竞赛中的表现令人瞩目,在IMO 2025前5道题中,模型仅用16.5小时便完成了完整可编译验证的Lean证明代码,成绩达到35/42,等同于金牌水平,对北美本科级别数学竞赛Putnam的挑战,更是展现出强大的实用性——在12道Putnam 2025赛题中,Seed Prover 1.5在短短9小时内完成了11道题目的编程验证。
为了全面评估模型的实力,Seed团队在代表性评估集中展现了更广阔的应用场景,在Putnam历史评估集上,模型成功解决了88%的问题;在代表硕士数学难度的Fate-H评估和博士生数学难度的Fate-X评估中,分别解决了80%和33%的问题,这些成果不仅刷新了现有形式化数学推理模型的SOTA(state-of-the-art, 最好现有技术)表现,更为模型的实际应用价值提供了有力支撑。

"Seed Prover 1.5的发布标志着形式化数学推理技术进入了一个新的发展阶段,我们相信,这一模型将为数学研究和教育提供全新的工具,推动相关领域的创新发展。"Seed团队表示。
技术报告已公开,团队表示将在未来开放API,欢迎全球数学和AI研究者积极参与探索和应用Seed Prover 1.5,共同推动形式化数学推理技术的进步。
此次发布不仅彰显了Seed团队在形式化数学推理领域的技术实力,也为数学研究者提供了一个全新的研究平台,预示着未来在AI与数学交叉领域将有更多令人期待的突破。