17173 > 游戏资讯 > 科技新闻 > 正文

V4还没来 DeepSeekMath-V2数学模型来了:IMO奥赛金牌水平

2025-11-28 23:54:12 神评论
17173 新闻导语

DeepSeekMath-V2发布,IMO奥赛金牌水平!开源免费,超越GPT-5、Claude等顶级模型,数学推理能力全球领先。立即了解详情!

全网都在等DeepSeek发布V4大模型,然而好事多磨,这个模型一直没有问世,但DeepSeek也没闲着,时不时来个惊喜,今晚突然低调发布了DeepSeekMath-V2模型。

DeepSeekMath-V2是一款可自我验证的数学推理训练框架,基于 DeepSeek?V3.2?Exp?Base训练而来,通过LLM验证器自动审查生成的数学证明,并利用高难度样本持续优化性能。

目前该模型代码与权重已开源,发布于Hugging Face及GitHub平台。

这款模型强在哪里?先说结果,在IMO 2025和CMO 2024中均达到金牌水平,Putnam 2024获118/120分。

如果对比当前顶级的大模型,比如Claude Sonnet4、GPT-5、Gemini 2.5 Pro等,Basic测试中得分被DeepSeekMath-V2的99分远远甩开,Adveanced中也只比Gemini DeepThink的65.7分略低,这个模型也是谷歌特调的,也达到到了IMO金牌水平。

考虑到DeepSeekMath-V2的开源、免费等特性,可以说它是当前最强的数学模型了。

不过DeepSeek官方的说法倒是很谦虚,表示尽管仍有许多工作需要完成,这些结果表明,自我可验证的数学推理是一个可行的研究方向,可能有助于开发更强大的数学AI系统。

如果联系到DeepSeek最近几款特殊模型的表现,显然他们在V4发布之前积累了相当多的新技术新想法,在OCR、数学等方面表现惊艳,这么一想V4如果是全能型的多模态大模型,那就更值得期待了。

【来源:快科技】
关于DeepSeekMath-V2,数学模型,IMO,奥赛金牌,开源,数学推理,自我验证,DeepSeek,大模型,Hugging Face的新闻
亲爱的 17173 玩家们~我们正在打磨平台的找游戏功能,想听听你平时是怎么筛选、导航找游戏的?你的真实习惯和偏好,能让后续找游戏更顺手哦!立即点击填写问卷 参与问卷