小红书大模型dots-note-3.0首战IMO满分夺金,创新解法获数学冠军盛赞

   时间:2026-07-22 07:44 来源:互联网作者:唐云泽

国际数学奥林匹克竞赛(IMO)刚刚落下帷幕,中国科技领域传来一则令人瞩目的消息:小红书自主研发的大模型dots-note-3.0在本次竞赛中以满分成绩斩获金牌,成为全球第二个达到这一成就的模型,也是中国大模型首次获得IMO官方金牌认证。

IMO被誉为数学界的“奥林匹克”,每年吸引全球最顶尖的中学生参与角逐。陶哲轩等当代菲尔兹奖得主均曾在此竞赛中崭露头角,谷歌联合创始人谢尔盖·布林也曾夺得金牌。竞赛要求选手在两天内完成六道高难度题目,涵盖代数、组合、几何和数论四个领域,每题满分7分,总计42分。参赛者不仅需要给出正确答案,还需提供逻辑严密、步骤完整的证明过程,这对人类选手和人工智能模型都是极大挑战。

小红书大模型dots-note-3.0在此次竞赛中表现惊艳。它以自然语言直接读取题目,独立完成解析、推理和证明全过程,六道题全部答对,取得满分42分的优异成绩。相比之下,谷歌2024年首次参赛时仅获得银牌,2025年虽以金牌成绩改进,但仍有一题未完全解答。小红书的突破标志着中国大模型在数学推理能力上达到国际领先水平。

竞赛评委和数学界专家对dots-note-3.0的解答给予高度评价。双CMO金牌得主刘涵祚指出,模型给出的证明思路“正确且漂亮”,结构紧凑、逻辑自然,在IMO解答中属于简洁优雅的典范。另一位CMO金牌得主汪千桐则表示,模型的解法直击问题本质,常规方法虽巧妙,但dots-note-3.0直接攻克了最难部分,其简洁明了的推理过程令人印象深刻,甚至为人类选手提供了新的解题视角。

IMO之所以成为衡量大模型能力的“试金石”,在于其独特的竞赛机制。题目由专家严格保密命制,模型无法提前训练或获取答案,必须现场独立理解并解决未知问题。这种设置排除了模型通过记忆或数据包装取胜的可能性,真正考验其推理和创新能力。竞赛采用与人类选手相同的评审标准,由国际评委对证明过程进行严格审查,任何逻辑漏洞都会被扣分,确保结果公正权威。

小红书大模型的成功并非偶然。dots-note-3.0采用智能体架构,结合自然语言与Python代码执行推理,并通过递归自我批判机制审视论证过程,确保每一步推理的严密性。在组合博弈类题目中,模型未沿用常见的图论转化方法,而是创新性地运用归纳法,精准捕捉问题本质,设计出简洁优雅的证明方案。这种能力不仅体现在解题正确性上,更反映出模型对数学结构的深刻理解和灵活运用。

本届IMO赛题难度显著提升,金牌分数线从去年的35分降至29分,满分与金牌的差距扩大至13分。这意味着选手需完整解决四道题,并在剩余两题中至少获得1分才能跻身金牌行列,而小红书大模型不仅达到这一标准,更以满分成绩突破极限,在顶尖选手中脱颖而出。其表现证明,模型在未知高难度问题上的推理能力已接近或超越人类顶尖水平。

此次突破为小红书在基础模型领域赢得广泛关注。过去,外界对小红书的技术认知多集中于内容社区和推荐算法,而IMO金牌成绩则直观展示了其在深度推理和复杂问题解决方面的实力。与常规基准测试相比,IMO的公开性和高认可度使这一成果更具说服力,为行业提供了衡量模型能力的权威参考。

据悉,小红书计划将dots-note-3.0模型开源,供全球研究者共同探索其技术潜力。这一举措不仅将推动数学推理领域的发展,也为大模型在科研、教育等场景的应用开辟新路径。随着模型能力的不断提升,人工智能在解决复杂科学问题上的角色正从辅助工具转变为积极参与者,为人类探索未知领域提供更强有力的支持。

 
 
更多>同类内容
全站最新
热门内容