
国际数学奥林匹克竞赛(IMO),这个让全球中学生闻风丧胆的顶级赛事,今年的最大看点不是哪个国家拿了团体冠军,而是——一台AI拿了满分。
没错,在IMO 2026上,小红书大模型dots-note-3.0六道题全部答对,斩获金牌。这是中国大模型历史上首次获得IMO官方金牌认证,也是继去年OpenAI的o3之后,全球第二个达到这一成绩的大模型。
说实话,”小红书做AI”这件事本身就够让人意外了。在很多人的印象里,小红书是种草社区、是穿搭笔记、是”生活类App”。但dots-note-3.0这一波操作,直接把小红书拉进了基础模型的第一梯队,而且是凭硬实力——数学推理——杀进去的。
第三题:让冠军选手都服气
这次IMO官方的一大亮点是公开了AI的完整答题过程。而在六道题中,第三题的解法最受关注——因为连本届IMO的冠军选手都给出了”正确且漂亮,结构紧凑、逻辑自然”的评价。
要知道,IMO的题目不是简单的”算个方程”,而是需要创造性的数学思维。很多题目,人类顶尖选手也需要数小时甚至数天才能找到思路。AI能在限定时间内给出结构紧凑、逻辑自洽的证明,说明它不只是背题库、套公式,而是具备了真正的数学推理能力。
这也是dots-note-3.0和很多”刷题型AI”的本质区别。它不是在已知题目库中匹配答案,而是像人类选手一样,从公理和定理出发,一步一步构建证明链。第三题的解法之所以被评价为”自然”,正是因为它的推导过程没有机械感,读起来甚至有点”人类味”。
小红书凭什么做AI?
这个问题很多人会问。但其实,小红书做AI不是突然冒出来的。早在2024年,小红书就成立了大模型团队,并陆续推出了多个模型版本。dots-note系列是他们的旗舰推理模型,主打深度推理能力。
小红书的优势在哪?一是数据。小红书拥有海量的结构化内容——笔记、评论、图片——这些数据天然适合训练多模态和推理模型。二是场景。小红书的搜索、推荐、内容理解等业务本身就是AI的天然练兵场。
dots-note-3.0展现的数学推理能力,意味着它在逻辑推理、复杂问题分解、多步规划等任务上也有相当的实力。这些能力可以直接迁移到小红书的核心业务——比如更精准的内容推荐、更智能的搜索问答、甚至未来可能出现的AI助手功能。
IMO对中国AI意味着什么?
IMO一直被视为AI推理能力的”试金石”。和ChatGPT对话、写诗不同,IMO考察的是严格的逻辑推导能力。一个能在IMO上拿满分的AI,意味着它已经具备了”像数学家一样思考”的潜力。
从OpenAI的o3到小红书dots-note-3.0,IMO满分正在成为衡量大模型推理能力的”标准赛道”。而中国AI这次终于站上了这条赛道——不是靠体量、不是靠应用场景,而是靠纯数学推理能力拿下了顶级认证。
更深一层看,数学推理能力是通往”强AI”的关键门槛。很多高阶任务——科学研究、工程创新、金融建模——本质上都是数学问题。AI在IMO上的突破,意味着在这些领域,AI的能力天花板正在被不断推高。
背后的大模型格局
dots-note-3.0的成功,也让中国大模型的竞争格局多了一个变量。一直以来,国内大模型赛道被字节豆包、百度文心、阿里通义等巨头主导。小红书dots-note的出现,证明了一件事:在AI这个领域,”新玩家”的窗口并没有关上。
前提是你得有真本事,而不是靠钞能力讲故事。dots-note-3.0拿的是IMO金牌,这玩意儿做不了假,也糊弄不了人。
可以预见,接下来的AI军备竞赛会更激烈。巨头们有算力和数据优势,但像小红书这样的”进攻型选手”,靠一招鲜的深度推理能力,同样能找到自己的生态位。对用户来说,这是好事——竞争越激烈,好东西越多。
回到这次IMO的表现,dots-note-3.0用六道满分的答卷告诉所有人:在小红书,能种草的不仅是穿搭博主,还有一个正在”暗中发育”的顶尖大模型。
本文地址:https://www.163264.com/14249


微信扫一扫,鼓励一下~