一个做种草的 APP,做出了 IMO 满分的数学模型

一个做种草的 APP,做出了 IMO 满分的数学模型 一个你天天用来种草口红的 App做出了全世界只有 7 个人类能做到的满分数学卷。7 月 21 日国际数学奥林匹克IMO 2026在上海收卷。中国队拿下冠军上海中学的邓乐言、张柏伦和华二附中的刘澈三个人交出了 42 分的满分答卷。另外 4 位满分选手来自美国、英国、韩国。全球一共只有 7 位人类选手拿到满分。但和他们并列站在满分线上的还有一个不是人的选手。小红书对就是那个 App内部有个 AI 团队叫 dots他们带着一个还没公开的模型 dots-note 3.0 参加了这次 IMO 2026六道题题题满分42/42。一个你平时用来种草口红、查旅游攻略的 APP做出了一个能跟全世界最聪明的中学生并列拿满分的数学模型。全球只有 7 个人做到满分小红书的 AI 也做到了这次AI 考 IMO不是噱头是这一波大模型最看重的硬指标之一。谁考的小红书内部 dots 团队的 dots-note 3.0是它们一个相对小型的内部模型版本。考得怎么样六道题全部满分42/42全球只有 7 位人类选手做到。怎么做的别的 AI 系统做数学题往往会借助一种专门给机器看的数学编程语言来兜底相当于带了计算器dots-note 这次没用直接读人写的题面靠自己反复检查、推翻自己的中间步骤——官方说法叫递归自我批判——一步步推到完。会不会开源官方说 dots-note 3.0 预期将开源。这不是 AI 又进步了一点点是在数学这条最硬的赛道上直接摸到了人类的满分线。为什么值得关注数学是大厂判断AI 会不会想的标尺为什么所有大厂——OpenAI、Google、Anthropic、阿里、现在加上小红书——都在卷数学因为数学能力是判断 AI 能不能真的思考最干净的标尺。写作可以靠背诵画画可以靠模仿但数学证明错了就是错了没法用套话糊弄过去。Google、OpenAI 都在 IMO 这条赛道上较劲小红书这次挤进来拿的是一个稳定的满分——同一张卷子谁站到 42 分谁就摸到了这条赛道的当前上限。能稳定做数学的 AI通常也被认为离能做科研、能做工程推理更近了一步——但能不能替你做复杂决策还要看具体场景。做 AI 的不再只是你印象里的那几家但真正让普通人要留意的不是分数本身而是谁在考这场试。以前你以为 AI 是大厂的游戏——OpenAI、Google、阿里、字节。现在一个内容社区做出了满分数学模型。这说明AI 的能力正在从少数几家巨头独占变成有数据、有人才、有钱就能追上。你用的 APP——购物、社交、内容、工具——背后的公司都在悄悄训练自己的 AI未来它们不只是接个 ChatGPT而是有自己的大脑。真正的 AI 竞赛不再是几个大佬的角力而是你手机里每一个 APP 都可能藏着一个模型。“刷题还有没有用”答案正在变复杂这是家长和学生最该想的一层。过去我们说 AI 数学不行至少能安慰自己它还差人类顶尖选手一头。现在 AI 在 IMO 拿满分了意味着标准化的、有标准答案的、能靠推理流程解决的题目AI 已经到顶了。但要注意AI 这个满分靠的是算力反复试错 自我批判和人类那个灵光一闪的证明直觉是两条路。它能做对不代表它真的在想。未来值钱的不是会做题是会问问题、会判断哪个问题值得做、会说服别人相信答案重要。AI 顶到了答案的天花板但提出问题、定义问题、判断答案价值——这些人的部分反而成了最稀缺的能力。这件事和你、你家孩子、你的生意有什么关系对普通用户别再把 AI 只当聊天玩具。它已经能解 IMO 满分的数学题意味着它大概率能帮你跑完工作里那些有明确对错的任务——核对一份报表里的数字对不对得上、检查一段逻辑链里有没有漏洞、把一堆资料对齐成结论。把它当一个能跑标准推理流程的同事不是一个会说话的搜索框。对家长和学生别再让孩子和 AI 比做题速度那是一场注定会输的比赛。把精力挪到 AI 不擅长的部分——提出问题、跨学科联系、做判断、做表达。AI 把答案做满了问题这一端反而成了人的主战场。对创业者两件事。一是 AI 的技术门槛正在快速被填平我有个模型越来越不是壁垒我有独占数据、有真实场景、有用户每天在用的流程才是。二是会做数学的模型很快会普及dots-note 3.0 预期开源那些靠复杂推理吃饭的服务——财税、法律分析、工程计算、科研辅助——接下来一年大概率要被重新做一遍机会和风险都在这。接下来三个月盯这几件事先试起来dots-note 3.0 还没开源但 dots.llm1小红书上一代开源模型已经可以试用先用它感受一下一个内容公司做的模型到底到了什么水平。盯一个信号接下来几个月看哪些你常用的 APP 悄悄上线了自己的 AI 功能——那才是 AI 真正落地的入口。做个判断如果你或你的孩子正在大量刷标准化题目认真想一次——这部分时间未来几年还值不值。AI 已经证明了在做题这件事上它比人更稳、更快、更不会累。观察一条赛道复杂推理类服务财税、法务、科研、工程计算接下来一年会有大变化无论你是想入场还是想避险都值得盯紧。这件事真正的看点不是小红书做了一个 AI。是一个你天天用来查口红的 APP悄悄做出了一个全世界最聪明的人都未必做得到的数学模型。它说明 AI 的门槛正在被踏平——以前是大厂独占现在只要你有数据、有人才就能入场。它也说明在最硬的赛道数学上AI 已经摸到了人类的满分线。下次你打开手机里某个常用的 App可以多想一秒——它背后可能不只是一个推荐算法。如果你身边也有人在纠结孩子还要不要刷那么多题或者团队到底要不要上 AI可以把这篇转给 TA——不是给答案是多一个参考。