TL;DR:
2026年IMO,中国队在上海主场拿下全员金牌,三位少年斩获42分满分,直接把AI的“金牌线”秒成了渣。但更刺激的是,GPT-5.6据说首次尝试就全做对了——这波啊,是人类的完美,和机器的逼近,在考场外开始“量子纠缠”了。
全员金牌,满分三人,中国少年用“零瑕疵”给AI上了一课
如果高考是千军万马过独木桥,那IMO(国际数学奥林匹克竞赛)简直就是一群“神童”在玩极限攀岩。今年的第67届赛事,好巧不巧就在上海中学举办——这是IMO历史上第一次把考场搬进中学,主打一个“主场Buff”拉满。
结果呢?中国队直接上演了一出“满分屠榜”。
以全员金牌、总分232的绝对优势,狂甩第二名美国队25分,强势C位登顶。1 更炸裂的是,来自上海中学的邓乐言、张柏伦,以及华东师大二附中的刘澈,三位少年交出了42分满分的答卷——六道题,题题完美,没有一丝扣分空间。
这什么概念?这就好比你去跑马拉松,别人气喘吁吁拿了个奖牌,结果这哥仨是踩着风火轮冲过终点,还顺手把计时器给按停了。
美国队虽然拿下了4金,但混了一银一铜,只能屈居亚军。俄罗斯队4金2银,拿了季军。中国队这波操作,直接让“主场优势”变成了“主场碾压”。
而且,这支队伍里没有高三选手,全员“低龄战神”,未来可期。2 上海中学更是成为“金牌批发户”——自2022年起,连续四年每年产出6枚金牌,累计20枚IMO金牌。从这所中学走出的唐云清、张明嘉、张盛桐等校友,如今已成长为数学家,即将在ICM2026上做45分钟报告。3 这哪是中学,分明是“未来数学家的摇篮”。
AI的“完美”vs人类的“完美”,差了一个“首次尝试”
每年IMO成绩一出,总有人要把人类的答卷和AI的答卷放在一起比。今年也不例外。
去年,OpenAI的o3和谷歌DeepMind的AlphaProof、AlphaGeometry 2,都在IMO题目上达到了金牌线水平,震动了数学圈。但细想之下,问题来了:AI的“金牌线”是“通过”,人类的“满分”是“完美”。
金牌线通常在28-30分左右(满分42),AI靠的是海量算力暴力搜索,在无数次试错里找到那条正确的路。而邓乐言们交出的42分,是“每一步推理都没有错,每一行证明都没有漏洞,每一道题的落笔都精准无误”——这是完全不同的两件事。
就在大家还在为人类天才欢呼时,一个“幽灵选手”在考场外悄悄行动了。
据多家媒体报道,GPT-5.6 Pro在首次尝试中就解出了2026年IMO的全部六道题,全程没有任何人工提示或引导。4 SignalPilot Labs的独立评估也证实,它为这六道题生成了完整解答。
注意这六个字——“首次尝试”。
这意味着,机器可能正在跨过那条我们刚刚用来区分人与AI的线:从“反复搜索、终于找到”,走向“一次落笔、一步不错”。这不就是当年AlphaGo战胜李世石的那个“AlphaGo时刻”吗?只不过这次,战场从围棋棋盘,换成了数学奥林匹克的考题。
考场外那个“没有参赛资格”的选手,正在改写规则
更耐人寻味的是,OpenAI还给所有金牌得主赠送了为期12个月的ChatGPT Pro订阅服务。4 这操作,像极了“未来的对手请你用我的武器?”
人类少年用脑力征服了题目,AI用算力征服了同样的题目。一个靠天赋与训练,一个靠数据与算力。但本质上,它们都在证明同一件事:数学之美,是可以被理解和复现的。
当然,目前这些关于GPT-5.6的报道还未获得官方全面证实,各大实验室也还在拿着2026年真题跑分。4 但趋势已经很明显:AI在数学推理上的能力,正在从“能做到”向“一次做对”跃迁。
如果说今年IMO是人类的胜利,那考场外那个没有参赛资格的AI选手,正悄悄站在门口,用它的“首次尝试”告诉所有人:完美,也许不再是人类的专利。
也许再过几年,我们会怀念这个还能轻松区分“人类满分”和“AI达标”的年代。因为当AI开始“不留漏洞”地解题时,真正被“碾压”的,或许就不只是奥数题了。