清华学霸与AI比作念高考压轴题，谁会赢？

你的位置：配资公司 > 炒股配资 > 清华学霸与AI比作念高考压轴题，谁会赢？

清华学霸与AI比作念高考压轴题，谁会赢？

时间：2025-06-09 09:31:52 点击：148 次

　　昨年，“9.11和9.9谁大？”这一粗浅的数学题曾难倒了多家大模子。到了本年，大模子的理科材干进步怎样？

　　当天网易有说念发布了一则视频，6位清华姚班学生与AI比赛作念高考压轴题。清华姚班为图灵奖得主姚期智院士创办，聚集了数学、物理、信息学竞赛金牌得主。

　　姚班学生和AI竞速的两说念题分离为2023年高考数学宇宙一卷压轴题和2021年高考物理江苏卷压轴题。姚班学生在10分钟内完成了作答，仅有1位同学作念错了题目，AI答疑笔则在输入阐述后几秒就开动输出按序，并答对了题目。

　　关于AI的回复，一位姚班学生以为AI作念题念念路与其一致，按序愈加明显，相较于传统的谜底更故意于学生集合解题念念路。

　　不错对比的是，昨年高考狂放后，有机构让包括GPT-4o、豆包、文心 4.0在内的9家大模子尝试河南的高考卷，并以河南的分数线评判，最终有4家大模子在文科高收用达到河南的一册线，但莫得大模子的理科分数达到河南省一册线。

　　有说念相干精致东说念主对记者暗意，本年以来AI进展飞速，尤其是DeepSeek-R1带来了推理模子大爆发，而大模子推理材干和交互材干在评释注解场景的适配性相配高，概况迟缓贬责个性化训导和答疑的需求，况且提供的指点和答疑质料越来越高，是以选拔与高考顶尖学霸进行同题测试，用一种成功明了的边幅向各人展示AI大模子材干的进步。

　　在题型选拔上，主要基于难度和贯通度的考量，炒股配资上述精致东说念主暗意，“因为群众对高考的难度齐是有倡导的，尤其是这种高难度的理科压轴题，容易引起护理，也能直不雅展示着力。”

　　上述东说念主士涌现，前段本事还作念了北京最新高考二模（题库数据里莫得的新题）的挑战。AI答题后由赤诚进行改动，分数为697分（总分750分），达到“清北”水平。“毕竟昨年AI集体作念24年高考题的时候理科真是三军毕命。”

　　夙昔一年本事，不少大模子公司将数学材干算作大模子的材干体现。OpenAI在先容OpenAI o3-mini时暗意，OpenAI o3mini 的高推理材干在 FrontierMath 上的明白优于其前辈。在 FrontierMath 上，当被条件使用 Python 器具时，具有高推理材干的 o3mini 初次尝试即可贬责杰出 32% 的问题，其中包括杰出 28% 的挑战性 (T3) 问题。FrontierMath是由Epoch AI和解60余位全世界的数学家共同推出了全新的数学基准，其原创的数常识题关于专科数学家而言仍需数小时以致数日贬责。不外，OpenAI公布的收成后续曾遭到质疑。

　　此前谷歌晓示推出了基于强化学习的数学推理系统 AlphaProof，以及几何求解系统的校正版 AlphaGeometry 2。谷歌暗意这两款系统统同贬责了2024年国外数学奥林匹克(IMO) 六说念题目中的四说念，初次达到了与银牌得主格外的水平。

　　本年4月29日，阿里巴巴发布新一代通义千问模子Qwen3。据了解，在奥数水平的AIME25测评中，千问3斩获81.5分，刷新开源记载。

　　艾媒探求发布的《2024年东说念主工智能+评释注解行业发展不绝敷陈》指出，2023至2027年在线评释注解市集的AI孝敬率瞻望从7%进步至16%傍边。

上一篇：端午箝制粽子过度包装我国现有食物包装关连企业超9100家
下一篇：6月11日科沃转债下落0.02%，转股溢价率272.13%

股票杠杆

清华学霸与AI比作念高考压轴题，谁会赢？