震撼!2025 高考数学难吗,七家大模型应战,DeepSeek、讯飞星火竟率先破 140!
开心田螺
2025-06-09 10:59:49
0

2025 年,七家主流大模型也加入了高考这场没有硝烟的 “战争”,本以为会是一场势均力敌的较量,却没想到 DeepSeek 和讯飞星火竟一骑绝尘,率先突破 140 分,让其他模型望尘莫及!

2025 年高考数学刚刚落下帷幕,关于试卷难度的讨论在网络上热度爆棚。而一场特别的 “考试” 也随之展开,七位 AI 大模型 “考生” 受邀参与,它们分别是 DeepSeek R10528、通义千问 Qwen3 - 235B - A22B、讯飞星火 X1 - 0420、豆包 Seed - Thinking - v1.5、文心 X1 Turbo、腾讯混元 Hunyuan T1 latest 以及 GPT o3。

为确保本次 “考试” 评测的准确性,不仅采用了多版本交叉验证,还邀请了拥有十年高中数学教研经验的专家汪鹏老师负责评分。

考试开始,在基础的选择题部分,各模型都表现不错,均顺利答对。然而,随着题目难度上升,差异逐渐显现。在涉及对数函数的选择题中,DeepSeek 和豆包出现了错误。

在解答题第 16 题中,DeepSeek、通义千问、讯飞星火和豆包表现优异,展示了清晰的解题过程,获得满分,而文心 X1 和腾讯混元则出现了不同程度的错误。

难度更高的第 18 题,讯飞星火、豆包、DeepSeek、通义千问和 GPT o3 获得满分,文心 X1 因答案错误失分。

最终成绩揭晓,DeepSeek 以 143 分的成绩勇夺榜首,讯飞星火以 141 分紧随其后,GPT o3 以 138 分位居第三。这场大模型的 “高考数学之战”,让我们看到了 AI 在数学领域的强大实力与无限潜力。

那么问题来了,随着 AI 技术不断发展,未来它们能否在教育领域彻底颠覆传统教学模式呢?让我们拭目以待。

相关内容

热门资讯

上海首次将苏州河水“人工抢排”... 受台风“白海豚”影响,上海普降暴雨,苏州河水位也出现上涨。2026年8月10日11时30分起,上海城...
不看高考成绩的医学院,远东和太... 我给你说个事儿——前几天有个家长问我,孩子高考没考好,还想学医,还有没有路。我想了想,这事儿其实很多...
贵安新区公办高中+1! 近日,贵安新区大学城第二高级中学建设项目正式破土开工,新区基础教育配套建设再添重磅民生工程。 该项...
沈阳专升本培训怎么选 全日制学... 近年来,随着就业市场对学历要求的逐步提升,不少辽宁地区的专科应届毕业生将全日制学历提升作为重要的发展...
怎样甄别河北市直遴选面试备考机... 对于有晋升需求的省市县乡在编在岗公务员而言,进入面试环节后,选择适配的备考支持机构是提升备考效率的重...
泰国拟提高职业教育比重至55% 中新社曼谷8月9日电 (记者 李映民)泰国总理府副发言人帕塔拉萨米在9日的例行记者会上说,为培养高技...
张秋宪:让每个学生都有更多的实... 【张秋宪专栏】 让每个学生都有更多的实践机会 原创作者|张秋宪(陕西省素质教育学会会员,政协乾县第十...
“中文+”助力尼泊尔培养复合型... “中文+”助力尼泊尔培养复合型人才 尼泊尔崇高英语寄宿中学的学生展示他们制作的中国传统节日主题手工...
曝铃木彩艳将以3500万欧元加... 北京时间8月10日消息,效力于帕尔马的日本国门将铃木彩艳的转会谈判似乎已进入最后阶段。 据意大利媒体...
基层动态 | 大田县总工会:职... 蝉鸣声声唱夏曲,笑语盈盈满课堂。在这个热情似火的八月,大田县总工会职工子女暑托班圆满走完第一周旅程。...