当前位置: 首页 >
如何看待机器之心重测高考数学全卷,Gemini夺冠,豆包DeepSeek并列第二?
- 人气:
当务之急最该解决的问题是大众对于 AI大模型的正确认知以及最基本的AI用法。
你看这是前两天的测试结果,突出了一个政治正确,6款大模型,OpenAI的o3倒数第一,我当时看到的时候就觉得很奇怪,o3好歹也是曾经的一代王者,高考数学这种题它排名这么低怕不是有什么猫腻。
我们就拿单选题的第五题来测试下,因为这道题除了o3,其他的国产模型都答对了。
这是第五题的原题,正确答案是A. - 1/2。
这是之前的第三方的测试结果,6个模型…。
推荐资讯
- 2025-06-27月之暗面 Kimi 首个 Agent 开启内测,可生成易追溯的万字报告,有哪些技术亮点?
- 2025-06-27苹果为什么要给每代MacOS起个名字,真以为人们记得住分得清吗?
- 2025-06-27个子高是种怎样的体验?
- 2025-06-27为什么是 9 月 3 日阅兵而不是 10 月 1 日国庆阅兵?
- 2025-06-27长得和刘亦菲很像是一种什么体验?
- 2025-06-27这种身材需要健身几年?
- 2025-06-27跟离异的女同事聊天时,她冒出一句:「你老婆还不如我,离了跟我过得了」,我该怎么回答?
- 2025-06-27哪些让你用了觉得相见恨晚的键盘?
- 2025-06-27“看不起印度,仅仅因为你是中国,而对于普通国家,印度已经是巨人”,这个观点你认同吗?
- 2025-06-27想往鱼缸里种点水草,但是家里鱼缸大了买水草泥或者底砂太贵了,有没有生活中可以替代的物品或其他建议?
- 2025-06-27AI 都能写代码了,还要学计算机吗?
- 2025-06-27易语言作者吴涛的技术水平在国内能排到什么级别?
- 2025-06-27国家为什么要把国企等企业电脑全部换成Linux环境?能不能从专业的角度分析一下?
- 2025-06-27苹果这家公司伟大之处在哪里?
- 2025-06-27你为什么退出了乐队?
- 2025-06-27你身边身材最好的女生是什么样?
推荐产品
-
照骗能骗到什么程度?
百万up主粤语歌手鱼蛋,抖音里长这样,容貌九分,声音十分。 -
为什么电脑厂商用了二十多年时间才发现电源应该放在机箱下部?电源下置这么显而易见的结构这么晚才出现?
电源上置是英特尔规定,电源下置是厂商和用户主推。 因为以前 -
如何看待M4单核性能吊打9950x?
正好,我在写一个.net core的小服务程序,正好用手头的 -
人常说女人味,到底是个什么味?
OPPO新机发布会上,产品经理莫妮卡这个动作,我觉得很有女人
最新资讯