
如何看待机器之心重测高考数学全卷,Gemini夺冠,豆包DeepSeek并列第二?_陕西省延安市志丹县满段糖类股份有限公司
联系人:
手机:
E-mail:
地址:
如何看待机器之心重测高考数学全卷,Gemini夺冠,豆包DeepSeek并列第二?
发布时间:2025-06-21 15:05:22 人气:
当务之急最该解决的问题是大众对于 AI大模型的正确认知以及最基本的AI用法。
你看这是前两天的测试结果,突出了一个政治正确,6款大模型,OpenAI的o3倒数第一,我当时看到的时候就觉得很奇怪,o3好歹也是曾经的一代王者,高考数学这种题它排名这么低怕不是有什么猫腻。
我们就拿单选题的第五题来测试下,因为这道题除了o3,其他的国产模型都答对了。
这是第五题的原题,正确答案是A. - 1/2。
这是之前的第三方的测试结果,6个模型…。
相关新闻
- 如何看待不超过1879元的Mac mini(M4+16/256GB+票),易用性吊打同级其他台式电脑? 如果内置硬盘能换,那么很超值。 不过没理解错的话,mac ...
- 吴柳芳的真实水平如何? 真实水平应该挺高的, 起码是被大众鉴定过的, 刚刚去看了一下...
- 为什么没有核动力货轮? 核动力这么强劲,为什么商船却不用? 其实看看世界第一艘核动力...
- 不限制语言,客户端GUI开发用什么好? 不考虑信创: Electron 唯一真神! WPF Wind...
- 感觉鱼缸久了底下火山石里脏脏的,能彻底换水清理一遍不? [***] 鱼缸要养庞大的清洁工队伍,清道夫、红眼大帆、各种...
- golang总体上有什么缺陷? 没什么缺陷,唯一的缺陷就是喜欢动态化的魔怔人太多,当然官方特...