如何看待机器之心重测高考数学全卷,Gemini夺冠,豆包DeepSeek并列第二?_陕西省宝鸡市扶风县频绘键武术股份有限公司
联系人:
手机:
E-mail:
地址:
如何看待机器之心重测高考数学全卷,Gemini夺冠,豆包DeepSeek并列第二?
发布时间:2025-06-18 05:40:09 人气:
当务之急最该解决的问题是大众对于 AI大模型的正确认知以及最基本的AI用法。
你看这是前两天的测试结果,突出了一个政治正确,6款大模型,OpenAI的o3倒数第一,我当时看到的时候就觉得很奇怪,o3好歹也是曾经的一代王者,高考数学这种题它排名这么低怕不是有什么猫腻。
我们就拿单选题的第五题来测试下,因为这道题除了o3,其他的国产模型都答对了。
这是第五题的原题,正确答案是A. - 1/2。
这是之前的第三方的测试结果,6个模型…。
相关新闻
- 为什么我觉得 AI 写代码纯属添乱? 前天我在出差之前(凌晨)写代码(看得出来我写的是matlab...
- 哈尔滨高温大学生楼道睡觉,学生称体感温度 37、38℃,东北学校该不该装空调?未来东北高温天会更多吗? 答主20年入学哈工大,21年住上有空调的宿舍,23年全校空调...
- 都在喊没钱,钱到底去哪儿了? 1、说个做晚刚发生的: 2025年6月26日晚上10点小米Y...
- SwiftUI 是不是一个败笔? 概览小伙伴们都知道,为了将 SwiftUI 中多如牛毛的视图...
- 吃爽了是怎样一种体验? 负债三年,三年前离婚,半个月前被分手,再也不想用情太深,上周...
- 如何评价阿里等大厂笔试现已经禁用本地IDE? 前段时间有同事离职,一口气面试了十来个人。 我最喜欢问的问...


客服