网站地图官方微信:
网站首页 三佳乡 芦集乡 李树乡 贺州市 支那乡 苍社镇

当前位置: 首页 >

如何看待机器之心重测高考数学全卷,Gemini夺冠,豆包DeepSeek并列第二?

当务之急最该解决的问题是大众对于 AI大模型的正确认知以及最基本的AI用法。

你看这是前两天的测试结果,突出了一个政治正确,6款大模型,OpenAI的o3倒数第一,我当时看到的时候就觉得很奇怪,o3好歹也是曾经的一代王者,高考数学这种题它排名这么低怕不是有什么猫腻。

我们就拿单选题的第五题来测试下,因为这道题除了o3,其他的国产模型都答对了。

这是第五题的原题,正确答案是A. - 1/2。

这是之前的第三方的测试结果,6个模型…。

如何看待机器之心重测高考数学全卷,Gemini夺冠,豆包DeepSeek并列第二?

  • | 自己组一个E5服务器才几百块钱,为什么去阿里云租这么贵? |

    很多人搞乱了一个事情, 商用和自用的区别。 还有回答说创业...

    查看详情>>
  • | 你的低成本爱好是什么? |

  • | Linux 下有没有类似 Everything 的搜索工具? |

  • | 如何评价B站up主***千代退网? |

  • | 你被哪个后来知道很sb的BUG困扰过一周以上吗? |

  • | 太空中没有氧气,为什么太阳还在燃烧? |

  • | 大一计算机新生怎么合理利用github? |

  • | 为什么 lua 在游戏开发中应用普遍? |

  • | 导师给了1.4W要我给工作室买个主机,是整机还是自己配? |

  • | 全平台应用框架会是趋势吗?flutter、tauri、maui你更看好哪一个? |

  • | 皮肤太白是种怎样的体验? |

  • 我之前也是喜欢严格遵循restful规范,什么get,pos...

    2025-06-24
  • 我们产品一个go实现的后台,高并发大流量时cpu十分繁忙,g...

    2025-06-24
  • 之前的文章《 Trae+Claude3.7 | 10分钟生成...

    2025-06-24
  • 因为事实上我们已经处于世界大战的周期里面了。 6月22日,...

    2025-06-24

关注我们

添加微信好友,关注最新动态