大语言模型数学逻辑缺陷探析.pdfVIP

  • 1
  • 0
  • 约4.4千字
  • 约 8页
  • 2026-09-27 发布于北京
  • 举报

239为什么大模型觉得9.11比9.8更大?

欢迎回到《科技参考》,我是

前一阵子,有一个在刷屏了:有人发现十几个大语言模型

都无法准确回答一个特别简单的问题,就是9.11大还是9.8大。最

初测试结果,十几个大模型集体翻车。等发酵了一段时间后,有

再去验证,情况有所改进,一半的大模型能答对,但还是有一半

答错,看来是这些公司对这个热点错误做了一些改进的结果。

今天我们就借这个话题说说大模型的有哪些,再谈谈大模型智慧

的边界在哪里、大模型的运转是不是等价于思考这些偏哲学的话题。

后来很多人也换了问题,比如9.25和9.8谁大、9.25和9.9谁大。

错误也照样出现。

这个之所以刷屏,是因为这个问题对大部分人来说是可以理解

的,但实际上大语言模型中的还有很多,比如问题(不

可解释)、逆转、性遗忘…这些有的是源于自注意力机

制,有的是和训练过程密切相关,总之,需要更深入的了解大语言模

型的工作机制才能知道错误为什么会发生。当然,我们是不会看到这

些被刷屏的情况的。

9.11比9.8更大,为什么会发生呢?

因为一个问题扔给大语言模型后,第一步

文档评论(0)

1亿VIP精品文档

相关文档