- N +

苹果 AI 研究:简单算术考倒 o1 和 Llama 等 20 多个主流模型

苹果 AI 研究:简单算术考倒 o1 和 Llama 等 20 多个主流模型原标题:苹果 AI 研究:简单算术考倒 o1 和 Llama 等 20 多个主流模型

导读:

北京时间月日年法国蒙彼利埃冠军赛结束第四日争夺这个比赛日堪称爆冷日在决出男单四强和女单四强的同时大种子选手输球出局无缘八强包括女单前两号种子王艺迪和陈幸同在王艺迪和陈幸同出局后...

北京时间10月26日,2024年WTT法国蒙彼利埃冠军赛结束第四日争夺,这个比赛日堪称爆冷日,在决出男单四强和女单四强的同时,6大种子选手输球出局,无缘八强,包括女单前两号种子王艺迪和陈幸同。在王艺迪和陈幸同出局后,国乒女单只剩钱天一,而男单还剩林诗栋和梁靖崑。男单1/8决赛,赛会3号种子雨果·卡尔德拉诺虽然在0-2...

IT之家 11 月 2 日消息,《洛杉矶时报》昨日(11 月 1 日)发布博文,报道称苹果研究团队 了 20 个最先进的 AI 模型,发现在有干扰项存在的情况下,它们处理简单的算术问题时表现不佳,甚至不如小学生。

苹果 AI 研究:简单算术考倒 o1 和 Llama 等 20 多个主流模型

用以下这道简单的题 20多个最先进的 AI 模型,IT之家附上题目如下:

Oliver 在星期五采摘了 44 个猕猴桃、然后他在星期六采摘了 58 个,星期日采摘的数量是星期五的两倍,不过其中有 5 个猕猴桃的块头要比平均值要小,请问 Oliver 这三天共摘了多少个猕猴桃?

正确 是 190 个,计算公式为 44(星期五)+58(星期六)+88(44*2,星期日)。

不过 的 20 多个最先进 AI 模型无法排除干扰项,通常不理解猕猴桃的大小和数量无关,大部分的结果是 185 个。

苹果团队发现,当问题包含看似相关但实际上无关的信息时,AI 模型的表现急剧下降。对此研究认为,AI 模型主要依赖于训练数据中的语言模式,而非真正理解数学概念。

苹果的研究表明,目前的 AI 模型“无法进行真正的逻辑推理”。这一发现提醒我们,尽管 AI 在某些任务上表现出色,但其智能并不如表面看起来那样可靠。

苹果团队指出,简单地扩展数据或计算能力并不能根本 这个问题,苹果的论文并非旨在削弱对 AI 能力的热情,而是提供一种理性的认知。

返回列表
上一篇:
下一篇:

发表评论中国互联网举报中心

快捷回复:

验证码

    评论列表 (暂无评论,共83人参与)参与讨论

    还没有评论,来说两句吧...