首页　>　 AI教程资讯 > 苹果AI研究：“猕猴桃”简单算术考倒o1和Llama等20多个最先进模型

苹果AI研究：“猕猴桃”简单算术考倒o1和Llama等20多个最先进模型

1764 2025-07-02 00:00:00

IT之家11月2日消息，《洛杉矶时报》昨日（11月1日）发布博文，报道称苹果研究团队测试了20个最先进的AI模型，发现在有干扰项存在的情况下，它们处理简单的算术问题时表现不佳，甚至不如小学生。

苹果公司用以下这道简单的算术题测试20多个最先进的AI模型，IT之家附上题目如下：

Oliver在星期五采摘了44个猕猴桃、然后他在星期六采摘了58个猕猴桃，星期日采摘的数量是星期五的两倍，不过其中有5个猕猴桃的块头要比平均值要小，请问Oliver这三天共摘了多少个猕猴桃？

正确答案是190个，计算公式为44（星期五）+58（星期六）+88（44*2，星期日）。

不过测试的20多个最先进AI模型无法排除干扰项，通常不理解猕猴桃的大小和数量无关，大部分的结果是185个。

苹果团队发现，当问题包含看似相关但实际上无关的信息时，AI模型的表现急剧下降。对此研究认为，AI模型主要依赖于训练数据中的语言模式，而非真正理解数学概念。

苹果的研究表明，目前的AI模型“无法进行真正的逻辑推理”。这一发现提醒我们，尽管AI在某些任务上表现出色，但其智能并不如表面看起来那样可靠。

苹果团队指出，简单地扩展数据或计算能力并不能根本解决这个问题，苹果的论文并非旨在削弱对AI能力的热情，而是提供一种理性的认知。

相关推荐