苹果研究团队曾测试20款先进AI模型 在有干扰项下简单算术题表现甚至不如小学生

花花2024-11-02热点分享22

  IT之家 11 月 2 日消息,《洛杉矶时报》昨日(11 月 1 日)发布博文,报道称苹果研究团队测试了 20 个最先进的 AI 模型,发现在有干扰项存在的情况下,它们处理简单的算术问题时表现不佳,甚至不如小学生。

  苹果公司用以下这道简单的算术题测试 20 多个最先进的 AI 模型,IT之家附上题目如下:

苹果研究团队曾测试20款先进AI模型 在有干扰项下简单算术题表现甚至不如小学生

  Oliver 在星期五采摘了 44 个猕猴桃、然后他在星期六采摘了 58 个猕猴桃,星期日采摘的数量是星期五的两倍,不过其中有 5 个猕猴桃的块头要比平均值要小,请问 Oliver 这三天共摘了多少个猕猴桃?

  正确答案是 190 个,计算公式为 44(星期五)+58(星期六)+88(44*2,星期日)。

  不过测试的 20 多个最先进 AI 模型无法排除干扰项,通常不理解猕猴桃的大小和数量无关,大部分的结果是 185 个。

  苹果团队发现,当问题包含看似相关但实际上无关的信息时,AI 模型的表现急剧下降。对此研究认为,AI 模型主要依赖于训练数据中的语言模式,而非真正理解数学概念。

  苹果的研究表明,目前的 AI 模型“无法进行真正的逻辑推理”。这一发现提醒我们,尽管 AI 在某些任务上表现出色,但其智能并不如表面看起来那样可靠。

  苹果团队指出,简单地扩展数据或计算能力并不能根本解决这个问题,苹果的论文并非旨在削弱对 AI 能力的热情,而是提供一种理性的认知。

相关文章

联合国《生物多样性公约》第十六次缔约方大会在哥伦比亚开幕,聚焦生物多样性等议题

联合国《生物多样性公约》第十六次缔约方大会在哥伦比亚开幕,聚焦生物多样性等议题

  当地时间10月20日下午,为期12天的联合国《生物多样性公约》第十六次缔约方大会(COP16)在哥伦比亚的卡利举行仪式性开幕式。联合国秘书长古特雷斯、哥伦比亚总统佩特罗、...

思勰投资回应总经理吴家麒离职四大热点:吴家麒不会自立门户,新任总经理由李苏苏担任

思勰投资回应总经理吴家麒离职四大热点:吴家麒不会自立门户,新任总经理由李苏苏担任

专题:百亿私募思勰投资总经理吴家麒要离职,管理产品2个月亏8%...

财政增量政策利好!机构:行情进入换挡期,科技板块或成主线!科技ETF(515000)单周获超4亿元资金增仓

财政增量政策利好!机构:行情进入换挡期,科技板块或成主线!科技ETF(515000)单周获超4亿元资金增仓

  上周(10月8日-11日),A股市场经历剧烈震荡,市场涨跌“换挡”后,半导体先扬后抑,科技龙头板块回落明显,代表A股科技龙头行情的科技ETF(515000)日线三连阴。对...

王洪栋将出任信银理财董事长 原为中信银行财富管理部总经理

王洪栋将出任信银理财董事长 原为中信银行财富管理部总经理

近日,记者从业内人士处获悉,中信银行财富管理部总经理王洪栋将出任信银理财董事长。   信银理财前任董事长为谷凌云,现已升任中信银行副行长。9月20日,中信银行公告...