大家好,今天小编来为大家解答【苹果AI研究:“猕猴桃”简单算术考倒o1和Llama等20多个最先进模型】这个问题,很多人还不知道,现在让我们一起来看看吧!
IT之家 11 月 2 日消息,《洛杉矶时报》昨日(11 月 1 日)发布博文,报道称苹果研究团队测试了 20 个最先进的 AI 模型,发现在有干扰项存在的情况下,它们处理简单的算术问题时表现不佳,甚至不如小学生。
苹果公司用以下这道简单的算术题测试 20 多个最先进的 AI 模型,IT之家附上题目如下:
Oliver 在星期五采摘了 44 个猕猴桃、然后他在星期六采摘了 58 个猕猴桃,星期日采摘的数量是星期五的两倍,不过其中有 5 个猕猴桃的块头要比平均值要小,请问 Oliver 这三天共摘了多少个猕猴桃?
正确答案是 190 个,计算公式为 44(星期五)+58(星期六)+88(44*2,星期日)。
不过测试的 20 多个最先进 AI 模型无法排除干扰项,通常不理解猕猴桃的大小和数量无关,大部分的结果是 185 个。
苹果团队发现,当问题包含看似相关但实际上无关的信息时,AI 模型的表现急剧下降。对此研究认为,AI 模型主要依赖于训练数据中的语言模式,而非真正理解数学概念。
苹果的研究表明,目前的 AI 模型“无法进行真正的逻辑推理”。这一发现提醒我们,尽管 AI 在某些任务上表现出色,但其智能并不如表面看起来那样可靠。
苹果团队指出,简单地扩展数据或计算能力并不能根本解决这个问题,苹果的论文并非旨在削弱对 AI 能力的热情,而是提供一种理性的认知。
以上就是【苹果AI研究:“猕猴桃”简单算术考倒o1和Llama等20多个最先进模型】相关内容,更多资讯请关注科技网
大家好,今天小编来为大家解答【一加Ace 5 Pro发布:骁龙8至尊版游戏旗舰,售价3299元起】这个问题,很多人还不知道,现在让我们一起来看看吧!凤凰网科技讯 12月26日,一加今日召开新品发布会,一加Ace5系列新机正式发布。新机包含标准版和Pro两款,主打 ...
大家好,今天小编来为大家解答【理想创始人李想重新露面并发声:不做特斯拉那样的 RoboTaxi,但想做一辆超级跑车】这个问题,很多人还不知道,现在让我们一起来看看吧!编者注:自今年上半年理想创始人李想不再在微博公开发声之后,他消失在公众视野已经 ...
大家好,今天小编来为大家解答【即梦对阵可灵,重演抖音反超快手?】这个问题,很多人还不知道,现在让我们一起来看看吧!快手可灵,只是抖音即梦的下一个目标罢了。年初从抖音 CEO 位置上辞职的张楠,应该度过了一个充实的 2024 年。在中央美术学院设计 ...
大家好,今天小编来为大家解答【董明珠回应“格力电器比竞品贵”:格力做的不是眼前一点利益】这个问题,很多人还不知道,现在让我们一起来看看吧!IT之家 12 月 26 日消息,针对“格力电器卖得贵”等声音,新浪财经今日发布访谈视频,董明珠在《珍知酌见》栏 ...
大家好,今天小编来为大家解答【199元!特斯拉Bot人形机器人开售即抢光:二手平台溢价超百元】这个问题,很多人还不知道,现在让我们一起来看看吧!快科技12月26日消息,特斯拉最新周边产品Tesla Bot摆件,已于今日上午10:00对外发售,官网定价为199元。 ...
大家好,今天小编来为大家解答【一夜之间,黄子韬托举雷军上神坛】这个问题,很多人还不知道,现在让我们一起来看看吧!短视频平台从不缺乏一夜之间粉丝暴涨几百万的传奇故事。K总、听泉赏宝、理发师晓华莫不如是。而如今这泼天的富贵轮到了曾经的顶流偶 ...
大家好,今天小编来为大家解答【红果短剧:深入落实广电主管部门指导要求、加强内容治理】这个问题,很多人还不知道,现在让我们一起来看看吧!IT之家 12 月 26 日消息,广电总局网络视听司、北京市广电局 12 月 25 日联合约见“红果短剧”主要负责人,对其 ...
大家好,今天小编来为大家解答【抖音生服年底冲GMV:放开部分类目押金限制,增加团购补贴】这个问题,很多人还不知道,现在让我们一起来看看吧!雷峰网独家获悉,抖音生服年底冲GMV放开类目限制,进一步增加补贴。11月到12月,抖音生服陆续放开一些原本需 ...
大家好,今天小编来为大家解答【格力申请“格力好强”商标 董明珠此前称“不用格力是傻瓜”】这个问题,很多人还不知道,现在让我们一起来看看吧!凤凰网科技讯 12月26日,爱企查App显示,近日,珠海格力电器股份有限公司申请注册多枚“格力好强”的商标,国际 ...
大家好,今天小编来为大家解答【英媒:中国电动汽车销量2025年将首超传统汽车】这个问题,很多人还不知道,现在让我们一起来看看吧!比亚迪电动汽车凤凰网科技讯 北京时间12月26日,据英国《金融时报》报道,中国电动汽车销量预计将在明年首次超越内燃机 ...