首页时事民生政务教育文化科技财富体娱健康情感

旅行百科职场楼市企业乐活学术汽车时尚创业美食幽默美体文摘

LLM为何频频翻车算术题？最新研究追踪单个神经元，「大脑短路」才是根源

科技 2024-11-19 12:47 北京

新智元报道

编辑：peter东乔杨

【新智元导读】大模型在数学问题上的表现不佳，原因在于采取启发式算法进行数学运算的，通过定位到多层感知机（MLP）中的单个神经元，可以对进行数学运算的具体过程进行解释。

由于缺少对运行逻辑的解释，大模型一向被人称为「黑箱」，但近来的不少研究已能够在单个神经元层面上解释大模型的运行机制。

例如Claude在2023年发表的一项研究，将大模型中大约500个神经元分解成约4000个可解释特征。

而10月28日的一项研究，以算术推理作为典型任务，借鉴类似的研究方法，确定了大模型中的一个模型子集，能解释模型大部分的基本算术逻辑行为。

论文地址：https://arxiv.org/abs/2410.21272

该研究首先定位了Llama3-8B/70B, Pythia-6.9B及GPT-J四个模型中负责算术计算的模型子集。

如图1所示，少数注意力头对大模型面对算术问题的正确率有显著影响。第一个 MLP（多层感知机）明显影响操作数和操作符位置，而中间层和后期层的 MLP 将token信息投影到最后位置，提升正确答案的出现概率。

图1：Llama3-8B中发现算术相关的模型子集

该研究聚焦于单个神经元层面，发现了一组重要的神经元，它们实现了简单的启发式算法。只需要关注特定的极少量神经元，就能正确预测大模型进行算术运算的结果（图2）。

图2：大模型中每层神经元中只需要关注1.5%的少数子集，就能预测大模型进行四则运算的结果

举个例子：当输入的提示词为“ 226−68= ”时，神经元24｜12439在结果介于150和180的减法提示下显示出高激活值，可被视为一个启发式算法。而每个启发式算法识别一个数值输入模式，并输出相应的答案。

具体可分为两种不同的激活模式：第一种直接启发式指的是在某些神经元中，激活模式取决于两个操作数，值向量编码了算术计算的预期结果（图 3b,c）。

第二种间接激活模式取决于单个操作数对应的神经元中，值向量通常编码下游处理的特征，而不是直接的计算结果（图3a）。

图3：启发式方法的可视化

神经元和运算的因果联系

该如何确认特定神经元和相关数学运算之间存在因果关系？一种常见的方法是消融分析，即将大模型大模型中特定的神经元敲除，看看模型的效果会有何改变，结果如图4所示。

图4：四则运算中敲除对应的算术神经元后模型的性能对比

去掉了对应神经元后，模型的运算准确性无论加减乘除都显著下降。

不仅如此，相比去除特定算术神经元时造成的性能下降，可以发现，去除随机神经元的影响相对较小，而且这种效应在模型8B和70B不同参数量中普遍存在。

图5：敲除与算术相关的启发式算法的神经元（实线）相比与算术无关的相同数量的随机神经元（虚线）

上述结果表明，可仅根据其相关启发式算法来识别对特定对大模型进行算术重要的神经元，也证明了属于几个启发式算法的神经元与提示正确完成之间的因果关系。

此外，该结果还支持了启发式算法集合的主张：即每个启发式算法仅略微提高正确答案的几率，但它们结合在一起，使得大模型以高概率产生算术题的正确答案。

大模型为何做不对算术题

Llama3-8B模型无法可靠地对每道算术题时给出正确的回答。基于启发式规则，该研究阐述了模型为何会做错，可能的机制共有两种：

第一，由于参数量的限制，大模型缺乏足够的算术神经元，无法针对每一种情况都给出应对。

第二种原因是，可能存在回忆不完整的情况，比如某个启发式规则对应的神经元没有在运算时被触发。

图6：随机抽取了50个正确完成和50个错误完成的算术题目，考察大模型中被正确和错误激活的算术神经元个数

如图6所示，在大模型回答正确及错误时，激活的算术神经元个数不存在差异，这不支持前述的第一种算术神经元个数不足的假设。

然而，在大模型回答正确的情况下，更多比例的正确神经元被激活了，而回答错误的案例中，应当被激活的神经元激活概率反而较小。

这意味着大模型在特定算术题上失败的主要原因是对能得出正确答案的神经元缺少泛化能力，而不是算术神经元的数量不足。

「算术神经元」何时诞生

由于其训练检查点可供公众获取，该研究采用Pythia-6.9B来考察大模型过程中算术神经元的出现阶段。

结果显示，大模型在训练过程中逐渐发展其最终的算术启发式机制，且算术神经元在模型训练早期就已出现。

图7 ：启发式的算术神经元的百分比随着训练增加

在模型训练的不同阶段，移除特定的启发式神经元会大幅降低模型在所有训练检查点的准确性，这表明算术准确性主要来自启发式，即使在早期阶段也是如此。算术启发式神经元与大模型算术能力的因果关系在整个训练过程中都存在。

图8：不同阶段敲除算术神经元对大模型进行算术运算准确性的影响

结论

理解大模型如何进行数学运算，不仅可以打开大模型内部运行的黑箱，解释它们为何在简单的数学题上翻车，例如最著名的「9.11和9.8哪个大」。

这项研究告诉我们，并不是因为大模型缺少相关训练，而是激活了错误的启发式神经元，例如将这个问题当成了询问哪个版本更大。

理解了大模型的算术运算，是依赖于启发式方法集，而非单纯的依靠记忆（背题目）或学会规则，这表明提高大模型的数学能力可能需要训练和架构的根本性改变，而不是像激活引导这样的小修小补。

对训练过程的分析结果指出，大模型在训练早期就学会了这些启发式方法，并随时间推移逐渐强化。这可能会导致模型过度拟合到早期的简单策略，因此可作为之后优化方向的参考。

参考资料：

https://arxiv.org/abs/2410.21272

http://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652541727&idx=3&sn=e035f557182011b105cf815f19f7eb3b

智能+中国主平台，致力于推动中国从互联网+迈向智能+新纪元。重点关注人工智能、机器人等前沿领域发展，关注人机融合、人工智能和机器人革命对人类社会与文明进化的影响，领航中国新智能时代。

最新文章

周鸿祎黑客短剧震撼首秀，直接带火纳米搜索！搜学写创，开启AI搜索3.0时代

数字孪生心脏全球首次实现0.84秒超实时模拟！智源突破计算极限，180倍性能提升

代码模型自我进化超越GPT-4o蒸馏！UIUC伯克利等提出自对齐方法 | NIPS 2024

当AI创造AI，就是库兹韦尔「奇点」临近时？人类正处于自我改进AI爆炸边缘

招人！新智元邀你勇闯ASI之巅

十年再登巅峰！刚刚，Ilya和GAN之父斩获NeurIPS 2024时间检验奖

AI卷翻科研！DeepMind 36页报告：全球实验室被「AI科学家」指数级接管

AI造芯Nature论文遭围攻，谷歌发文硬刚学术抹黑！Jeff Dean怒怼：你们连模型都没训

不是RNN的锅！清华团队深入分析长上下文建模中的状态崩溃，Mamba作者点赞

一文看尽Meta开源大礼包！全面覆盖图像分割、语音、文本、表征、材料发现、密码安全性等

招人！新智元邀你勇闯ASI之巅

Sora半夜泄露3小时，物理效果惊人！奥特曼急拔网线，艺术家抗议被白嫖

逃回大厂！谷歌天才科学家Yi Tay——639天创业血泪史

打破LLM数据孤岛！Anthropic革命性MCP让大模型解锁全网数据，AGI要来了？

AI视频两巨头开战！Runway秒生现实大片，Luma动嘴创作电影

「学术版ChatGPT」登场！Ai2打造科研效率神器OpenScholar，让LLM帮你搞定文献综述

揭示Transformer「周期建模」缺陷！北大提出新型神经网络FAN，填补周期性特征建模能力缺陷

UC伯克利：给大模型测MBTI，Llama更敢说但GPT-4像理工男

招人！新智元邀你勇闯ASI之巅

GAN之父新冠后惊传罹患双重顽疾！听力减退心动过速，全网求医

OpenAI怒斥Scaling撞墙论！o1已产生推理直觉潜力巨大

指令跟随大比拼！Meta发布多轮多语言基准Multi-IF：覆盖8种语言，超4500种任务

世界模型挑战赛，单项奖金10000美元！英伟达全新分词器助力下一帧预测

招人！新智元邀你勇闯ASI之巅

Claude 3.5两小时暴虐50多名专家，编程10倍速飙升！但8小时曝出惊人短板

新晋AI编程神器干翻Cursor！首创实时感知无限用，估值12.5亿华人初创震惊AI界

扩散模型=进化算法！生物学大佬用数学揭示本质

招人！新智元邀你勇闯ASI之巅

美国教授痛心：UC伯克利GPA 4.0计算机本科生，毕业即失业？ML博士直呼太卷后悔转行

英特尔错失AI芯片浪潮，从放弃收购英伟达开始

一只暹罗猫竟是论文作者！谷歌学术20岁，创始人首次公开最魔幻学术故事

招人！新智元邀你勇闯ASI之巅

续命Scaling Law？世界模型GPT-4o让智能体超级规划，OSU华人一作

5年浴火，800余岁巴黎圣母院重生！马斯克激动转发，AI数字建模创奇迹

首个可保留情感的音频LLM！Meta重磅开源7B-Spirit LM，一网打尽「音频+文本」多模态任务

机器人训练数据不缺了！英伟达团队推出DexMG：数据增强200倍

招人！新智元邀你勇闯ASI之巅

全面进攻谷歌！OpenAI被曝打造浏览器，已挖Chrome创始大牛

预定下一个诺奖级AI？谷歌量子纠错AlphaQubit登Nature，10万次模拟实验创新里程碑

宝可梦GO「偷家」李飞飞空间智能？全球最强3D地图诞生，150万亿参数解锁现实边界

OpenAI薪酬大曝光！奥特曼身价145亿，年薪只有55万

世界最大AI Agent生态系统！微软推出全新「自主AI智能体」，10万企业工作流被改变

RAG没有银弹！四级难度，最新综述覆盖数据集、解决方案，教你「LLM+外部数据」的正确使用姿势

招人！新智元邀你勇闯ASI之巅

OpenAI看好的方向，文心智能体技术抢先爆发！

「全球最严榜单」，阶跃拿下中国TOP 1！杀入世界前五，超过GPT-4o紧跟o1-mini

收敛速度最高8倍，准确率提升超30%！华科发布MoE Jetpack框架 | NeurIPS 2024

405B大模型也能线性化！斯坦福MIT最新研究，0.2%训练量让线性注意力提分20+

招人！新智元邀你勇闯ASI之巅

美国AI曼哈顿计划793页文件曝光！全力研发AGI，十大战略直指中国

分类

原创标签

时事社会财经军事教育体育科技汽车科学房产搞笑综艺明星音乐动漫游戏时尚健康旅游美食生活摄影宠物职场育儿情感小说曲艺文化历史三农文学娱乐电影视频图片新闻宗教电视剧纪录片广告创意壁纸头像心灵鸡汤星座命理教育培训艺术文化金融财经健康医疗美妆时尚餐饮美食母婴育儿社会新闻工业农业时事政治星座占卜幽默笑话独立短篇连载作品文化历史科技互联网

发布位置

广东北京山东江苏河南浙江山西福建河北上海四川陕西湖南安徽湖北内蒙古江西云南广西甘肃辽宁黑龙江贵州新疆重庆吉林天津海南青海宁夏西藏香港澳门台湾美国加拿大澳大利亚日本新加坡英国西班牙新西兰韩国泰国法国德国意大利缅甸菲律宾马来西亚越南荷兰柬埔寨俄罗斯巴西智利卢森堡芬兰瑞典比利时瑞士土耳其斐济挪威朝鲜尼日利亚阿根廷匈牙利爱尔兰印度老挝葡萄牙乌克兰印度尼西亚哈萨克斯坦塔吉克斯坦希腊南非蒙古奥地利肯尼亚加纳丹麦津巴布韦埃及坦桑尼亚捷克阿联酋安哥拉