Nat. Mach. Intell. | 用化学工具扩充大型语言模型

文摘 2024-11-02 00:03 北京

背景：

大型语言模型（LLMs）在多个领域的任务中表现出色，但在处理与化学相关的问题时却面临挑战。作者们指出，尽管LLMs在自然语言处理方面取得了显著进展，但它们在化学领域的应用仍然存在局限性。因此，研究团队提出了一种名为ChemCrow的代理，旨在通过整合多种化学工具来增强LLMs的能力，以便更好地解决化学合成、药物发现和材料设计等复杂任务。

图1.ChemCrow系统的概述和工具集

结果：

（1）自主化学合成

图2. a.用户启动ChemCrow脚本示例。b.硫脲类有机催化剂的研究与合成。

c.实验执行的合成平台。d.实验验证的化合物。

（2）Human-AI协作

图3.人类-模型的相互作用导致新发色团的发现

ChemCrow通过结合18个专家设计的工具和使用GPT-4作为基础LLM，增强了在化学领域的性能。该代理能够自主规划和执行化学合成，包括昆虫驱避剂和有机催化剂的合成，以及指导新型发色团的发现。ChemCrow的工作流程包括使用工具进行推理、选择适当的工具、使用工具以及分析结果，直到达到最终答案。

（3）评估

图4.评估结果

研究通过LLM和专家评估对ChemCrow和GPT-4进行了性能比较。

化学家专家的评估表明，ChemCrow在化学事实性、推理和反应完整性方面优于GPT-4，特别是在更复杂的任务中。虽然GPT-4可能在涉及记忆的任务中表现更好，比如合成扑热息痛和阿司匹林等众所周知的分子，但ChemCrow在新任务或不太为人所知的任务中表现出色，这些任务更有用，更有挑战性。
相反，llm支持的评估倾向于GPT-4，主要是因为它的反应更流畅、更完整。值得注意的是，在评估化学推理模型的真正有效性时，llm驱动的评估可能不如人类评估可靠。这种差异凸显了进一步完善评估方法的必要性，以更好地捕捉像ChemCrow这样的系统在解决复杂的现实化学问题方面的独特能力。

研究者认为ChemCrow有潜力成为化学实验室中的宝贵助手，并在化学任务解决方面发挥重要作用。

http://mp.weixin.qq.com/s?__biz=MzU2ODgzMTM5NA==&mid=2247499784&idx=1&sn=80f8bf14787fce3e55de453368515390

CAAI认知系统与信息处理专委会

CAAI认知系统与信息处理专委会成立于2014年，胡德文教授担任专委会主任，孙富春教授担任荣誉主任，方斌教授担任秘书长。专委会不断吸纳业界人才，会员1000余名。创建了“认知系统与信息处理国际会议”、“机器人智能论坛”等品牌活动。

最新文章

第九届认知系统与信息处理国际会议（ICCSIP 2024）即将在常州召开！

具身触觉社区“新锐论前沿” 第一期活动成功举办

柔性仿人手指全覆盖磁皮肤，具备接触觉和运动觉的双模态感知能力

迄今结构最简洁的双向刚度仿人手指关节，设计灵感源自卷尺

大面积柔性磁触觉感知

超人手功能的软体指尖：磁触觉感知兼具吸附抓取能力

控制系统可控性检验理论的变革：从模型驱动到数据驱动

强化学习和模型预测控制的区别与联系

强化学习经典教材的配套源代码上线了

推荐清华大学李升波教授撰写的强化学习英文专著

Nature Communications 基于触觉手套的深度学习驱动视触觉动态重建方案

Springer英文专著分享：结合穿戴技术的机器人操作与学习

Nature Communications 麻省理工学院计算机科学与人工智能实验室研制“触觉反馈”智能数据手套

ICRA 2024: 使用Masked Visual-Tactile 对机器人操作预训练

Science Robotics 封面论文：视触觉传感器的手内操作

Advanced Functional Materials 人工皮肤—基于视触觉传感的三维重建技术：材料、方法和评估

Advanced Intelligent Systems 综述论文：视触觉传感器的力测量技术

Advanced Intelligent Systems视触觉传感器在矿物/岩石识别中的应用探索

IEEE Sensors 视触觉传感器的硬件技术综述

IEEE JSTSP综述：从信号处理领域分析视触觉传感器的研究

不列颠哥伦比亚大学（The University of British Columbia）刘超助理教授招生公告~

新加坡国立大学机器人方向（AdaComp 研究组）科研实习机会

斯坦福李飞飞吴佳俊团队建立HourVideo，揭示当前模型在长视频理解上与人类水平的差距

具身触觉社区 | “新锐论前沿” 第一期活动预告

清华大学张钹院士发表人民日报最新文章：具身智能—人工智能与机器人发展的重要推力

高教出版社《具身智能导论》正式出版

中文专著《机器人触觉感知原理与方法》正式出版

具身触觉社区 | “新锐论前沿” 第一期活动预告

美国《福布斯》刊登文章：2025年人工智能（AI）的十大趋势

2024 AI年度报告发布，附十大预测：人形机器人热度下降，英伟达维持霸主地位

Science Robotics 综述揭示演化研究新范式，从机器人复活远古生物！

CoRL2024 聚焦「视听触感官」协同配合的具身智能操作

Nature正刊：西湖大学姜汉卿教授与John A. Rogers-黄永刚-解兆谦联合开发新型的多模态触觉反馈智能穿戴装置

Nature正刊：利物浦大学的研究人员开发了人工智能驱动的移动机器人，可以高效地进行化学合成研究

Science Robotic 综述论文：通过机器人技术了解自我意识

Science Robotics 对机器人的意图归因将会影响人机协作感

Science Robotics 专刊总结：借助机器人技术推进科学发现

IEEE TRO综述论文：抓取合成领域的深度学习方法

NeurIPS 2024 | 机器人操纵世界模型来了，成功率超过谷歌RT-1 26.6%

高教出版社《具身智能导论》正式出版

具身智能综述：鹏城实验室&中大调研近400篇文献，深度解析具身智能

具身智能的视觉-语言-动作模型综合综述论文

谷歌、CMU等研究综述：面向通用机器人的基础模型

机器人神经场的全面盘点：导航/自动驾驶/姿态估计应用一览无余

CMU, UC Berkeley等团队结合神经辐射场的视触觉感知，用于手内操作

Nat. Mach. Intell. | 用化学工具扩充大型语言模型

清华叉院高阳团队首次发现具身智能Scaling Laws

Advanced Functional Materials 人工皮肤—基于视触觉传感的三维重建技术：材料、方法和评估

Advanced Intelligent Systems 综述论文：视触觉传感器的力测量技术

Advanced Intelligent Systems视触觉传感器在矿物/岩石识别中的应用探索

分类

时事

民生

政务

教育

文化

科技

财富

体娱

健康

情感

旅行

百科

职场

楼市

企业

乐活

学术

汽车

时尚

创业

美食

幽默

美体

文摘

原创标签

时事社会财经军事教育体育科技汽车科学房产搞笑综艺明星音乐动漫游戏时尚健康旅游美食生活摄影宠物职场育儿情感小说曲艺文化历史三农文学娱乐电影视频图片新闻宗教电视剧纪录片广告创意壁纸头像心灵鸡汤星座命理教育培训艺术文化金融财经健康医疗美妆时尚餐饮美食母婴育儿社会新闻工业农业时事政治星座占卜幽默笑话独立短篇连载作品文化历史科技互联网

发布位置

广东北京山东江苏河南浙江山西福建河北上海四川陕西湖南安徽湖北内蒙古江西云南广西甘肃辽宁黑龙江贵州新疆重庆吉林天津海南青海宁夏西藏香港澳门台湾美国加拿大澳大利亚日本新加坡英国西班牙新西兰韩国泰国法国德国意大利缅甸菲律宾马来西亚越南荷兰柬埔寨俄罗斯巴西智利卢森堡芬兰瑞典比利时瑞士土耳其斐济挪威朝鲜尼日利亚阿根廷匈牙利爱尔兰印度老挝葡萄牙乌克兰印度尼西亚哈萨克斯坦塔吉克斯坦希腊南非蒙古奥地利肯尼亚加纳丹麦津巴布韦埃及坦桑尼亚捷克阿联酋安哥拉

​Nat. Mach. Intell. | 用化学工具扩充大型语言模型

Nat. Mach. Intell. | 用化学工具扩充大型语言模型