点赞送书啦！大模型应用落地指南

学术 2024-09-27 08:03 湖北

在本篇文章下方留言，点赞数量最高的2位朋友将获得《大型语言模型实战指南：应用实践与场景落地》1本

自ChatGPT模型问世后，在全球范围内掀起了AI新浪潮。

有很多企业和高校也随之开源了一些效果优异的大模型，例如：Qwen系列模型、MiniCPM序列模型、Yi系列模型、ChatGLM系列模型、Llama系列模型、Baichuan系列模型、Deepseek系列模型、Moss模型等。

图片来自：A Survey of Large Language Models

并且在去年的一整年中，大多数人都在做底座通用大模型的搭建、垂直领域大模型预训练或微调等工作。虽然大模型基础能力得到了很大程度的提升，但是大模型距离真正地落地，其实还有一段艰难的路要走。

图片来自：A Survey of Large Language Models

那么如何让大模型更好地进行场景落地，变得尤为重要。例如：如何优化通用大模型在领域上的效果，如何在某些场景中合理运用大模型，如何确保生成内容的稳定性和安全性，如何确保大模型可以在生产环境下稳定使用等。

《大型语言模型实战指南》一书从大模型应用落地角度出发，系统梳理了大模型的相关技术，也帮助读者学习如何优化开源大模型在不同领域或场景中的效果，详细讲述了如何搭建角色扮演、信息抽取、知识问答、AI Agent等各种各样的大模型应用。

角色扮演

角色扮演应用主要利用大模型来模拟不同属性和风格的人物和角色，如游戏人物、动漫角色、网络小说的主角、电影人物、电视人物，以及历史名人等，旨在为用户带来更精细、更沉浸的交互体验。

图片来自：From Persona to Personalization: A Survey on Role-Playing Language Agents

为了确保用户获得最佳的体验，角色扮演应用不仅需模拟角色基本的对话流程，还要求大型语言模型深入理解角色的性格、故事背景、情感状态和行为模式，从而塑造出更为智能和生动的AI角色。可以应用在教育、游戏、咨询、创作、培训等多个领域中。

图片来自：Two Tales of Persona in LLMs: A Survey of Role-Playing and Personalization

Text2SQL

Text2SQL应用就是将自然语言查询转换为结构化查询语言（SQL）语句，以便从数据库中检索数据。随着大模型能力的逐步提高，解决Text2SQL的任务的方法也从传统深度学习模型转向大模型。并且各种平台系统的ChatBI、数据分析等功能，均离不开Text2SQL技术。

图片来自：A Survey on Employing Large Language Models for Text-to-SQL Tasks

RAG

RAG（Retrieval-Augmented Generation，检索增强生成）技术，主要是在大型语言模型生成答案之前，通过检索方法从数据库中检索与用户查询相关的信息，利用这些相关信息指引大型语言模型进行答案生成。

RAG不仅极大程度地解决大型语言模型幻觉的问题，还提高模型回复的可靠性，提供生成答案的溯源信息，并且通过更新外部知识库实现对于知识的更新，无需重新训练模型，减少了模型训练更新的成本。目前，已经成为大型语言模型应用落地的重要方向。

RAG的整体流程主要涉及查询处理模块、内容检索模块、内容组装模块和大模型生成4个部分。当系统接收到用户查询Query进行初步处理后，利用向量检索模型从构建的向量知识库中检索到与其最相关的文档片段内容，再通过提示工程对用户查询Query和文档片段进行组装，最后利用大模型生成一个答案。

图片来自：Retrieval-Augmented Generation for Large Language Models: A Survey

AI Agent

Agent是能够感知自身所处环境、自我决策并采取行动的人工智能实体。Agent技术的应用范围广泛且多样化，它们不仅仅是简单的自动化工具，而是能够在多个领域中提供高效和创新的解决方案。

自动化和效率化的工具：从简单的数据查询到复杂的决策制定，它们都能显著减少人工操作的需求，优化工作流程。
数据分析和处理：在处理大量数据和执行复杂分析方面，能够从海量数据中提取有价值的信息，为企业和研究者提供快速、准确的洞察。
交互式用户体验：通过自然语言处理和上下文感知技术，提供个性化和互动的用户体验，从而改善用户交互。
智能决策支持：作为决策支持工具，在分析复杂情况和提供基于数据的建议方面表现突出，特别是在商业、医疗和科研等领域。
集成与扩展服务：通过API调用外部服务，为用户提供全面和扩展的功能。可以通过API调用外部服务，将不同的功能和信息源集成到一个统一的接口中。
自适应学习和进化：能够根据用户反馈和行为模式不断进化，以更好地满足用户需求。

The Rise and Potential of Large Language Model Based Agents: A Survey

文章来源：IT阅读排行榜

本文摘编自《大型语言模型实战指南：应用实践与场景落地》，机械工业出版社出版，经出版方授权发布，转载请标明文章来源。

▼

延伸阅读

《大型语言模型实战指南：应用实践与场景落地》

刘聪沈盛宇李特丽杜振东著

资深大模型技术专家撰写

零一万物、通义千问、面壁智能等

多个主流大模型的负责人力荐

内容简介：

这是一本系统梳理并深入解析大模型的基础理论、算法实现、数据构造流程、模型微调方法、偏好对齐方法的著作，也是一本能手把手教你构建角色扮演、信息抽取、知识问答、AI Agent等各种强大的应用程序的著作。本书得到了零一万物、面壁智能、通义千问、百姓AI、澜舟科技等国内主流大模型团队的负责人的高度评价和鼎力推荐。

本文来源：原创，图片来源：原创
责任编辑：王莹，部门领导：宁姗
发布人：白钰

http://mp.weixin.qq.com/s?__biz=MzkyOTU5NzY1Mw==&mid=2247489426&idx=1&sn=fc7c0481ac25f7f121df311c7bc03a15

NLP前沿

一手ai news分享 \x26amp; 热点paper解读

最新文章

测试时训练(TTT)太强了！

大模型也能"反悔"了！

Merkle树+RAG，Cursor的秘密曝光!

GraphRAG进化，效率翻倍！

8个月炼出好"钢"，Steel-LLM开源了~

OpenAI发布GPT学习法则~

465次实验炸出大模型量化真相

Qwen2.5.1 Coder系列开源来袭！冲！

一篇大模型RAG最新综述

解密o1，六大推理秘诀大曝光！

GraphRAG 0.4来袭：增量更新+DRIFT，起飞~

Llama 3退位，腾讯Hunyuan强势登顶

文本分块的天花板来了~

三连发！1.7B小模型把大厂干懵了~

给RAG装上眼睛，性能暴涨39%！

AI助攻SCI，这招太强了

KAG来了，RAG慌了！

传统RAG凉凉？多模态RAG带来工业级革命

AutoRAG开源：RAG界的AutoML终于来了！

智谱大气！首个语音到语音国产大模型开源

大模型数学能力翻车实锤！Apple新研究暴露真相~

prompt要自己写自己了！大厂扎堆放大招~

Claude昨夜王炸！新模型暴打o1，还能玩电脑~

RAG遇上知识冲突，Google祭出终极大招~

向o1看齐，google开源RAG推理扩展，提升近60%

微软开源，CPU推理100B模型，速度飞起~

Llama3 太炸裂了！远超过去的体验！

英伟达一夜封神，开源新模型打进全球前三！

忘记社区，lightrag开源graph的又一用法

entropix，终于找到了真正解决幻觉的方法了

是时候更新vllm了，新版吞吐提升2倍

openai今天open了2下，prompt自动生成器、Agent框架开源

手撕LLM+RLHF+VLM+o1推理，我全都要!!!

现实再次给大模型带来沉重打击

cde，世界上最好的 BERT 大小文本嵌入模型

卷疯了！开源社区离openai o1越来越近~

openai突发上架新模型：gpt4t-lu-test

SFT无需指令，响应微调开源~

点赞送书啦！大模型应用落地指南

Meta刚开源llama 3.2多模态，就被打败了~

cot-decoding，谷歌把o1的底裤都开源了

openai终于open了，开源了，别骂了~

免费送！我们出版了首本大模型RAG书籍

如果思维链都满足不了你，那思维图尼？

RL驱动的Reflection炼丹，谷歌开源SCoRe

大模型Agent，如何利用历史经验自我进化？

OpenAI o1时代，RLHF和多模态我全都要！！！

Qwen2.5系列开源来袭！冲！

达到草莓的70%！首个open o1项目开源

疯狂24h后，openai o1有哪些新的秘密？

分类

时事

民生

政务

教育

文化

科技

财富

体娱

健康

情感

旅行

百科

职场

楼市

企业

乐活

学术

汽车

时尚

创业

美食

幽默

美体

文摘

原创标签

时事社会财经军事教育体育科技汽车科学房产搞笑综艺明星音乐动漫游戏时尚健康旅游美食生活摄影宠物职场育儿情感小说曲艺文化历史三农文学娱乐电影视频图片新闻宗教电视剧纪录片广告创意壁纸头像心灵鸡汤星座命理教育培训艺术文化金融财经健康医疗美妆时尚餐饮美食母婴育儿社会新闻工业农业时事政治星座占卜幽默笑话独立短篇连载作品文化历史科技互联网

发布位置

广东北京山东江苏河南浙江山西福建河北上海四川陕西湖南安徽湖北内蒙古江西云南广西甘肃辽宁黑龙江贵州新疆重庆吉林天津海南青海宁夏西藏香港澳门台湾美国加拿大澳大利亚日本新加坡英国西班牙新西兰韩国泰国法国德国意大利缅甸菲律宾马来西亚越南荷兰柬埔寨俄罗斯巴西智利卢森堡芬兰瑞典比利时瑞士土耳其斐济挪威朝鲜尼日利亚阿根廷匈牙利爱尔兰印度老挝葡萄牙乌克兰印度尼西亚哈萨克斯坦塔吉克斯坦希腊南非蒙古奥地利肯尼亚加纳丹麦津巴布韦埃及坦桑尼亚捷克阿联酋安哥拉