驯服大模型--大模型RAG调优总结

2024-08-23 16:20
文章标签 总结 模型 调优 rag 驯服

本文主要是介绍驯服大模型--大模型RAG调优总结,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

随着ChatGPT的兴起,大语言模型再次走进人们的视野,其在NLP领域表现出的语言识别、理解以及推理能力令人惊叹。越来越多的行业开始探索大语言模型的应用,比如航空、医疗等行业,针对特定领域设计的大模型往往对大模型的回答严谨程度有更高的要求,要求大模型“言之有据“是在解决细分问题是最基本的要求。

![](https://img-blog.csdnimg.cn/img_convert/011312c136ad0071eac05b2029d5617f.pn

在这样的普遍需求之下,本文将介绍针对大模型回复质量的调优方法,主要将以RAG与超参数设置作为主要切入点,介绍RAG技术基本架构与常见的实现流程,以及影响大模型回复质量的超参数解析。

大语言模型的不足及RAG优化

为了应对大语言模型的不足,通过采用半参数化方法,即RAG(Retrieval-Augmented Generation),结合非参数化的语料库数据库与参数化模型,以解决纯参数化模型的局限性。

大语言模型的不足

• 知识局限性:依赖于训练数据集的广度,难以学习内部数据和专业领域知识;

• 知识滞后性:无法学习模型训练后产生的新知识,且训练成本高,难以频繁更新;

• 幻觉问题:模型可能在不具备相关知识的场景下产生错误输出,且难以区分;

• 数据安全性:企业担心数据泄露,不愿将私域数据用于第三方平台训练,导致应用方案在数据安全和效果上需做出取舍。

RAG优化方向

RAG从数据建立到使用过程,可分为三个阶段,优化过程可从这三个阶段进行:

RAG 检索前:

RAG 检索前对知识的正确向量化对后续知识的检索非常重要:

图片来源:

《中国民航订座系统航班控制管理手册》

1、清理数据

  • 清理质量较差的数据

  • 保留质量的高的数据

  • 补充缺失的定义

2、合理切分

  • 合理分段,不采用按字数切分的方式,确保内容不被分割成多段

  • 采用 AI 辅助,对分段内容进行总结,去除无关内容

3、QA 对多样性,对一些问题需要提升QA对的多样性,确保在知识检索时可适应用户提问的多样性

4、选择与业务切合的 Embedding 模型及向量数据库

5、知识召回测试

RAG检索中:

RAG 检索中可以对知识的策略进一步调整,让结果更加准确:

  • Top N,选取检索结果排列的条数,条数过少可能导致知识没有命中,条数过多则容易导致误导 AI;

  • 适当加入上下文信息,让检索结果更符合预期;

  • 多路召回,多种方式检索结果,但向量召回的方式比重是最大的;

  • 结果重排 Rerank,检索结果重排在某些场景下可以提升检索的正确率;

通过 Reranker 增强 RAG:

图片来源:zilliz官网

RAG检索后:

RAG 检索后可以对结果进行过滤和补充:

  • 二次重排,采用AI对结果与上下文的相关性进行打分重排;

  • 过滤与筛选,去除重复内容,过滤无关内容;

  • 知识补充,对检索的结果进行补充,如补充前后段落内容;

  • 知识融合,对检索结果的实体统一做解释说明;

  • 反馈机制,记录问题、检索结果及回答,补充及优化 RAG 知识,为知识检索提供多样性数据;

RAG调优检索技术

RAG调优检索技术目前都有较为可行的技术体系,本图展示的是《RAG通用范式的工程实践》中的技术系统,实际应用过程可参考进行裁剪和补充。

恒赢智航会持续推出“驯服大模型”系列文章,旨在分享 AI 在航空领域的应用经验。恒赢智航秉持不断求索、拥抱未来、开源共享的理念,致力于引领该领域的 AI 发展,也会在后续系列文章中分享开源专业领域的相关框架、技术、数据与行业模型,并发布专属于航空领域的AI产品。

如何学习AI大模型?

大模型时代,火爆出圈的LLM大模型让程序员们开始重新评估自己的本领。 “AI会取代那些行业?”“谁的饭碗又将不保了?”等问题热议不断。

不如成为「掌握AI工具的技术人」,毕竟AI时代,谁先尝试,谁就能占得先机!

但是LLM相关的内容很多,现在网上的老课程老教材关于LLM又太少。所以现在小白入门就只能靠自学,学习成本和门槛很高

针对所有自学遇到困难的同学们,我帮大家系统梳理大模型学习脉络,将这份 LLM大模型资料 分享出来:包括LLM大模型书籍、640套大模型行业报告、LLM大模型学习视频、LLM大模型学习路线、开源大模型学习教程等, 😝有需要的小伙伴,可以 扫描下方二维码领取🆓↓↓↓

👉[CSDN大礼包🎁:全网最全《LLM大模型入门+进阶学习资源包》免费分享(安全链接,放心点击)]()👈

学习路线

在这里插入图片描述

第一阶段: 从大模型系统设计入手,讲解大模型的主要方法;

第二阶段: 在通过大模型提示词工程从Prompts角度入手更好发挥模型的作用;

第三阶段: 大模型平台应用开发借助阿里云PAI平台构建电商领域虚拟试衣系统;

第四阶段: 大模型知识库应用开发以LangChain框架为例,构建物流行业咨询智能问答系统;

第五阶段: 大模型微调开发借助以大健康、新零售、新媒体领域构建适合当前领域大模型;

第六阶段: 以SD多模态大模型为主,搭建了文生图小程序案例;

第七阶段: 以大模型平台应用与开发为主,通过星火大模型,文心大模型等成熟大模型构建大模型行业应用。

在这里插入图片描述

👉学会后的收获:👈

• 基于大模型全栈工程实现(前端、后端、产品经理、设计、数据分析等),通过这门课可获得不同能力;

• 能够利用大模型解决相关实际项目需求: 大数据时代,越来越多的企业和机构需要处理海量数据,利用大模型技术可以更好地处理这些数据,提高数据分析和决策的准确性。因此,掌握大模型应用开发技能,可以让程序员更好地应对实际项目需求;

• 基于大模型和企业数据AI应用开发,实现大模型理论、掌握GPU算力、硬件、LangChain开发框架和项目实战技能, 学会Fine-tuning垂直训练大模型(数据准备、数据蒸馏、大模型部署)一站式掌握;

• 能够完成时下热门大模型垂直领域模型训练能力,提高程序员的编码能力: 大模型应用开发需要掌握机器学习算法、深度学习框架等技术,这些技术的掌握可以提高程序员的编码能力和分析能力,让程序员更加熟练地编写高质量的代码。

在这里插入图片描述

1.AI大模型学习路线图
2.100套AI大模型商业化落地方案
3.100集大模型视频教程
4.200本大模型PDF书籍
5.LLM面试题合集
6.AI产品经理资源合集

👉获取方式:
😝有需要的小伙伴,可以保存图片到wx扫描二v码免费领取【保证100%免费】🆓

这篇关于驯服大模型--大模型RAG调优总结的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1099887

相关文章

Python中logging模块用法示例总结

《Python中logging模块用法示例总结》在Python中logging模块是一个强大的日志记录工具,它允许用户将程序运行期间产生的日志信息输出到控制台或者写入到文件中,:本文主要介绍Pyt... 目录前言一. 基本使用1. 五种日志等级2.  设置报告等级3. 自定义格式4. C语言风格的格式化方法

Spring 依赖注入与循环依赖总结

《Spring依赖注入与循环依赖总结》这篇文章给大家介绍Spring依赖注入与循环依赖总结篇,本文通过实例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录1. Spring 三级缓存解决循环依赖1. 创建UserService原始对象2. 将原始对象包装成工

MySQL中查询和展示LONGBLOB类型数据的技巧总结

《MySQL中查询和展示LONGBLOB类型数据的技巧总结》在MySQL中LONGBLOB是一种二进制大对象(BLOB)数据类型,用于存储大量的二进制数据,:本文主要介绍MySQL中查询和展示LO... 目录前言1. 查询 LONGBLOB 数据的大小2. 查询并展示 LONGBLOB 数据2.1 转换为十

Java慢查询排查与性能调优完整实战指南

《Java慢查询排查与性能调优完整实战指南》Java调优是一个广泛的话题,它涵盖了代码优化、内存管理、并发处理等多个方面,:本文主要介绍Java慢查询排查与性能调优的相关资料,文中通过代码介绍的非... 目录1. 事故全景:从告警到定位1.1 事故时间线1.2 关键指标异常1.3 排查工具链2. 深度剖析:

在Java中实现线程之间的数据共享的几种方式总结

《在Java中实现线程之间的数据共享的几种方式总结》在Java中实现线程间数据共享是并发编程的核心需求,但需要谨慎处理同步问题以避免竞态条件,本文通过代码示例给大家介绍了几种主要实现方式及其最佳实践,... 目录1. 共享变量与同步机制2. 轻量级通信机制3. 线程安全容器4. 线程局部变量(ThreadL

Spring Boot 与微服务入门实战详细总结

《SpringBoot与微服务入门实战详细总结》本文讲解SpringBoot框架的核心特性如快速构建、自动配置、零XML与微服务架构的定义、演进及优缺点,涵盖开发环境准备和HelloWorld实战... 目录一、Spring Boot 核心概述二、微服务架构详解1. 微服务的定义与演进2. 微服务的优缺点三

Java通过驱动包(jar包)连接MySQL数据库的步骤总结及验证方式

《Java通过驱动包(jar包)连接MySQL数据库的步骤总结及验证方式》本文详细介绍如何使用Java通过JDBC连接MySQL数据库,包括下载驱动、配置Eclipse环境、检测数据库连接等关键步骤,... 目录一、下载驱动包二、放jar包三、检测数据库连接JavaJava 如何使用 JDBC 连接 mys

JavaSE正则表达式用法总结大全

《JavaSE正则表达式用法总结大全》正则表达式就是由一些特定的字符组成,代表的是一个规则,:本文主要介绍JavaSE正则表达式用法的相关资料,文中通过代码介绍的非常详细,需要的朋友可以参考下... 目录常用的正则表达式匹配符正则表China编程达式常用的类Pattern类Matcher类PatternSynta

SQL中JOIN操作的条件使用总结与实践

《SQL中JOIN操作的条件使用总结与实践》在SQL查询中,JOIN操作是多表关联的核心工具,本文将从原理,场景和最佳实践三个方面总结JOIN条件的使用规则,希望可以帮助开发者精准控制查询逻辑... 目录一、ON与WHERE的本质区别二、场景化条件使用规则三、最佳实践建议1.优先使用ON条件2.WHERE用

Nginx Location映射规则总结归纳与最佳实践

《NginxLocation映射规则总结归纳与最佳实践》Nginx的location指令是配置请求路由的核心机制,其匹配规则直接影响请求的处理流程,下面给大家介绍NginxLocation映射规则... 目录一、Location匹配规则与优先级1. 匹配模式2. 优先级顺序3. 匹配示例二、Proxy_pa