LLM之幻觉（二）：大语言模型LLM幻觉缓减技术综述

🕗 发布于 2024-01-16 13:29 语言模型 人工智能 深度学习

LLM幻觉缓减技术分为两大主流，梯度方法和非梯度方法。梯度方法是指对基本LLM进行微调；而非梯度方法主要是在推理时使用Prompt工程技术。LLM幻觉缓减技术，如下图所示：

LLM幻觉缓减技术值得注意的是：

检索增强生成（RAG）
知识检索（https://arxiv.org/abs/2307.03987）
CoNLI（https://arxiv.org/abs/2310.03951）
CoVe（https://cobusgreyling.medium.com/chain-of-verification-reduces-hallucination-in-llms-20af5ea67672）

与专注于有限任务的传统人工智能系统不同，LLM在训练过程中使用了大量的在线文本数据。当大模型语言生成功能应用在要求严格的应用程序时，LLM幻觉就变得非常令人担忧，例如：

总结医疗记录；
客户支持对话;
财务分析报告，并提供错误的法律建议。

一、幻觉缓解分类法

这项研究对LLM幻觉缓解技术进行了总结，分类为：梯度方法和非梯度方法。

梯度方法包括复杂和不透明的解码策略、知识图谱、微调策略等。

非梯度方法包括RAG、自我优化和Prompt微调。

值得注意的是，RAG方法分为四个部分；

生成之前；
生成期间；
生成后；
端到端

Prompt工程缓解幻觉的原理在于定义：

特殊上下文&；
预期输出

二、最佳预防幻觉

预防幻觉的最佳方法不是单一的方法，需要综合多种方法。

缓减幻觉需要考虑以下因素：

在多大程度上依赖标签数据？
引入无监督或弱监督学习技术以提高可扩展性和灵活性的可能性是什么？
考虑梯度和非梯度方法，以产生连贯和上下文相关的信息。
收集到的缓解幻觉的工作揭示了一系列不同的策略，每种策略都有助于解决LLM中幻觉的细微差别。
通过反馈和推理的自我完善会产生有影响力的策略。
结构化比较推理引入了一种结构化的文本偏好预测方法，增强了连贯性，减少了幻觉。
监督微调可以通过知识注入和师生方法进行探索。
特定领域的知识被注入到较弱的LLM和使用反事实数据集来提高真实性的方法中。

参考文献：

[1] https://cobusgreyling.medium.com/large-language-model-hallucination-mitigation-techniques-a75b6f873318

原文地址：https://blog.csdn.net/wshzd/article/details/135606786

免责声明：本站文章内容转载自网络资源，如本站内容侵犯了原著者的合法权益，可联系本站删除。更多内容请关注自学内容网（zxcms.com）！

上一篇：Python 与 PySpark数据分析实战指南：解锁数据洞见
下一篇：C++力扣题目700--二叉搜索树中的搜索

Java项目实战II基于Java+Spring Boot+MySQL的共享汽车管理系统(源码+数据库+文档)
在共享经济蓬勃发展的背景下，共享汽车作为一种新型的出行方式，正逐渐改变着人们的出行习惯。然而，随着共享汽车市场规模的不断扩大，车辆管理、用户服务、数据安全等问题日益凸显，传统的管理方式已难以满足当前的
阅读更多2024-11-19
【青牛科技】汽车收音机调频中频放大器——D1145
无线麦克风对讲机。
阅读更多2024-11-19
鸿蒙中位置权限和相机权限
State permissionsMessage: string | Resource = "\"获取当前位置\"需获取定位权限才能正常使用"this.perm
阅读更多2024-11-19
UE5 第一人称射击项目学习（二）
然后，把子弹的向前向量提升（在ue5的标准向量是以1cm为单位，所以虽然子弹跟随视角发射，但是速度太慢），从生成Actor的return Value处拉一根线，获取向前向量乘1000.运行程序，按
阅读更多2024-11-19
【软考】系统架构设计师-数据库设计基础
数据库设计基础知识
阅读更多2024-11-19
MongoDB 监控：确保数据库性能和可靠性
MongoDB 是一个流行的开源 NoSQL 数据库，以其灵活的文档模型和强大的查询语言而闻名。然而，为了确保 MongoDB 的性能和可靠性，监控是至关重要的。本文将讨论 MongoDB 监控的重要
阅读更多2024-11-19
电脑插入U盘，电脑显示新增了，但是双击却显示请将磁盘插入
`CHKDSK 无法供 RAW 驱动器使用` 表明内存卡的文件系统已损坏或丢失，当前处于 **RAW 文件系统** 状态。RAW 表示文件系统无法识别，可能由以下原因导致：
阅读更多2024-11-19
【论文阅读】InstructIR: High-Quality Image Restoration Following Human Instructions
图像恢复是一个基本问题，旨在从退化的图像中恢复出高质量的清晰图像。All-In-One 图像恢复模型能够利用退化特定的信息作为提示，引导恢复模型有效地恢复多种类型和不同程度的退化图像。本研究提出了首个
阅读更多2024-11-19
【Next】字体修改
next/font 包括任何字体文件的内置自动自托管。首先从 next/font/google 导入您想要使用的字体作为函数。（可以按住 ctrl 点进去 google 查看所有字体）然后导入该字体函
阅读更多2024-11-19
Springboot基于GIS的旅游信息管理系统
项目编号：springbootA100基于GIS的旅游信息管理系统是在旅游业迅速发展、旅游需求日益多样化的背景下应运而生的一套综合性信息管理平台，它通过整合旅游资源、提供实时信息、优化服务流程，旨在为
阅读更多2024-11-19

LLM之幻觉（二）：大语言模型LLM幻觉缓减技术综述

一、幻觉缓解分类法

二、最佳预防幻觉

参考文献：

相关文章