跳至正文
-
Subscribe to our newsletter & never miss our best posts. Subscribe Now!
Kris的技术站
Kris的技术站
  • 首页
  • 示例页面
  • 首页
  • 示例页面
关

搜索

  • https://www.facebook.com/
  • https://twitter.com/
  • https://t.me/
  • https://www.instagram.com/
  • https://youtube.com/
Subscribe
AI 开发

RAG 检索增强生成实战:让大模型学会「查资料再回答」

作者 kris
2026年8月2日 1 分钟阅读
0

大模型再厉害,也有一个硬伤:它的知识停留在训练截止的那一刻,而且可能「记错」。想让它回答你公司的内部文档、最新的产品政策,怎么办?答案是 RAG(检索增强生成)。它是目前企业落地大模型最主流、性价比最高的方案。

一、RAG 是什么

RAG 的全称是 Retrieval-Augmented Generation,核心思想一句话:先检索,再生成。模型在回答之前,先从你的知识库里「查资料」,把相关的片段拼进提示词里,再基于这些资料作答。

这样既利用了 LLM 的语言能力,又让答案基于真实、最新的资料,幻觉大幅减少。你可以把 LLM 想象成一个会说话的助手,而 RAG 是递给它的「参考资料文件夹」。

二、核心流程四步走

一个典型的 RAG 系统分四个环节:

  • 文档切分(Chunking): 把长文档切成一段段固定长度的小块,并保留上下文,便于后续检索。
  • 向量化(Embedding): 用嵌入模型把每个小块转成向量,存入向量数据库(如 Milvus、FAISS、Pinecone)。
  • 检索(Retrieval): 用户提问时,把问题也转成向量,在库里找出语义最相近的若干片段。常用方法有向量检索、关键词检索,以及两者的混合检索。
  • 生成(Generation): 把检索到的片段和原始问题拼进提示词,交给 LLM 生成最终答案。

三、落地时最容易踩的坑

RAG 看似简单,真正做好却有不少门道:

  • 切分策略: 切太碎会丢上下文,切太大会夹带噪音。要根据文档类型调整。
  • 检索质量决定上限: 检索不到,LLM 再强也无米下锅。混合检索 + 重排序(Rerank)能显著提升命中率。
  • 引用溯源: 让模型在回答里标注「依据来自哪段文档」,用户能核验,信任度大增。
  • 查询改写: 用户问题太口语化时,先让模型改写成一个适合检索的查询,效果更好。

四、RAG 之外的补充手段

如果文档经常变、问题很专,还可以配合函数调用:让模型决定要不要实时查数据库、调接口。更进一步,当某类问题需要模型「深度思考」而非查资料时,微调或长上下文可能是更合适的选择。RAG、微调、长上下文,三者不是互斥,而是按场景组合使用。

对个人开发者来说,用开源向量库加几百行代码就能搭一个能用的 RAG 原型。建议从一个小数据集开始,先把检索质量调好,再逐步扩展。

标签:

LLMRAG
作者

kris

关注我
其他文章
上一个

大语言模型是怎么「学会说话」的

下一个

AI Agent 智能体:从「回答问题」到「替你干活」

暂无评论!成为第一个。

发表回复 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

近期文章

  • AI 的未来:从单模型到智能体生态
  • 把大模型接入你的日常开发工作流:一份保姆级清单
  • AI 安全:幻觉、越狱与数据泄露,一个都不能忽视
  • 多模态 AI:当模型能「看懂图片、听懂语音」
  • AI 编程助手实测:它如何改变我的开发方式

近期评论

您尚未收到任何评论。

归档

  • 2026 年 8 月

分类

  • AI 大模型
  • AI 安全与伦理
  • AI 应用
  • AI 开发
Copyright 2026 — Kris的技术站. 版权所有. 粤ICP备2026112440号-1