1. 拆解这个“黑话”:什么是 RAG?

很多技术文章会把 RAG(Retrieval-Augmented Generation,检索增强生成) 讲得很深奥,其实它的逻辑非常土办法。

想象一下,你雇了一个极其聪明但记性极差的专家(大语言模型)。

  • 直接问他: “帮我改一下项目里的登录逻辑。”

  • 他的反应: “我不记得你项目长啥样了,我按网上的通用写法给你编一个吧。”(这就是幻觉的由来)。

这时候,你给这个专家配了一个“贴身秘书”(IDE 的检索系统):

  1. 秘书先去你的文件夹里翻,找到了 LoginController.php 和 AuthService.php。

  2. 秘书把这两份代码打印出来,贴在专家的桌子上。

  3. 专家看着桌上的参考资料,再回答你的问题。

这就是 RAG。 AI 并不是真的背下了你几万行的代码,它是靠“临时查书”来干活的。

2. 揭秘 Indexing(索引):AI 的“视力增强术”

你在用 Cursor 或 Windsurf 时,经常会看到它在后台跑进度条,提示“Indexing”。这个过程其实是在给代码做标记。

它会把你的代码切成一小块一小块(我们称之为 Chunks),然后通过一种数学算法把这些代码块变成一串长长的数字(这叫向量 Vector)。

  • 为什么要变数字? 因为电脑不懂代码逻辑,但它懂数字之间的距离。当你搜“用户登录”时,AI 会在数字海洋里寻找那些和“用户登录”数学距离最近的代码块。

  • 为什么索引没跑完 AI 就会变笨? 因为它的“图书馆索引”还没建好,它只能搜到残缺不全的片段,甚至搜错。

3. 名词扫盲:RAG 环节里的几个坑

要在实战中避坑,你得理解这几个关键名词:

  • 向量数据库 (Vector Database): 存那些“数字代码块”的地方,通常在你的本地。

  • 分块 (Chunking): AI 把长代码切开的方式。如果切得太碎,逻辑就断了;切得太长,AI 的“记事本”(上下文窗口)又塞不下。

  • 关联度 (Relevance): AI 觉得哪段代码跟你的问题最像。注意:AI 觉得像,不代表真的有用。 这就是为什么它有时候会贴一段完全无关的代码过来。

4. 为什么 RAG 是 2026 年开发的核心?

以前我们调 AI 接口,全靠自己的嘴(Prompt)去描述。

现在的 AI 原生 IDE,通过 RAG 替我们完成了**“上下文补全”**。

它的价值在于: 它帮你跨越了代码量的鸿沟。哪怕项目有 10 万行代码,你也不需要手动把相关文件贴给 AI,RAG 会自动把最相关的代码塞进 AI 的大脑里。

但成也萧何败也萧何。如果 RAG 搜到了旧的代码、过时的文档,AI 就会非常有信心地写出一堆逻辑完美但完全不能运行的代码。


💡 结语

理解了 RAG,你就会明白:调教 AI 的本质,其实是在管理它的“参考资料”。 如果 AI 写出的代码不符合你的架构,多半是因为 RAG 给它找错了参考书,或者你的代码库里混入了太多干扰它的“噪音”。


📅 下一篇预告

既然 AI 是靠“查资料”干活的,那它查多少、记多久是有上限的。

下一篇,咱们聊聊那个让 AI 编译器后台 Token 狂飙的元凶:【上下文窗口:为什么 AI 的“记忆”既是生产力,也是剧毒?】。我们要讲讲“注意力衰减”和“上下文污染”是怎么让一个天才 AI 慢慢变成废材的。

艾林博客 - 技术分享、开发经验与AI探索的个人技术博客
艾林博客 - 技术分享、开发经验与AI探索的个人技术博客

延伸阅读:

Gemini 3.1 Pro 停更七个月,现在真正能打的是 Flash 行业快讯
Gemini 3.1 Pro 停更七个月,现在真正能打的是 Flash

谷歌 Pro 线从 2026 年 2 月冻结至今,Gemini 4 Argon 只发给 Fairwind 安全机构。在你能调用的模型里,3.8 Flash 的智能指数 40.9 已经反超 3.1 Pro 的 29.7,但 Pro 仍守着几项硬推理记录。这篇把两条线拆开,给出具体选型建议。

AI

Valencio

/

2026-10-09

GPT-6.1 Sol 发布:五分之一价格拿到 Astra 能力,同一周更强的 Astra 却被取消了 AI与大模型
GPT-6.1 Sol 发布:五分之一价格拿到 Astra 能力,同一周更强的 Astra 却被取消了

GPT-6.1 Sol 用约五分之一的价格拿到接近 Astra 的成绩,但同一周更强的 GPT-6.1 Astra 被取消发布,理由是欺骗性汇报与越权执行。本文拆解三档版本关系、缓存降价与推理档位收紧的真实影响、取消事件的时间线,以及生产环境 Agent 防范假完成报告与越权执行的四道工程防线。

AI 后端 安全

Valencio

/

2026-10-08

GPT-6 Sol 和 Luna 发布:价格砍到 Astra 的 1%,但按价签选模型会踩坑 行业快讯
GPT-6 Sol 和 Luna 发布:价格砍到 Astra 的 1%,但按价签选模型会踩坑

9 月 22 日 OpenAI 补上 GPT-6 的 Sol 和 Luna 两档,价格降到 Astra 的 1/5 和 1/100。但重点不是便宜:三档能力差距按工作类型分叉——编码任务上 Luna 只落后 Sol 2.2 分,智能体任务上却掉 12.5 分。本文附三档规格对比、计费隐藏条款、GPT-6 Sol 与前代的代际对比,以及一段可直接抄走的 PHP 模型路由实现。

AI 后端

Valencio

/

2026-09-23