跳到主要内容

RAG 检索与调优

当某个命令或 Chat 使用了某个 Space 时,Rephlo 并不会盲目地把每一份文档都塞进提示词中。相反,它会检索与您的请求最相关的段落,并只注入这些内容——这项技术称为检索增强生成(Retrieval-Augmented Generation,RAG)。**RAG Retrieval(RAG 检索)**设置可让您调整这种检索的严格或宽松程度。

您可以在 Settings → General 页面的底部附近找到该部分。

The RAG Retrieval settings — a strictness profile picker (Very Lenient … Strictest) and tuning controls

为什么要调优检索?

检索是一种平衡:

  • 过于严格,Rephlo 可能会遗漏有用的上下文,导致答案不够充实。
  • 过于宽松,则会引入相关性较弱的文本,浪费 token,有时还会引入噪音。

默认设置对大多数人来说已经足够好用。当您的 Space 比较特殊——非常庞大、非常专业,或包含大量近似重复的内容——并希望微调平衡时,调优就派上用场了。

基础模式与高级模式

共有两种模式。大多数用户只需使用**基础(Basic)**模式。

基础模式(默认)

选择一个严格程度配置(strictness profile),Rephlo 会为您应用一套合理的数值:

配置行为
Very Lenient(非常宽松)广泛检索——倾向于纳入更多上下文。
Lenient(宽松)略微放宽的检索。
Balanced(平衡)默认设置——适合大多数 Space 的折中方案。
Strict(严格)更紧凑——只保留明显相关的段落。
Strictest(最严格)最具选择性——只保留可信度最高的匹配结果。

只需点击某个配置,更改会自动保存。

高级模式

打开 **Advanced(高级)**开关,即可直接编辑底层参数。切换到该模式时,各字段会预先填入您当前配置的数值,以便您有一个合理的起点。可用的控制项包括:

  • Similarity floor(相似度下限)——段落必须达到的最低相关性分数,才会被纳入考虑。
  • Selected-ratio cutoff(选中比例截止值)——从候选池中保留的比例。
  • High-confidence threshold(高置信度阈值)——将某个匹配视为明显相关所需的门槛。
  • Minimum chunks(最小分块数)——一个下限,防止检索返回过少内容。
  • Minimum Space size (tokens)(最小 Space 大小,以 token 计)——低于该值时,Space 足够小,会被完整发送,而不是从中检索(默认为 4,000)。这也是 Smart Search 所使用的分界线:等于或低于该值时,Rephlo 会发送整个 Space;高于该值时,Rephlo 只检索最相关的部分。对于较大的 Space,可以调高此值以继续完整扫描。
  • Command context budget (tokens)(命令上下文预算,以 token 计)——一个命令可以使用的检索上下文 token 数量。默认为 4,000。在 v1.4.0 中已从 2,500 调高,因此命令现在默认能看到更多文档内容——与 Chat 的预算相同。
  • Chat context budget (tokens)(Chat 上下文预算,以 token 计)——Chat 可以使用的检索上下文 token 数量。默认为 4,000
  • Large-Space command guard (tokens)(大型 Space 命令保护,以 token 计)——默认为 10,000。超过此大小时,Rephlo 会在发送整个 Space 之前提示您先精简命令。
  • Inject-All Ceiling (tokens)(全量注入上限,以 token 计)——默认为 50,000。无论 Space 的实际大小如何,都会限制回退式的全量 Space 发送所能注入的内容量。

Token 预算会自动被限制在安全范围内,并根据您所使用的服务商实际能处理的能力进行约束,因此您无法设置一个会导致请求失败的数值。

保存与重置

  • 自动保存——您所做的每一项更改都会立即保存,与 Settings 中的其他部分一样。没有单独的保存按钮。
  • Reset to Defaults(重置为默认值)——恢复出厂默认设置:基础模式,配置为 Balanced(平衡)

如果检索调优功能在您的设备上不可用,Rephlo 会悄悄回退到其内置默认值——您的 Space 仍然可以正常使用。

与数据模式的关系

无论 Space 采用哪种数据模式,RAG 检索都会应用于每一个 Space——它始终是在 Space 的原始(raw)分块上进行检索。一个超过最小 Space 大小下限的 🗜️ Compact Space,在正常请求中仍会获得相关的检索段落,而不是完整的 AI 摘要。数据模式只会改变回退(fallback)情形下发送的内容——即 Space 等于或低于最小 Space 大小,或没有可信匹配时:🔍 Smart Search Space 会免费发送每个文件的完整原始文本,而 🗜️ Compact Space 会发送每个文件的 AI 摘要,构建该摘要需要消耗 credit。完整说明请参见数据模式与压缩

相关页面