核心概念:Providers
Providers(提供方) 是处理您的文本并生成回复的底层 AI 引擎(大语言模型)。Rephlo 是一个统一接口——您可以按任务随时切换这些"大脑",而单个 Provider 可以对外提供多个模型(参见 Models & Inference)。
Provider 类型
Rephlo 支持 8 种自带密钥(Bring-Your-Own-Key,BYOK)的 Provider 类型,以及由 Rephlo 托管的 Dedicated API:
云端 Provider(需要联网)
- OpenAI — GPT 系列模型。推理、编程与创意方面的行业标准。
- Anthropic — Claude 模型;以高质量写作、大上下文窗口和 prompt caching(提示缓存)(默认开启)著称。
- Groq — 基于定制 LPU 芯片的超快推理——近乎即时的响应。
- Google — Gemini 模型,具备强大的多模态能力。
- xAI (Grok) — Grok 模型,可选启用实时的 Live Search。
- OpenRouter — 统一网关,连接来自众多厂商的 100 多个模型,并通过 Site URL / Site Name 进行追踪。
- OpenAI-Compatible — 连接任何实现 OpenAI API 规范的服务(Azure OpenAI、vLLM、LocalAI、LiteLLM、LM Studio、自定义代理)。需要 API Key、Base URL 和 Model Name。
本地 Provider(完全隐私)
- Ollama — 直接在您的电脑上运行开源模型(Llama、Mistral、Gemma、DeepSeek、Qwen)。您的数据永远不会离开您的设备。Base URL 可配置(默认
http://localhost:11434);可选的 Ollama API key 可启用网络搜索。
Azure OpenAI 通过 OpenAI-Compatible 类型接入——选择 OpenAI-Compatible,并将您的 Azure 部署端点填入 Base URL(将部署名称填入 Model Name)。它不是添加 Provider 列表中的独立条目。
本机模型(On-device models):Rephlo 还可以通过内置引擎完全在本机运行 GGUF 模型(无需联网,无需 Ollama)。这是一条相关但独立的推理路径——参见 On-Device Models 和 Models & Inference。
托管 Provider
- Dedicated API — Rephlo 使用 OAuth 2.0 提供的托管云端选项。对不想自行管理 API 密钥的用户而言是最简单的设置;用量通过 credit 计量。其配置会自动创建,并在常规 Provider 列表中隐藏。
想要仅显示 BYOK/本机模型的选择器? 在 Providers 下开启 Hide online models from Rephlo Gateway,即可在所有模型选择器中隐藏 Dedicated(Gateway)模型。
On-Device 与 BYOK 的区别
这两种"自带模型"路径很容易混淆:
- On-Device(本机) — 通过内置引擎在您的设备上本地运行的开放模型(GGUF)。无需 API 密钥,无需联网,完全私密;不会有任何内容离开您的电脑。
- BYOK(Bring Your Own Key,自带密钥) — 您为外部 Provider(某个云厂商,或本地的 Ollama)提供自己的 API 密钥。请求会以您的密钥发送给该 Provider,由厂商直接向您计费。
On-Device 与 BYOK 都属于 Pro 级功能——使用它们需要有效的 Pro 套餐(或更高级别)或永久许可证。对于本机模型,这一限制同时涵盖下载和运行两方面;一旦解锁,它们的运行不消耗 credit,且完全离线。请在 Providers 下设置密钥。
平台 Dedicated API 与企业版 BYOK
- Dedicated API 是 Rephlo 托管的云端推理:登录后即可使用 Rephlo 的前沿模型,以 credit 计费,无需管理任何密钥。
- 企业版 BYOK(通过平台) 面向需要在组织层面集中配置自有 Provider 密钥和可用模型的企业,使每位成员都使用组织统一的模型和密钥——以满足合规与成本控制需求。
简言之:Dedicated API 用密钥换取 credit 和零配置,而企业版 BYOK 将密钥管理集中到组织层面。个人 BYOK 密钥在 Providers 下配置。
Provider 模式
每个 Provider 运行于两种模式之一:BYOK(您提供厂商密钥)或 Dedicated(由 Rephlo 托管,并追踪 credit)。
连接模式
Dedicated 模式(托管)
- 说明:Rephlo 通过 OAuth 2.0 管理连接与计费;用量从您的 credits 中扣除。
- 优点:零配置,统一计费管理。
- 缺点:对模型参数的底层控制较少。
BYOK 模式(自带密钥)
- 说明:您直 接使用自己的厂商 API 密钥。
- 优点:最大程度的隐私保护(数据从您的设备直接发送给厂商,不经过 Rephlo 服务器)、直接享受厂商定价,以及第一时间使用新模型。
- 缺点:需要有厂商账户。
Provider 配置存储的内容
每个 Provider 配置包括:
- 可选的 Display Name(显示名称) 覆盖项。
- 一个 Mode(BYOK / Dedicated)和 Provider 类型。
- Models — 一个或多个模型,其中一个被标记为默认模型。
- Configuration — 特定于 Provider 的字段。API 密钥和令牌均以加密方式存储:
- OpenAI / OpenAI-Compatible:API Key、可选的 Base URL(对 OpenAI-Compatible 而言,还有 Model Name)。Azure OpenAI 使用此类型——将 Base URL 指向您的 Azure 部署端点。
- Anthropic:API Key、可选的 Base URL,prompt caching 默认开启。
- Google:API Key、可选的 Base URL。
- Groq:API Key。
- Ollama:Base URL、可选的 API key(用于网络搜索)。
- xAI (Grok):API Key、可选的 Live Search 开关。
- OpenRouter:API Key、可选的 Site URL / Site Name。
- Capabilities — Vision、Function Calling(工具调用)、Long Context、Web Search、Thinking 等能力开关;在运行时会与模型的真实能力进行校验。
- Model Parameters — 按 Provider/模型划分的请求设置(temperature、max tokens、top-p 等)。
同一时间只有一个 Provider 处于激活状态。您也可以按命令单独覆盖 Provider,以实现精细化控制。

获取 API 密钥(BYOK)
使用 BYOK 时,您需要直接向厂商支付 API 用量费用。
| Provider | 获取密钥的位置 | 备注 |
|---|---|---|
| Azure OpenAI | portal.azure.com | 需要 Azure 订阅以及已部署的 OpenAI 资源 |
| OpenAI | platform.openai.com | GPT 系列模型 |
| Anthropic | console.anthropic.com | Claude 模型;支持 prompt caching |
| Groq | console.groq.com | 提供免费额度 |
aistudio.google.com | Gemini Pro / Flash | |
| xAI | console.x.ai | Grok 模型;可选 Live Search |
| OpenRouter | openrouter.ai | 一个密钥,100 多个模型 |
| OpenAI-Compatible | 因服务而异 | vLLM、LocalAI、LiteLLM、LM Studio |
| Ollama | 本地安装 + ollama.com/settings/keys | 本地模型;仅在需要网络搜索时才需要 API key |
切换 Provider
您可以全局切换 Provider(作为所有命令的默认值),也可以按命令切换。例如,快速拼写检查使用 Groq(速度快、成本低),而复杂分析则切换到 Claude(更智能、更细致)。
Provider 对比指南
| Provider | 最适合 | 速度 | 隐私 |
|---|---|---|---|
| Azure OpenAI | 企业、合规场景 | 快 | 云端 |
| OpenAI | 通用、编程、分析 | 快 | 云端 |
| Anthropic (Claude) | 写作、长文档、prompt caching | 快 | 云端 |
| Groq | 快速任务 | 超快 | 云端 |
| Google (Gemini) | 多模态、研究 | 快 | 云端 |
| xAI (Grok) | 实时知识 | 快 | 云端 |
| OpenRouter | 多模型接入 | 视情况而定 | 云端 |
| OpenAI-Compatible | 自托管、自定义 | 视情况而定 | 自托管 / 云端 |
| Ollama | 隐私、离线 | 取决于硬件 | 您的设备本地 |
具体的模型名称和上下文窗口大小会经常变化。要查看每个 Provider 具体提供哪些模型——以及如何按命令或按对话覆盖模型——请阅读 Models & Inference