管理提供商
Rephlo 可以同时连接多个 AI 提供商。您可以使用托管的 Rephlo 方案处理日常工作,使用您自己的 OpenAI 账户处理常规任务,使用 Anthropic 账户处理长文档,并使用本地 Ollama 模型处理私密数据——所有这些都可以并排配置。
两种访问 AI 的方式
1. Rephlo Gateway(推荐新用户使用)
Rephlo Gateway(Dedicated API)是最简单的入门方式。您无需自行管理 API 密钥,而是通过您的 Rephlo 账户订阅来访问 AI 模型。
优势:
- 无需管理 API 密钥——只需使用您的 Rephlo 账户登录即可。
- 统一计费——一份订阅即可覆盖多个 AI 模型,以 credit 形式计量。
- 预配置模型——无需设置即可使用热门模型。
- 自动更新——新模型会自动为您添加。
使用 Gateway 的方法:
- 打开 Account 区域,并使用您的 Rephlo 账户 Sign In。
- 登录后,Gateway 提供商会自动为您设置完成,其模型随即可用。
Gateway 提供商是通过您的账户来管理的——您不需要手动在提供商列表中添加或移除它。参见账户(Account)和账单与订阅(Billing & Subscription)。
只想使用 BYOK 或本机模型? 在 Settings > LLM Providers 中开启 Hide online models from Rephlo Gateway——该开关在 On-Device 和 BYOK Providers 两个子标签页中均可使用。开启后会从所有模型选择器(状态栏、聊天、悬浮窗)中隐藏 Gateway(Dedicated API)模型。如果您开启该开关时当前的活动模型正是 Gateway 模型,Rephlo 会自动为您切换到一个可访问 的本机或 BYOK 模型,而不会让您悄无声息地停留在已被隐藏的模型上。
2. BYOK(自带密钥)
对于希望直接掌控或已拥有供应商订阅的用户,Rephlo 可使用您自己的 API 密钥直接连接到 AI 提供商。
优势:
- 与供应商直接建立关系——您直接向供应商付费。
- 完全掌控——可使用供应商提供的每一个模型和功能。
- 自定义端点——可连接到私有、企业级或自托管的部署。
支持的提供商(BYOK)
添加提供商时,您可以从以下类型中选择一种:
| 提供商 | Vision | 说明 |
|---|---|---|
| OpenAI | 支持 | GPT 系列模型;可选自定义端点 |
| Anthropic | 支持 | Claude 模型;支持 prompt caching |
| Google AI | 支持 | Gemini 模型 |
| Grok (xAI) | 支持 | Grok 模型;可选 Live Search(网页搜索) |
| Groq | 视模型而定 | 面向开源模型的高速推理 |
| OpenRouter | 视模型而定 | 连接多个供应商众多模型的网关 |
| Ollama | 视模型而定 | 本地/离线模型;可选密钥用于网页搜索 |
| OpenAI-Compatible | 视模型而定 | 任何符合 OpenAI 规范的服务——Azure OpenAI、vLLM、LocalAI、LiteLLM、自定义代理 |
Azure OpenAI 通过 OpenAI-Compatible 类型接入(将其指向您的 Azure 端点),而不是添加提供商列表中的独立条目。Ollama 在专门的本机模型(On-Device Models)页面中有详细介绍。
添加提供商
- 进入 Settings > Providers。
- 点击 Add Provider。
- Select Type——从下拉列表中选择供应商。
- Enter details(字段会根据您选择的类型而变化):
- Name——一个便于识别的别名(例如 "My GPT"、"Work Claude")。
- API Key——从供应商控制台获取的密钥。
- Base URL——对于 OpenAI-Compatible 和 Ollama,即端点 URL。
- Model Name——要使用的模型(OpenAI-Compatible 及若干其他类型必填)。
- Test Connection——保存前验证配置(见下文)。
- Save。
各提供商专属字段
每种提供商类型都会要求其所需的信息:
| 提供商 | 必填 | 可选 |
|---|---|---|
| OpenAI | API Key | 自定义 Base URL |
| Anthropic | API Key | Base URL;prompt-caching 设置 |
| Google AI | API Key | Base URL |
| Grok (xAI) | API Key | Live Search 开关 |
| Groq | API Key | — |
| OpenRouter | API Key | Site URL、Site Name(用于 OpenRouter 的活动仪表盘) |
| Ollama | Base URL(默认 http://localhost:11434) | API key(仅用于网页搜索) |
| OpenAI-Compatible | API Key、Base URL、Model Name | — |
Anthropic 的 Prompt Caching
添加 Anthropic 提供商时,您会看到 prompt-caching 相关选项:
- Enable Prompt Caching——默认开启。缓存(caching)可大幅降低重复上下文的成本。
- Cache TTL——
ephemeral(约 5 分钟)或extended(约 1 小时)。TTL 越长,写入成本越高,但上下文缓存保留时间也越长。 - Cache Logging——可选的缓存性能详细日志。
只有当请求确实携带了可复用的上下文时(例如聊天中附加了 Space),缓存才会生效。完整说明参见Prompt Caching。
测试连接
Test Connection 按钮会在您保存之前验证设置:
结果显示绿色表示凭据和端点均可正常工作;显示红色则会说明出了什么问题,便于您进行修正。
模型参数
设置好模型后,您可以调整其生成文本的方式:
- Temperature——数值越低,输出越精确/确定;数值越高,输出越具创造性/多样化。
- Max tokens——限制响应的长度。
- Top-p / sampling——对随机性进行细粒度控制(需模型支持)。
Rephlo 会为每个模型套用与之匹配的参数范围,因此您无法设置模型不接受的数值。
每个提供商可配置多个模型
单个提供商可以容纳多个模型。在 Add/Edit Provider 抽屉中,您可以:
- Add Model——在同一提供商下注册另一个模型,每个模型拥有各自的参数。
- Set Active Model——标记该提供商默认使用哪个模型。
- Edit / Remove 单个模型。
这样一来,同一个 Anthropic 或 OpenRouter 连接就可以同时覆盖日常工作用的快速模型,以及处理难题用的更强模型——而无需将该提供商配置两次。