Quản lý nhà cung cấp
Rephlo có thể kết nối tới nhiều nhà cung cấp AI cùng lúc. Bạn có thể dùng một gói Rephlo được lưu trữ (hosted) cho công việc hằng ngày, tài khoản OpenAI của riêng bạn cho các tác vụ thông thường, tài khoản Anthropic cho tài liệu dài, và một mô hình Ollama cục bộ cho dữ liệu riêng tư — tất cả được cấu hình song song.
Hai cách để truy cập AI
1. Rephlo Gateway (Khuyến nghị cho người dùng mới)
Rephlo Gateway (Dedicated API) là cách dễ nhất để bắt đầu. Thay vì tự quản lý khóa API, bạn truy cập các mô hình AI thông qua gói thuê bao tài khoản Rephlo của mình.
Lợi ích:
- Không cần quản lý khóa API — chỉ cần đăng nhập bằng tài khoản Rephlo của bạn.
- Thanh toán hợp nhất — một gói thuê bao bao gồm nhiều mô hình AI, được theo dõi dưới dạng credit.
- Mô hình cấu hình sẵn — các mô hình phổ biến có sẵn mà không cần thiết lập.
- Cập nhật tự động — các mô hình mới được thêm vào cho bạn.
Để dùng Gateway:
- Mở khu vực Account và Sign In bằng tài khoản Rephlo của bạn.
- Sau khi đăng nhập, nhà cung cấp Gateway sẽ được thiết lập tự động cho bạn và các mô hình của nó trở nên khả dụng.
Nhà cung cấp Gateway được quản lý thông qua tài khoản của bạn — bạn không tự thêm hoặc xóa nó khỏi danh sách nhà cung cấp theo cách thủ công. Xem Tài khoản (Account) và Thanh toán & Gói thuê bao (Billing & Subscription).
Chỉ muốn dùng BYOK hoặc mô hình trên thiết bị? Bật Hide online models from Rephlo Gateway trong Settings > LLM Providers — công tắc này có ở cả hai tab con On-Device và BYOK Providers. Nó sẽ ẩn các mô hình Gateway (Dedicated API) khỏi mọi bộ chọn mô hình: thanh trạng thái, chat, và lớp phủ (overlay). Nếu một mô hình Gateway đang là mô hình đang hoạt động của bạn khi bạn bật công tắc này, Rephlo sẽ tự động chuyển bạn sang một mô hình trên thiết bị hoặc BYOK khả dụng, thay vì âm thầm để bạn ở lại mô hình vừa bị ẩn.
2. BYOK (Dùng khóa API của riêng bạn)
Dành cho người dùng thích kiểm soát trực tiếp hoặc đã có sẵn gói thuê bao của nhà cung cấp, Rephlo kết nối trực tiếp tới các nhà cung cấp AI bằng khóa API của riêng bạn.
Lợi ích:
- Quan hệ trực tiếp với nhà cung cấp — bạn thanh toán trực tiếp cho nhà cung cấp.
- Kiểm soát toàn diện — truy cập mọi mô hình và tính năng mà nhà cung cấp cung cấp.
- Điểm cuối tùy chỉnh (custom endpoints) — kết nối tới các triển khai riêng tư, doanh nghiệp, hoặc tự lưu trữ (self-hosted).
Nhà cung cấp được hỗ trợ (BYOK)
Khi thêm một nhà cung cấp, bạn chọn một trong các loại sau:
| Nhà cung cấp | Vision | Ghi chú |
|---|---|---|
| OpenAI | Có | Các mô hình dòng GPT; có endpoint tùy chỉnh (tùy chọn) |
| Anthropic | Có | Các mô hình Claude; hỗ trợ prompt caching |
| Google AI | Có | Các mô hình Gemini |
| Grok (xAI) | Có | Các mô hình Grok; có Live Search (web) tùy chọn |
| Groq | Tùy mô hình | Suy luận nhanh cho các mô hình mã nguồn mở |
| OpenRouter | Tùy mô hình | Cổng kết nối (gateway) tới nhiều mô hình từ nhiều nhà cung cấp |
| Ollama | Tùy mô hình | Mô hình cục bộ/ngoại tuyến; khóa tùy chọn cho tìm kiếm web |
| OpenAI-Compatible | Tùy mô hình | Bất kỳ dịch vụ nào theo chuẩn OpenAI — Azure OpenAI, vLLM, LocalAI, LiteLLM, proxy tùy chỉnh |
Azure OpenAI được kết nối thông qua loại OpenAI-Compatible (trỏ tới endpoint Azure của bạn), chứ không phải một mục riêng trong danh sách thêm nhà cung cấp. Ollama được trình bày chi tiết trong trang riêng Mô hình trên thiết bị (On-Device Models).
Thêm nhà cung cấp
- Vào Settings > Providers.
- Nhấp Add Provider.
- Select Type — chọn nhà cung cấp từ danh sách thả xuống.
- Enter details (các trường sẽ thay đổi tùy theo loại bạn chọn):
- Name — một tên gợi nhớ (ví dụ: "My GPT", "Work Claude").
- API Key — khóa bí mật của bạn từ bảng điều khiển của nhà cung cấp.
- Base URL — với OpenAI-Compatible và Ollama, đây là URL của endpoint.
- Model Name — mô hình cần dùng (bắt buộc với OpenAI-Compatible và một số loại khác).
- Test Connection — xác thực cấu hình trước khi lưu (xem bên dưới).
- Save.
Trường thông tin theo từng nhà cung cấp
Mỗi loại nhà cung cấp yêu cầu nh ững thông tin riêng:
| Nhà cung cấp | Bắt buộc | Tùy chọn |
|---|---|---|
| OpenAI | API Key | Base URL tùy chỉnh |
| Anthropic | API Key | Base URL; cài đặt prompt caching |
| Google AI | API Key | Base URL |
| Grok (xAI) | API Key | Công tắc Live Search |
| Groq | API Key | — |
| OpenRouter | API Key | Site URL, Site Name (cho bảng hoạt động của OpenRouter) |
| Ollama | Base URL (mặc định http://localhost:11434) | API key (chỉ dùng cho tìm kiếm web) |
| OpenAI-Compatible | API Key, Base URL, Model Name | — |
Prompt Caching của Anthropic
Khi thêm một nhà cung cấp Anthropic, bạn sẽ thấy các tùy chọn prompt caching:
- Enable Prompt Caching — bật theo mặc định. Việc lưu đệm (caching) có thể giảm đáng kể chi phí cho ngữ cảnh lặp lại.
- Cache TTL —
ephemeral(khoảng 5 phút) hoặcextended(khoảng 1 giờ). TTL dài hơn có chi phí ghi cao hơn nhưng giữ ngữ cảnh trong bộ đệm lâu hơn. - Cache Logging — ghi log chi tiết tùy chọn về hiệu năng bộ đệm.
Việc lưu đệm chỉ được kích hoạt khi một yêu cầu thực sự mang ngữ cảnh có thể tái sử dụng (ví dụ: khi một Space được đính kèm vào cuộc trò chuyện). Xem Prompt Caching để biết đầy đủ chi tiết.
Kiểm tra kết nối
Nút Test Connection xác thực cài đặt của bạn trước khi lưu:
Kết quả màu xanh nghĩa là thông tin xác thực và endpoint hoạt động tốt; kết quả màu đỏ cho biết điều gì đã sai để bạn khắc phục.
Tham số mô hình
Sau khi thiết lập một mô hình, bạn có thể tinh chỉnh cách nó tạo văn bản:
- Temperature — thấp hơn cho đầu ra chính xác/xác định, cao hơn cho đầu ra sáng tạo/đa dạng.
- Max tokens — giới hạn độ dài của phản hồi.
- Top-p / sampling — kiểm soát chi tiết mức độ ngẫu nhiên (khi mô hình hỗ trợ).
Rephlo áp dụng phạm vi tham số phù hợp với từng mô hình, vì vậy bạn không thể đặt các giá trị mà mô hình không chấp nhận.