핵심 개념: 공급자(Providers)
**공급자(Provider)**는 텍스트를 처리하고 응답을 생성하는 기반 AI 엔진(대규모 언어 모델)입니다. Rephlo는 범용 인터페이스이므로, 작업별로 이러한 "두뇌"를 자유롭게 교체할 수 있으며, 하나의 공급자가 여러 모델을 노출할 수도 있습니다(모델 및 추론 참고).
공급자 유형
Rephlo는 8가지 Bring-Your-Own-Key(BYOK) 공급자 유형과 Rephlo가 관리하는 Dedicated API를 지원합니다:
클라우드 공급자 (인터넷 필요)
- OpenAI — GPT 계열 모델. 추론, 코딩, 창작 분야의 업계 표준입니다.
- Anthropic — Claude 모델; 고품질 글쓰기, 넓은 컨텍스트 윈도우, 그리고 기본적으로 켜져 있는 prompt caching으로 잘 알려져 있습니다.
- Groq — 맞춤형 LPU 칩에서 동작하는 초고속 추론 — 거의 즉각적인 응답을 제공합니다.
- Google — 강력한 멀티모달 기능을 갖춘 Gemini 모델.
- xAI (Grok) — 실시간 Live Search를 선택적으로 사용할 수 있는 Grok 모델.
- OpenRouter — Site URL / Site Name을 통한 추적 기능과 함께, 다양한 벤더의 100개 이상 모델에 접근할 수 있는 통합 게이트웨이.
- OpenAI-Compatible — OpenAI API 스펙을 구현하는 모든 서비스(Azure OpenAI, vLLM, LocalAI, LiteLLM, LM Studio, 커스텀 프록시)에 연결합니다. API 키, Base URL, Model Name이 필요합니다.
로컬 공급자 (완전한 프라이버시)
- Ollama — 오픈소스 모델(Llama, Mistral, Gemma, DeepSeek, Qwen)을 컴퓨터에서 직접 실행합니다. 데이터가 사용자의 기기를 벗어나지 않습니다. Base URL을 설정할 수 있으며(기본값
http://localhost:11434), 선택적으로 Ollama API 키를 설정하면 웹 검색이 가능합니다.
Azure OpenAI는 OpenAI-Compatible 유형을 통해 연결됩니다 — OpenAI-Compatible을 선택하고 Azure 배포 엔드포인트를 Base URL로(그리고 배포 이름을 Model Name으로) 입력하세요. 공급자 추가 목록에 별도 항목으로 존재하지 않습니다.
온디바이스(On-device) 모델: Rephlo는 내장 엔진을 통해 GGUF 모델을 기기에서 완전히 실행할 수도 있습니다(인터넷 불필요, Ollama 불필요). 이는 관련은 있지만 별도의 추론 경로입니다 — 온디바이스 모델 및 모델 및 추론을 참고하세요.
관리형 공급자
- Dedicated API — OAuth 2.0을 사용하는 Rephlo의 관리형 클라우드 옵션입니다. API 키를 직접 관리하고 싶지 않은 사용자를 위한 가장 간단한 설정이며, 사용량은 credit으로 추적됩니다. 설정은 자동으로 생성되며 일반 공급자 목록에는 표시되지 않습니다.
BYOK/온디바이스 전용 선택기를 원하시나요? Providers에서 Hide online models from Rephlo Gateway를 켜면 모든 모델 선택기에서 Dedicated(Gateway) 모델을 숨길 수 있습니다.
온디바이스 vs BYOK
이 두 가지 "직접 모델 준비" 방식은 혼동하기 쉽습니다:
- On-Device — 내장 엔진을 통해 사용자 기기에서 로컬로 실행되는 오픈 모델(GGUF)입니다. API 키 불필요, 인터넷 불필요, 완전한 프라이버시—어떤 데이터도 컴퓨터를 벗어나지 않습니다.
- BYOK (Bring Your Own Key) — 외부 공급자(클라우드 벤더 또는 로컬 Ollama)에 본인의 API 키를 직접 제공하는 방식입니다. 요청은 사용자의 키로 해당 공급자에게 전송되며, 벤더가 사용자에게 직접 요금을 청구합니다.
On-Device와 BYOK 모두 Pro 등급 기능이며, 사용하려면 활성화된 Pro 플랜(또는 그 이상) 또는 영구 라이선스가 필요합니다. 온디바이스 모델의 경우 이 등급 제한은 다운로드와 실행 모두에 적용됩니다. 잠금이 해제되면 credit 소모 없이 완전히 오프라인으로 실행됩니다. Providers에서 키를 설정하세요.
Platform Dedicated API vs Enterprise BYOK
- Dedicated API는 Rephlo가 관리하는 호스팅 추론 서비스로, 로그인 후 Rephlo의 최신 모델을 사용할 수 있으며 credit으로 결제되고 관리할 키가 없습니다.
- **Enterprise BYOK(플랫폼을 통한)**는 조직이 자체 공급자 키와 허용 모델을 조직 단위로 중앙에서 구성하여, 모든 구성원이 조직의 모델과 키를 사용하도록 하는 방식입니다 — 규정 준수와 비용 관리를 위한 것입니다.
요약하면: Dedicated API는 키 관리 대신 credit과 제로 설정을 제공하는 반면, Enterprise BYOK는 키 관리를 조직 차원에서 중앙화합니다. 개인 BYOK 키는 Providers에서 설정합니다.
공급자 모드
각 공급자는 두 가지 모드 중 하나로 동작합니다: BYOK(벤더 키를 직접 제공) 또는 Dedicated(Rephlo가 관리하며 credit으로 추적).
연결 모드
Dedicated 모드 (관리형)
- 설명: Rephlo가 OAuth 2.0을 통해 연결과 결제를 관리하며, 사용량은 credit에서 차감됩니다.
- 장점: 제로 설정, 관리형 결제.
- 단점: 모델 파라미터에 대한 세밀한 제어가 제한적입니다.
BYOK 모드 (Bring Your Own Key)
- 설명: 본인의 벤더 API 키를 직접 사용합니다.
- 장점: 최대 수준의 프라이버시(데이터가 Rephlo 서버를 거치지 않고 사용자 기기에서 벤더로 바로 전달됨), 벤더 직접 요금제, 신규 모델에 대한 즉각적인 접근.
- 단점: 벤더 계정이 필요합니다.
공급자 설정에 저장되는 정보
각 공급자 설정에는 다음이 포함됩니다:
- 선택적인 Display Name 재정의.
- Mode(BYOK / Dedicated)와 공급자 유형.
- Models — 하나 이상의 모델이며, 그중 하나가 기본값으로 표시됩니다.
- Configuration — 공급자별 필드. API 키와 토큰은 암호화되어 저장됩니다:
- OpenAI / OpenAI-Compatible: API 키, 선택적 Base URL(그리고 OpenAI-Compatible의 경우 Model Name). Azure OpenAI는 이 유형을 사용합니다 — Base URL을 Azure 배포 엔드포인트로 지정하세요.
- Anthropic: API 키, 선택적 Base URL, 기본적으로 활성화된 prompt caching.
- Google: API 키, 선택적 Base URL.
- Groq: API 키.
- Ollama: Base URL, 선택적 API 키(웹 검색용).
- xAI (Grok): API 키, 선택적 Live Search 토글.
- OpenRouter: API 키, 선택적 Site URL / Site Name.
- Capabilities — Vision, Function Calling(도구), Long Context, Web Search, Thinking 등에 대한 토글이며, 런타임에 모델의 실제 기능과 대조하여 검증됩니다.
- Model Parameters — 공급자/모델별 요청 설정(temperature, max tokens, top-p 등).
한 번에 하나의 공급자만 활성화됩니다. 명령별로 공급자를 재정의하여 세밀하게 제어할 수도 있습니다.

API 키 발급받기 (BYOK)
BYOK를 사용할 경우, API 사용량은 벤더에게 직접 결제합니다.
| 공급자 | 키 발급처 | 참고 사항 |
|---|---|---|
| Azure OpenAI | portal.azure.com | Azure 구독과 배포된 OpenAI 리소스가 필요합니다 |
| OpenAI | platform.openai.com | GPT 계열 모델 |
| Anthropic | console.anthropic.com | Claude 모델; prompt caching 지원 |
| Groq | console.groq.com | 무료 등급 제공 |
aistudio.google.com | Gemini Pro / Flash | |
| xAI | console.x.ai | Grok 모델; 선택적 Live Search |
| OpenRouter | openrouter.ai | 키 하나로 100개 이상 모델 이용 |
| OpenAI-Compatible | 서비스별로 다름 | vLLM, LocalAI, LiteLLM, LM Studio |
| Ollama | 로컬 설치 + ollama.com/settings/keys | 로컬 모델; API 키는 웹 검색 시에만 필요 |
공급자 전환
공급자는 전역적으로(모든 명령의 기본값) 또는 명령별로 전환할 수 있습니다. 예를 들어, 빠른 맞춤법 검사에는 Groq를 사용하고(빠르고 저렴함), 복잡한 분석에는 Claude로 전환하는(똑똑하고 정교함) 식입니다.
공급자 비교 가이드
| 공급자 | 최적 용도 | 속도 | 프라이버시 |
|---|---|---|---|
| Azure OpenAI | 엔터프라이즈, 규정 준수 | 빠름 | 클라우드 |
| OpenAI | 범용, 코딩, 분석 | 빠름 | 클라우드 |
| Anthropic (Claude) | 글쓰기, 긴 문서, caching | 빠름 | 클라우드 |
| Groq | 빠른 작업 | 초고속 | 클라우드 |
| Google (Gemini) | 멀티모달, 리서치 | 빠름 | 클라우드 |
| xAI (Grok) | 실시간 정보 | 빠름 | 클라우드 |
| OpenRouter | 멀티모델 접근 | 다양함 | 클라우드 |
| OpenAI-Compatible | 자체 호스팅, 커스텀 | 다양함 | 자체 호스팅 / 클라우드 |
| Ollama | 프라이버시, 오프라인 | 하드웨어에 따라 다름 | 사용자 기기 |
구체적인 모델 이름과 컨텍스트 윈도우 크기는 자주 변경됩니다. 각 공급자가 정확히 어떤 모델을 노출하는지, 그리고 명령별 또는 대화별로 모델을 재정의하는 방법은 모델 및 추론을 참고하세요.
다음 개념: 대시보드 및 탐색을 살펴보세요.