본문으로 건너뛰기

LLM Providers

Settings의 LLM Providers 탭에서는 명령과 채팅을 구동하는 AI 모델에 Rephlo를 연결할 수 있습니다. 주요 AI 공급업체에 자신의 계정을 연결하거나, 완전한 프라이버시를 위해 모델을 로컬에서 실행하거나, 키 없이 Rephlo가 모든 것을 관리하도록 맡길 수 있습니다.

Settings → LLM Providers에서 열 수 있습니다.

Settings의 LLM Providers 탭 — On-Device 및 BYOK Providers 하위 탭이 표시된 화면

공급자를 사용하는 두 가지 방법

모드작동 방식적합한 대상
Login (Dedicated API)Rephlo가 대신 추론을 실행합니다. 관리할 API 키가 없으며 — 사용량은 요금제의 credit에서 차감됩니다.설정이 전혀 필요 없기를 원하는 모든 사용자
BYOK (Bring Your Own Key)공급자(OpenAI, Anthropic 등)에서 발급받은 자신의 API 키를 추가합니다. 해당 업체에 직접 비용을 지불하고 최신 모델을 사용합니다.이미 공급자 계정을 보유한 파워 유저

두 방식을 함께 사용할 수도 있습니다. 일상적인 사용을 위해 로그인 상태를 유지하면서 특정 모델을 위해 BYOK 공급자를 추가하는 방식입니다. 결제와 credit이 어떻게 작동하는지는 Credit 및 사용량요금제 및 가격을 참고하세요.

지원되는 공급자

Rephlo는 8가지 BYOK 공급자 유형을 지원합니다 — 7개의 클라우드 업체와 사용자의 기기에서 localhost:11434로 실행되는 로컬 Ollama — 그리고 on-device 및 관리형 옵션도 함께 제공합니다.

공급자제공해야 하는 항목
OpenAIAPI 키(선택적으로 사용자 지정 엔드포인트)
AnthropicAPI 키(선택적으로 base URL); prompt caching 지원
GoogleAPI 키(선택적으로 base URL)
GroqAPI 키
xAI (Grok)API 키(선택적으로 Live Search)
OpenRouterAPI 키(선택적으로 OpenRouter 대시보드용 사이트 URL/이름)
OpenAI-CompatibleBase URL + API 키 + 모델 이름(Azure OpenAI, vLLM, LocalAI, LiteLLM 등)
OllamaBase URL(기본값 http://localhost:11434); 웹 검색용 선택적 키
On-Device필요 없음 — 모델이 로컬에서 실행됩니다. On-Device 모델을 참고하세요.
Dedicated API필요 없음 — 로그인하면 Rephlo가 관리합니다.

Azure OpenAI는 별도 항목이 아니라 OpenAI-Compatible 유형을 통해 연결합니다 — Base URL을 Azure 배포 엔드포인트로 지정하세요.

공급자와 모델의 관계에 대한 개념적 개요는 공급자(Providers)모델 및 추론(Models & Inference)를 참고하세요.

공급자 추가하기

  1. Add Provider를 클릭합니다.
  2. 공급자 유형을 선택합니다. 양식은 해당 공급자에 필요한 필드만 표시하도록 자동으로 조정됩니다.
  3. 자격 증명을 입력합니다(예: API 키, 또는 Azure 엔드포인트 + 배포 이름).
  4. 필요하다면 custom name을 설정해 목록에서 공급자를 쉽게 알아볼 수 있게 합니다.
  5. 저장하기 전에 Test Connection을 클릭해 키가 정상 작동하는지 확인합니다.
  6. Save를 클릭합니다.

키는 암호화되어 저장됩니다

API 키와 토큰은 사용자의 기기에 저장되기 전에 암호화됩니다. 로그에는 절대 기록되지 않으며 데이터 내보내기에서도 제외됩니다. 키는 비밀번호처럼 다루세요 — Rephlo는 키를 로컬에 안전하게 보관합니다.

모델

각 공급자는 하나 이상의 모델을 제공합니다(예: OpenAI 공급자는 여러 GPT 모델을 제공할 수 있습니다). 하나의 공급자에 여러 모델을 추가하고 그중 하나를 기본값으로 지정할 수 있습니다. 명령이나 채팅을 실행하면, 명령 또는 대화에서 다른 모델을 지정하지 않는 한 Rephlo는 활성 공급자의 기본 모델을 사용합니다.

모델 선택기에서 요금제에 포함되지 않아 잠긴 Dedicated(Gateway) 모델에는 등급 배지(예: PRO 또는 ENTERPRISE)와 잠금 아이콘이 표시되어, 요금제가 어떤 모델을 포함하는지 한눈에 확인할 수 있습니다. 완전히 새로운 채팅을 시작하거나 해당 대화에 아직 모델이 설정되지 않은 상태로 Chat을 열면, 전역적으로 마지막에 사용한 모델이 다시 사용됩니다 — 이는 대화별 모델 선택과는 별개로 저장되는 값입니다.

명령별·대화별 모델 재정의와 이 전역 "마지막 사용" 기억 기능이 어떻게 작동하는지 알아보려면 모델 및 추론(Models & Inference)를 참고하세요.

Rephlo Gateway에서 온라인 모델 숨기기

On-DeviceBYOK Providers 하위 탭에는 모두 Hide online models from Rephlo Gateway 토글이 있습니다(툴팁: "When enabled, hides online models from Rephlo Gateway"). 이 토글을 켜면 상태 표시줄, 채팅, 오버레이 등 모든 모델 선택 화면에서 Dedicated(Gateway) 모델이 숨겨집니다.

v1.4.1부터는 토글을 켤 때 활성 모델이 Gateway 모델이면, Rephlo는 사용자가 모르는 사이 숨겨진 모델에 그대로 남아 있지 않도록 자동으로 사용 가능한 on-device 또는 BYOK 모델로 전환하며 — 사용 가능한 모델이 없으면 모델을 비활성화합니다.

기능

각 공급자 구성에는 모델이 무엇을 할 수 있는지 Rephlo에 알려주는 일련의 기능 플래그가 포함되어 있습니다.

  • Text generation — 항상 켜져 있습니다.
  • Vision — 이미지를 분석합니다(GPT-4o, Claude, Gemini처럼 비전 기능을 지원하는 모델에서만 사용 가능).
  • Function calling / tools — 구조화된 도구 사용으로, MCP connectors에 필요합니다.
  • Long context — 매우 큰 입력(100K 토큰 이상)을 처리합니다.
  • Streaming — 응답을 토큰 단위로 표시합니다(기본적으로 켜져 있음).
  • Web searchThinking — 모델이 지원하는 경우에 사용할 수 있습니다.

기능은 실행 시점에 모델의 실제 능력과 대조하여 검증되므로, 모델이 지원하지 않는 플래그를 켜더라도 문제가 발생하지 않습니다 — Rephlo는 해당 작업을 그저 시도하지 않을 뿐입니다.

모델 매개변수

모델별로 생성 동작을 조정할 수 있습니다.

  • Temperature — 값이 낮을수록 더 정확하고 일관되며, 값이 높을수록 더 창의적인 결과를 냅니다.
  • Max tokens — 각 응답의 길이를 제한합니다.
  • Top-p / top-k — 고급 사용자를 위한 추가 샘플링 제어 옵션입니다.

명령은 자신의 실행에 한해 이 값들을 재정의할 수 있으므로, 기본값은 차분한 낮은 temperature로 유지하면서 브레인스토밍용 명령 하나만 더 과감하게 설정할 수 있습니다.

Anthropic prompt caching

Anthropic 공급자는 prompt caching을 지원하며, 반복되는 컨텍스트의 비용을 크게 줄일 수 있습니다. 이 기능은 "ephemeral" 캐시(약 5분)로 기본 활성화되어 있습니다. "extended" 옵션(약 1시간)도 사용할 수 있습니다. 캐싱은 요청에 실제로 캐시 가능한 컨텍스트가 포함된 경우에만 작동합니다 — 자세한 내용은 Prompt Caching을 참고하세요.

Ollama 및 로컬 모델

Ollama의 경우 base URL을 설정하세요(기본값 http://localhost:11434). 사양이 제한된 기기에서는 메모리가 부족해지지 않도록 컨텍스트 창 크기에 유의하세요. Rephlo가 대신 로컬 모델을 다운로드하고 관리해 주기를 원한다면, 내장된 On-Device 모델 카탈로그를 사용하세요.

수정, 테스트, 삭제

  • Edit로 공급자의 키를 업데이트하거나, 모델을 추가하거나, 매개변수를 변경할 수 있습니다.
  • Test Connection은 키를 교체한 후 공급자를 다시 검증합니다.
  • 더 이상 사용하지 않는 공급자는 Remove로 삭제할 수 있습니다. 공급자를 삭제해도 명령은 삭제되지 않으며 — 활성 공급자로 대체되어 계속 작동합니다.

공통 설정

모든 공급자에는 다음과 같은 공통 옵션도 있습니다.

  • Request timeout(기본값 60초)
  • 일시적 오류에 대한 Max retries(기본값 3회)
  • Streaming 켜기/끄기

관련 페이지