본문으로 건너뛰기

제공업체 관리

Rephlo는 여러 AI 제공업체에 동시에 연결됩니다. 일상적인 작업에는 호스팅된 Rephlo 요금제를, 일반적인 작업에는 사용자 본인의 OpenAI 계정을, 긴 문서 작업에는 Anthropic 계정을, 개인 데이터 작업에는 로컬 Ollama 모델을 사용하는 등, 이 모두를 나란히 구성하여 함께 사용할 수 있습니다.

AI에 접근하는 두 가지 방법

1. Rephlo Gateway (신규 사용자에게 권장)

Rephlo Gateway(Dedicated API)는 가장 손쉽게 시작할 수 있는 방법입니다. 직접 API 키를 관리하는 대신, Rephlo 계정 구독을 통해 AI 모델에 액세스합니다.

장점:

  • API 키 관리 불필요 — Rephlo 계정으로 로그인하기만 하면 됩니다.
  • 통합 결제 — 하나의 구독으로 여러 AI 모델을 이용할 수 있으며, credit으로 추적됩니다.
  • 사전 구성된 모델 — 별도 설정 없이 인기 모델을 바로 사용할 수 있습니다.
  • 자동 업데이트 — 새로운 모델이 자동으로 추가됩니다.

Gateway 사용 방법:

  1. Account 영역을 열고 Rephlo 계정으로 Sign in합니다.
  2. 로그인하면 Gateway 제공업체가 자동으로 설정되고 해당 모델을 사용할 수 있게 됩니다.

Gateway 제공업체는 계정을 통해 관리되므로 제공업체 목록에서 직접 추가하거나 제거할 필요가 없습니다. Account결제 및 구독(Billing & Subscription) 문서를 참고하세요.

BYOK나 온디바이스(on-device) 전용을 선호하시나요? Settings > LLM Providers에서 Hide online models from Rephlo Gateway를 켜세요 — 이 토글은 On-DeviceBYOK Providers 하위 탭 모두에서 사용할 수 있습니다. 이 토글을 켜면 상태 표시줄, chat, 오버레이 등 모든 모델 선택 화면에서 Gateway(Dedicated API) 모델이 숨겨집니다. 켜는 시점에 Gateway 모델이 활성 모델로 설정되어 있었다면, Rephlo는 사용자가 숨겨진 모델에 그대로 남아 있지 않도록 자동으로 접근 가능한 온디바이스 또는 BYOK 모델로 전환해 드립니다.

2. BYOK (직접 API 키 사용)

직접적인 제어를 선호하거나 이미 제공업체 구독을 보유한 사용자를 위해, Rephlo는 사용자 본인의 API 키를 사용하여 AI 제공업체에 직접 연결합니다.

장점:

  • 제공업체와의 직접적인 관계 — 제공업체에 직접 비용을 지불합니다.
  • 완전한 제어 — 제공업체가 제공하는 모든 모델과 기능에 액세스합니다.
  • 커스텀 엔드포인트 — 비공개, 엔터프라이즈, 또는 자체 호스팅 배포에 연결할 수 있습니다.

지원되는 제공업체 (BYOK)

제공업체를 추가할 때 다음 유형 중 하나를 선택합니다.

제공업체Vision참고
OpenAI지원GPT 계열 모델; 커스텀 엔드포인트 선택 가능
Anthropic지원Claude 모델; 프롬프트 캐싱 지원
Google AI지원Gemini 모델
Grok (xAI)지원Grok 모델; Live Search(웹) 선택 가능
Groq모델에 따라 다름오픈 모델을 위한 고속 추론
OpenRouter모델에 따라 다름여러 제공업체의 다양한 모델로 연결되는 게이트웨이
Ollama모델에 따라 다름로컬/오프라인 모델; 웹 검색용 키 선택 가능
OpenAI-Compatible모델에 따라 다름OpenAI 규격을 따르는 모든 서비스 — Azure OpenAI, vLLM, LocalAI, LiteLLM, 커스텀 프록시 등

Azure OpenAI는 제공업체 추가 목록에 별도 항목으로 있는 것이 아니라 OpenAI-Compatible 유형을 통해 연결합니다(Azure 엔드포인트를 지정하면 됩니다). Ollama에 대한 자세한 내용은 전용 문서인 온디바이스 모델(On-Device Models)에서 다룹니다.

제공업체 추가하기

  1. Settings > Providers로 이동합니다.
  2. Add Provider를 클릭합니다.
  3. Select Type — 드롭다운에서 제공업체를 선택합니다.
  4. 세부 정보 입력 (선택한 유형에 따라 필드가 달라집니다):
    • Name — 식별하기 쉬운 별칭(예: "My GPT", "Work Claude").
    • API Key — 제공업체 대시보드에서 발급받은 비밀 키.
    • Base URL — OpenAI-Compatible과 Ollama의 경우 엔드포인트 URL.
    • Model Name — 사용할 모델(OpenAI-Compatible 등 일부 유형에서 필수).
  5. Test Connection — 저장하기 전 설정을 검증합니다(아래 참고).
  6. Save.

제공업체별 필드

각 제공업체 유형은 필요한 정보를 요청합니다.

제공업체필수선택
OpenAIAPI Key커스텀 Base URL
AnthropicAPI KeyBase URL; 프롬프트 캐싱 설정
Google AIAPI KeyBase URL
Grok (xAI)API KeyLive Search 토글
GroqAPI Key
OpenRouterAPI KeySite URL, Site Name (OpenRouter 활동 대시보드용)
OllamaBase URL (기본값 http://localhost:11434)API key (웹 검색 시에만 필요)
OpenAI-CompatibleAPI Key, Base URL, Model Name

Anthropic 프롬프트 캐싱

Anthropic 제공업체를 추가하면 프롬프트 캐싱 옵션이 표시됩니다.

  • Enable Prompt Caching — 기본적으로 켜져 있습니다. 캐싱은 반복되는 컨텍스트의 비용을 크게 절감할 수 있습니다.
  • Cache TTLephemeral(약 5분) 또는 extended(약 1시간). TTL이 길수록 쓰기 비용은 높아지지만 컨텍스트가 더 오래 캐시된 상태로 유지됩니다.
  • Cache Logging — 캐시 성능에 대한 상세 로깅(선택 사항).

캐싱은 요청에 실제로 재사용 가능한 컨텍스트가 포함된 경우에만 작동합니다(예: chat에 Space가 첨부된 경우). 전체 내용은 프롬프트 캐싱(Prompt Caching)을 참고하세요.

연결 테스트하기

Test Connection 버튼은 저장하기 전에 설정을 검증합니다.

녹색 결과는 자격 증명과 엔드포인트가 정상 작동함을 의미하며, 빨간색 결과는 무엇이 잘못되었는지 보여주므로 이를 바탕으로 수정할 수 있습니다.

모델 파라미터

모델이 설정되면 텍스트 생성 방식을 조정할 수 있습니다.

  • Temperature — 낮추면 정밀하고 일관된 출력이, 높이면 창의적이고 다양한 출력이 나옵니다.
  • Max tokens — 응답 길이의 상한을 설정합니다.
  • Top-p / sampling — 무작위성을 세밀하게 제어합니다(모델이 지원하는 경우).

Rephlo는 각 모델에 맞는 파라미터 범위를 적용하므로, 모델이 허용하지 않는 값은 설정할 수 없습니다.

제공업체당 다중 모델

하나의 제공업체는 여러 모델을 보유할 수 있습니다. Add/Edit Provider 드로어에서 다음을 할 수 있습니다.

  • Add Model — 동일한 제공업체 아래에 다른 모델을 각각의 파라미터와 함께 추가로 등록합니다.
  • Set Active Model — 해당 제공업체가 기본적으로 사용할 모델을 지정합니다.
  • 개별 모델을 Edit / Remove합니다.

이를 통해 하나의 Anthropic 또는 OpenRouter 연결로 일상 업무용 빠른 모델과 어려운 문제를 위한 더 강력한 모델을 모두 다룰 수 있어, 제공업체를 두 번 설정할 필요가 없습니다.

제공업체 기능(Capabilities)

제공업체를 추가하거나 편집할 때 해당 제공업체가 지원하는 기능을 표시할 수 있습니다. 이는 Chat과 command에서 사용할 수 있는 기능을 결정합니다.

  • Vision — Visual Intelligence를 활성화합니다: 스크린샷, 사진, 다이어그램, 오류 메시지를 캡처하고 분석합니다.
  • Function Calling — 외부 도구를 호출합니다(MCP Connectors를 사용하려면 필요).
  • Long Context — 대용량 입력을 처리합니다.
  • Code Generation — 코딩 작업에 최적화되어 있습니다.
  • Streaming — 응답이 실시간으로 점진적으로 표시됩니다.

예를 들어 Visual Intelligence 기능(스크린샷, 다이어그램, 오류 메시지)을 사용하려면 Vision 기능을 지원하는 제공업체가 필요하며, chat에서 connector를 사용하려면 Function Calling 기능을 지원하는 모델이 필요합니다.

활성 제공업체 설정하기

모든 command에 기본적으로 사용할 Active Provider를 지정할 수 있습니다.

  • 활성 제공업체는 command가 이를 재정의하지 않는 한 모든 command를 실행합니다.
  • 변경하려면 목록에서 원하는 제공업체 옆의 Activate를 클릭합니다.
  • 활성 제공업체는 인터페이스에서 강조 표시됩니다.
  • 한 번에 하나의 제공업체만 활성화됩니다.

API 키 발급받기 (BYOK)

BYOK를 사용하면 사용량에 대해 제공업체에 직접 비용을 지불합니다. 각 제공업체의 콘솔에서 키를 발급받으세요.

  • OpenAIplatform.openai.com
  • Anthropicconsole.anthropic.com
  • Google AIaistudio.google.com
  • Grok (xAI)console.x.ai
  • Groqconsole.groq.com
  • OpenRouteropenrouter.ai
  • Ollama (웹 검색 키)ollama.com/settings/keys

로컬 모델 구성하기 (Ollama)

모델을 완전히 오프라인으로 실행하려면:

  1. Ollama를 설치합니다.
  2. 터미널에서 모델을 받습니다(예: ollama pull llama3).
  3. Rephlo에서 Ollama 제공업체를 추가합니다.
  4. Base URLhttp://localhost:11434(기본값).
  5. Model — Ollama에 표시되는 이름과 정확히 동일하게 입력합니다(예: llama3:latest).
  6. (선택) 웹 검색을 활성화하려면 Ollama 웹 검색 키를 추가합니다.

온디바이스 GGUF 모델과 하드웨어 확인에 대해서는 온디바이스 모델(On-Device Models)을 참고하세요.

제공업체 인터페이스 기능

Providers 페이지는 다수의 연결을 관리하는 데 도움을 줍니다.

  • Search — 이름으로 제공업체를 찾습니다.
  • View toggle — 카드 보기와 목록 보기를 전환합니다.
  • Status indicators — 어떤 제공업체가 구성되어 있는지, 활성 상태인지, 오류가 있는지를 한눈에 확인합니다.

제공업체 문제 해결

  • 401 Unauthorized — API 키가 잘못되었을 가능성이 높습니다. 제공업체에서 키를 다시 복사하여 재테스트하세요.
  • 429 Too Many Requests — 제공업체의 속도 제한에 도달했거나 credit이 소진되었습니다.
  • Connection Refused (Ollama) — Ollama 백그라운드 서비스가 실행 중인지 확인하세요.
  • Model Not Found — 모델 ID 철자가 올바른지, 해당 계정에서 사용 가능한지 확인하세요.
  • 새 컴퓨터에서 가져오기(import) 후 테스트 실패 — 암호화된 키는 기기 간 이동이 불가능하므로 키를 다시 입력하세요. 가져오기 및 내보내기(Import & Export)를 참고하세요.

관련 문서: 온디바이스 모델(On-Device Models) · 프롬프트 캐싱(Prompt Caching) · 제공업체 설정(Provider settings)

다음 기능: Commands 실행하기의 다양한 방법을 알아보세요.