출처

개요

OmniRoute은 여러 AI 제공자의 API와 구독 서비스를 하나의 로컬 게이트웨이로 통합하는 오픈소스 도구입니다. 로컬에서 http://localhost:20128/v1 OpenAI 호환 엔드포인트를 제공해 Claude Code, Cursor, Codex 등 다양한 도구가 동일한 주소를 사용하도록 합니다. 제공자의 한도 초과나 장애가 발생하면 구독, API 키, 저비용 모델, 무료 제공자 순으로 요청을 넘기는 폴백 구조를 지원합니다. 또한 라우팅 전략, 토큰 압축, MCP/A2A 연동 기능을 제공하며 Node.js, Docker, 데스크톱 앱, PWA, Termux 등 여러 환경에서 실행할 수 있습니다. 글에서 소개하는 기능과 제공자·모델 수는 프로젝트의 변경에 따라 달라질 수 있으므로 최신 정보는 공식 저장소에서 확인해야 합니다.

핵심 포인트

  • 로컬 게이트웨이가 여러 AI 제공자를 단일 OpenAI 호환 엔드포인트 뒤에 연결하며, 요청 경로에 OmniRoute의 클라우드 서버가 개입하지 않는 로컬 우선 구조를 취합니다.
  • 기본 폴백은 구독 서비스, 직접 발급한 API 키, 저비용 모델, 무료 티어 순서로 구성되며, auto, auto/coding, auto/fast, auto/cheap 등의 목적별 자동 라우팅을 제공합니다.
  • priority, cost-optimized, headroom, context-relay, fusion, pipeline 등을 포함한 여러 라우팅 전략을 조합할 수 있고, 쿼터 공유 전략으로 여러 키의 시간 기반 한도를 분배할 수 있습니다.
  • 서킷 브레이커, 연결 쿨다운, 모델 잠금 기능을 통해 장애 제공자·한도 초과 키·문제 모델을 각각 격리하고 다른 연결을 계속 사용할 수 있습니다.
  • RTK와 Caveman 기반 토큰 압축으로 반복적인 도구 출력과 컨텍스트를 줄이며, 글에서는 도구 호출이 많은 세션에서 15~95% 절감될 수 있다고 설명합니다. 이는 작성자가 제시한 수치이며 실제 절감률은 입력과 사용 환경에 따라 달라집니다.
  • MCP 서버와 A2A 서버를 통해 에이전트가 라우팅, 제공자, 콤보, 캐시, 압축, 메모리 등의 게이트웨이 기능을 직접 다룰 수 있습니다.
  • MIT 라이선스로 공개되어 있으며, npm 전역 설치, Docker, 소스 빌드, Electron 데스크톱 앱, Android Termux, PWA 등의 실행 방식을 제공합니다.

왜 중요한가

여러 AI 서비스와 코딩 도구를 함께 사용할 때 발생하는 엔드포인트·인증 정보·요금제·사용 한도 관리 문제를 로컬 게이트웨이 하나로 단순화하려는 접근입니다. 특히 제공자별 장애나 한도 초과 시 자동으로 다른 경로를 선택하고, 반복적인 도구 출력을 압축해 비용과 컨텍스트 사용량을 줄일 수 있다는 점이 실용적인 가치로 제시됩니다. 다만 제공자 지원 수, 무료 티어, 압축률, 실제 비용 절감 효과는 연결한 서비스와 시점에 따라 달라지므로 직접 검증이 필요합니다.

설치 및 기본 사용

npm install -g omniroute
omniroute
  • 대시보드: http://localhost:20128
  • API 엔드포인트: http://localhost:20128/v1
  • 코딩 도구 설정:
    • Base URL: http://localhost:20128/v1
    • API Key: 대시보드의 Endpoints에서 확인
    • Model: auto

모델 목록 조회 예시:

curl http://localhost:20128/v1/models \
  -H "Authorization: Bearer YOUR_KEY"

후속으로 볼 링크 및 키워드

관련 위키

원문 보존 위치

원문 전체는 raw source: 2026-07-28-pytorchkr-topic-11413-omniroute-aisource_url 및 HTML 원문과 함께 저장되어 있습니다.