Tabion
AIRouter
여러 공급사의 AI 모델을, 하나의 API로.
계약·결제를 한 건으로 통합하고, 예산과 보안 기준 안에서 팀이 필요한 모델을 즉시 사용할 수 있도록 지원합니다.


기업의 멀티 모델 활용이 늘면서
공급자별 관리 부담이 늘고 있습니다.
- 01멀티 모델 활용의 일반화업무 특성에 따라 여러 공급자의 모델을 함께 사용하는 방식이 일반화되고 있습니다.
- 02공급자별 다른 운영 조건계약 · 결제 · API 규격 · 보안 조건이 공급자마다 서로 다릅니다.
- 03늘어나는 개별 연동애플리케이션마다 공급자와 개별 연동하여 관리 지점이 지속적으로 늘어납니다.
공급자마다 계약 · 결제 · 키 · 보안 검토를 개별로 수행합니다.
관리 부서는 통제를,
개발 조직은 속도를 요구합니다.
통제가 필요합니다
- 요구 사항 — 계약 · 비용 · 외부 전송 데이터 통제
- 성과 기준 — 보안 사고 없음 · 예산 준수
- 우려 사항 — 예산 초과 · 데이터 외부 유출
속도가 필요합니다
- 요구 사항 — 필요한 모델의 즉시 사용
- 성과 기준 — 빠른 개발과 출시
- 우려 사항 — 모델 교체 시 서비스 장애
어느 한쪽 요구만 충족하는 방식으로는 기업의 AI 활용을 확대할 수 없습니다.
계약, 비용, 보안을 일원화하여
관리할 수단이 없습니다.
통합 계약 · 청구
- 공급자별 개별 계약 · 정산
- 신규 모델 도입 시 계약 절차 반복
예산 통제
- 사용 금액을 청구 이후에야 파악
- 부서 · 서비스별 한도 관리 수단 부재
보안과 거버넌스
- 민감 데이터의 전송 대상 통제 불가
- 보안 심사 대응 근거 부족
공급자가 4곳이면
공급자가 4곳이면
공급자가 4곳이면
모델 교체, 모델 선택, 장애 대응이
모두 개발 부담으로 이어집니다.
모델 전환 비용
- 모델명이 코드에 고정
- 교체 · 검증 · 원복마다 코드 수정과 재배포 필요
요청에 맞는 모델 선택
- 모든 요청에 단일 모델 적용
- 단순 작업에도 고가 모델 사용
서비스 가용성
- 공급자 장애가 서비스 중단으로 직결
- 호출 한도 초과(HTTP 429)가 사용자에게 그대로 노출
모델 교체 절차 코드 수정 → 테스트 → 재배포를 교체할 때마다 반복 · 호출 한도는 공급자 계정 단위로 적용됩니다.
애플리케이션마다 따로 연동하던 구조를
하나로 모읍니다.
애플리케이션 3개가 공급자 3곳과 직접 연동하면 관리 지점이 9개로 늘어납니다. AIRouter를 거치면 연동 · 계약 · 키 · 보안 검토를 한 곳에서 처리합니다.
- 01관리 지점이 곱으로 늘어납니다애플리케이션 수 × 공급자 수만큼 연동 · 계약 · 키 · 보안 검토가 필요합니다.
- 02한 곳으로 모읍니다모든 요청이 AIRouter를 거치므로 공급자 추가 · 교체가 애플리케이션 코드에 영향을 주지 않습니다.

모든 AI 호출을
하나의 게이트웨이로 통합합니다.
기업 애플리케이션과 여러 AI 모델 공급자 사이에서 모든 요청을 중계하는 기업용 AI 게이트웨이입니다.
서비스 키 하나로
서비스 키 하나로 여러 공급자의 모델을 호출합니다.
단일 콘솔에서 관리
계약 · 예산 · 보안 정책을 단일 콘솔에서 관리합니다.
2026-09-28 운영 환경 기준
2026-09-28 운영 환경 기준
6가지 과제를
하나의 플랫폼에서 해결합니다.
통합 계약 · 청구
여러 공급자 계약 · 정산을 단일 계약으로 통합. 신규 모델 추가 시 재계약 불필요.
예산 통제
조직 · 워크스페이스 · 서비스 키 단위로 한도 설정. 한도 도달 시 요청 차단, 월 예상 비용 산출.
보안과 거버넌스
허용 공급자 · 모델 · 리전 · 데이터 정책 설정. 개인정보(PII) 탐지, 모든 요청 로그 기록.
모델 전환 비용 제거
모델 교체 · 원복 · A/B 테스트를 콘솔 설정으로 처리. 코드 배포 불필요.
요청에 맞는 모델 자동 선택
입력 길이 · 메시지 수 · 도구 호출 · 이미지 포함 · 구조화 출력 조건에 따른 조건 기반 라우팅.
장애 시 자동 전환
공급자 장애 · 호출 한도 초과 시 대체 공급자 · 폴백 모델로 자동 페일오버. 자주 실패하는 엔드포인트는 일시 제외.
개발사 · 클라우드 공급자 · 호스팅의 모델을
하나의 API로 사용합니다.
개발사 직접
OpenAI · Anthropic · Google · xAI — 모델 개발사가 직접 제공하는 최신 모델을 사용합니다.
클라우드 공급자
AWS · Azure — 같은 모델을 클라우드 공급자를 통해 제공합니다. 공급자별 리전 · 데이터 정책을 선택 기준으로 사용합니다.
호스팅
Huawei — 전용 장비에서 운영하는 모델을 같은 API · 같은 정책으로 사용합니다.
하나의 서비스 키
하나의 서비스 키로 모든 공급자의 모델을 호출합니다.
공급자별 비교
같은 모델을 여러 공급자에서 — 단가 · 지연시간 · 데이터 정책을 비교합니다.
자동 전환
한 공급자에 장애가 나면 다른 공급자로 자동 전환합니다.
비용과 보안을
사전에 통제합니다.
- 01통합 빌링공급자 단가 기준의 요청 단위 비용 산출. API 응답(usage.cost)과 청구 내역에 같은 금액 기록.
- 02예산 통제조직 · 워크스페이스 · 서비스 키 단위 예산 한도. 한도 도달 시 요청 차단, 비용 예측 제공.
- 03가드레일조직 관리자가 설정하고 서비스 키마다 적용. 개발자가 요청 단위로 해제 불가.
- 04입력 데이터 검사개인정보 · API 키 등 비밀값을 탐지하여 차단 · 마스킹 · 경고.

기존 코드를 유지한 채
모델 운영을 콘솔로 옮깁니다.
- 01OpenAI API 호환기존 SDK 코드에서 base_url과 API 키만 변경하면 도입이 완료됩니다.
- 02라우팅 프리셋모델 선택 조건 · 공급자 라우팅 · 폴백 모델을 콘솔에 저장. 코드에서는 프리셋 ID만 호출합니다.
- 03버전 관리와 A/B 테스트프리셋을 버전으로 관리하여 즉시 원복. 일부 트래픽에만 새 설정 적용.
client = OpenAI(
api_key="sk-...")
client.chat.completions.create(model="gpt-4o", ...)
client = OpenAI(
base_url="https://api.airouter.tabion.ai/v1",
api_key="서비스 키")
client.chat.completions.create(model="preset/support", ...)
AI를 서비스에 적용하는
기업을 대상으로 합니다.
AI 에이전트 · 솔루션 개발 기업
멀티 모델 운영. 모델 교체와 장애 대응이 서비스 품질을 결정합니다.
여러 부서가 생성형 AI를 사용하는 대기업
부서별 예산 배분 · 사용 현황 가시화 · 공급자 계약 일원화.
금융 · 공공 · 의료 등 규제 산업
데이터 정책 · 리전 제한. 보안 심사용 감사 로그.
SI · ISV
고객사 · 프로젝트별 워크스페이스 · 예산 · 서비스 키 분리 관리.
역할별 필요한 기능을
제공합니다.

데이터 플레인과
컨트롤 플레인을 분리한 구조입니다.
PostgreSQL
정책 · 모델 카탈로그 · 사용량 데이터를 저장합니다.
관리 API · 사내 포털 · SIEM
콘솔과 같은 관리 API를 제공하여 사내 포털 · SIEM과 연동할 수 있습니다.
모든 요청은 인증부터 과금까지
같은 절차를 거칩니다.
서비스 키 검증
서비스 키 검증 · 워크스페이스 식별.
정책 확인
허용 모델 · 공급자 · 리전 · 데이터 정책 확인, 입력 데이터 검사.
한도 · 잔액
예산 한도 · 잔액 확인, 초과 시 차단.
단가 가중 분산
기본은 단가 가중 부하 분산. 프리셋 :cheapest · :fastest 지정 시 최저 단가 · 최저 지연.
규격 변환
공급자 API 규격 변환 · 스트리밍 중계.
자동 전환
첫 스트리밍 청크 수신 전 실패 시 대체 공급자 · 폴백 모델로 전환.
사용량 기록
토큰 · 비용 · 지연시간 기록, 응답 헤더로 처리 공급자 표시.
요청을 거절합니다
지정 모델 · 허용 공급자로 전송할 수 없으면 다른 대상으로 보내지 않고 요청을 거절합니다. 페일오버도 허용 목록 안에서만 동작합니다.
모델 이름만 지정해도 여러 공급자에 분산하고,
장애 시 다음 공급자로 전환합니다.
- 01기본 부하 분산모델을 제공하는 허용된 엔드포인트에 단가 가중으로 분산. 무료 엔드포인트 우선, 같은 단가는 관리자가 정한 순서.
- 02장애 시 폴백첫 스트리밍 청크 수신 전에 실패하면 다음 엔드포인트, 이어서 폴백 모델로 전환. 허용 목록 안에서만 전환.
- 03일시 제외1분 안에 3회 넘게 실패한 엔드포인트는 30초 동안 후보에서 제외. 공급자가 대기 시간을 알려주면 그 시간(최대 15분) 동안 제외.
x-airouter-model anthropic/claude-haiku-4-5-20251001
x-airouter-endpoint anthropic
x-airouter-fallbacks anthropic/claude-haiku-4-5
x-airouter-call call_d058132e6efe23eb
응답마다 처리한 공급자와 폴백 순서를 표시하고, 요청 기록에도 남깁니다.
기업 운영 환경에 맞춘
게이트웨이 기술을 적용했습니다.
OpenAI API 호환
Chat Completions · Responses · Embeddings · Images · Audio · Videos · Moderations · Models.
공급자 규격으로 변환
Responses API로 Claude · Gemini 호출. 도구 호출 · 구조화 출력 · 프롬프트 캐싱을 공급자 규격으로 변환.
설정 기반 프로필
공급자를 설정 기반 프로필로 관리. 공급자 추가 시 코드 변경 최소화.
자동 수집
공급자 모델 목록과 단가 정보 자동 수집.
일관된 한도
서버를 수평 확장해도 조직 · 키 단위 호출 한도를 일관되게 유지.
안전한 거절
지정 모델 · 허용 공급자로 전송할 수 없으면 다른 대상으로 보내지 않고 요청 거절.
확률적 추정 없음
보안 · 예산 판정을 확률적 추정 없이 규칙으로 적용.
콘솔과 같은 API
콘솔과 같은 관리 API 제공. 사내 포털 · SIEM 연동 가능.
고객의 데이터와 자격 증명을
분리하여 보호합니다.
공급자 키를 보호합니다
- 공급자 키 암호화 저장
- 응답 · 로그 · 오류 메시지에 비노출
- 고객은 서비스 키로만 호출 — 공급자 키 비공개
조직마다 분리합니다
- 조직 → 워크스페이스 → 서비스 키 계층
- 역할 기반 접근 제어(소유자 · 관리자 · 감사자 · 재무 · 구성원)
원문은 볼 수 없습니다
- 서비스 관리자는 프롬프트 · 응답 원문과 서비스 키 원문 열람 불가
- 고객 조직으로 대리 접속하는 기능 없음
SaaS · 4개 언어
- SaaS · 싱가포르 리전
- 한국어 · 영어 · 일본어 · 중국어 지원
로드맵 설치형 제공 · 호스팅 모델 확대 (예정)

여러 공급자의 모델을
하나의 콘솔에서 운영합니다.

여러 공급자의 모델을
한눈에 조회하고 비교합니다.
- 01하나의 카탈로그개발사/모델명 형식으로 통일한 모델 ID. 배포 위치 · 입력 단가 · 컨텍스트 길이 · 지원 파라미터로 필터. 텍스트 · 이미지 · 영상 · 음성 · 임베딩 모델 구분.
- 02최대 4개 나란히 비교입력 · 출력 · 캐시 단가와 컨텍스트 길이를 비교. 항목마다 유리한 모델에 「우수」 표시, 「차이만 보기」로 다른 항목만 표시.
- 03모델 상세모델 정보(개발사 · 입출력 형식 · 컨텍스트 · 지원 파라미터), 공급자별 엔드포인트의 단가 · 지연시간 · 데이터 정책, 가용성 · 첫 토큰 지연(TTFT), 사용량 추이를 한 화면에서 확인.
모델 운영 방식을 프리셋으로 저장하고,
폴백 · A/B 테스트를 코드 수정 없이 설정합니다.
- 01서비스 키 단위 한도서비스 키는 워크스페이스 단위로 발급하고 키별 한도를 설정합니다. 코드에는 프리셋 ID(preset/이름)만 기재합니다.
- 02폴백과 선택 기준폴백 모델과 선택 기준(우선순위 순 · 최저 단가)을 지정합니다. 「요청 재정의 금지」로 호출에서 설정 변경을 차단합니다.
- 03조건부 라우팅조건에 맞는 요청을 지정한 대상으로 전송. 엔드포인트를 직접 지정하거나 자동 선택할 수 있습니다.
- 04A/B 테스트미지원 파라미터 처리 방식 설정, 일부 트래픽에만 새 설정을 적용하는 A/B 테스트.

호출 전에 테스트하고,
개인정보는 전송 전에 가립니다.
- 01호출 전에 즉시 테스트base_url · 서비스 키 · 태그 등 실제 호출 설정 그대로 실행. 가드레일 적용 상태로 실행하고, Python · TypeScript · cURL 코드를 제공합니다.
- 02모든 요청의 처리 결과 추적요청별 모델 · 배포 위치 · 입력 · 출력 토큰 · 비용, 첫 토큰 지연(TTFT) · 라우팅 오버라이드 · 종료 사유. 성공 · 실패 필터, 요청 기록 내보내기.
- 03개인정보 마스킹주민등록번호 · 카드번호 · 전화번호 · 메일은 「마스킹 후 전송」. 모델이 받은 내용은 [REDACTED]로 대체됩니다.
고객 메일: [REDACTED]
결제 카드: [REDACTED]
연락처: [REDACTED]

비용을 사후 확인이 아닌 사전 통제로 관리하고,
보안 심사와 정산의 근거를 제공합니다.
- 01사용량 · 예산워크스페이스 · 서비스 키 · 모델 · 배포 위치 · 태그별 사용량. 예산 한도 설정, 한도 도달 알림과 요청 차단, 최근 사용 추이로 3 · 6 · 12개월 예상 금액 산출.
- 02감사 · 청구요청별 워크스페이스 · 모델 · 배포 위치 · 리전 · 비용 · 결과 기록. 기간 조회와 내보내기, 계약 조건 · 잔액 · 사용 내역 조회, 요청 단위 비용과 청구 내역 일치.
- 03서비스 관리 콘솔운영사가 서비스 상태(공급자 · 엔드포인트 모니터링과 장애 이력), 테넌트(고객 조직 · 계약 · 충전 · 가입 신청 승인), 공급자 · 모델 카탈로그(공급자 키 등록 · 모델 동기화)를 관리합니다. 고객 화면과 분리된 별도 콘솔이며 운영사는 고객의 프롬프트 · 응답 원문에 접근할 수 없습니다.
관리 부서와 개발 조직이
함께 효과를 얻습니다.
같은 결과를
더 낮은 비용으로 얻습니다.
모든 요청에 최상위 모델을 쓰지 않습니다
조건 기반 라우팅으로 요청마다 적정 모델을 적용합니다.
같은 모델이면 가장 저렴한 곳으로
같은 모델을 여러 공급자가 판매하면 최저 단가 공급자로 라우팅합니다.
청구 내역과 같은 금액
모델 단가는 공급자 단가를 그대로 적용하며, 요청 단위 비용을 응답과 청구 내역에 같은 금액으로 기록합니다.
※ 절감률은 고객 도입 사례 확보 후 제시합니다.

