OpenRouter는 여러분의 애플리케이션과 AI 모델 공급자들 사이에 놓이는 인프라입니다. 스스로의 정의는 간결합니다. 모든 모델을 위한 통합 인터페이스이며, 더 나은 가격과 더 나은 가동률을 약속하고 구독은 요구하지 않습니다. 실무적으로는 한 번만 연동해 하나의 엔드포인트를 상대하면, 원래라면 수십 개의 개별 공급사 계정과 SDK, 정산 관계, 장애 처리 분기가 있어야 닿을 수 있던 모델 목록에 접근하게 된다는 뜻입니다.
공식 문서는 가치 제안을 꾸밈 없이 적어 둡니다. 하나의 API 엔드포인트로 수백 개 모델에 접근하고, 폴백을 자동으로 처리하며, 요청마다 비용 효율이 좋은 선택지를 고른다는 것입니다. 이 두 문장이 제품의 전부입니다. 집약, 그리고 어떤 모델과 어떤 공급자가 이 호출을 처리해야 하는지에 대한 판단력입니다.
독자가 누구인지 분명히 짚어야 합니다. OpenRouter는 자주 잘못 분류되기 때문입니다. 사이트에는 브라우저 채팅 화면이 있고, 그 때문에 일부 디렉터리는 이 제품을 소비자용 AI 대화 서비스 옆에 놓습니다. 오독입니다. 그 채팅 화면은 개발자가 모델을 시험하고 프롬프트를 다듬으라고 존재합니다. 제품의 본체는 과금과 라우팅, 관측 기능이 붙은 API 계층입니다. 코드를 쓰지 않고 애플리케이션이 API를 호출하도록 설정하지도 않는다면, 이것은 직접 쓸 도구가 아닙니다. 반대로 그런 일을 한다면, 이 제품은 금세 고통스러워지는 문제를 다룹니다. 모델 공급자마다 자체 SDK와 자체 인증, 자체 속도 제한, 자체 장애가 있기 때문입니다.
서비스는 OpenRouter, Inc.가 운영하며 뉴욕 매디슨 애비뉴 169번지에 등록되어 있고, 약관은 뉴욕주법을 따릅니다. 창업자 Alex Atallah는 앞서 OpenSea를 창업한 인물이며, 투자사 글은 이 제안을 하나의 API, 하나의 통합 청구로 요약합니다. 뒷부분이 가치의 나머지 절반을 담습니다. 여러 공급자에 흩어진 지출을 계정 하나로 합쳐, 청구서 여러 장을 대조하지 않아도 되게 만드는 일입니다.
모델 공급자 다섯 곳과 직접 연동한다고 생각해 보십시오. 교체해야 할 API 키 다섯 벌, 버전을 따라가야 할 SDK 다섯 개, 지켜봐야 할 가격 페이지 다섯 개, 확인해야 할 상태 페이지 다섯 개, 그리고 한 곳이 성능 저하를 일으킬 때 직접 짜야 하는 장애 전환 로직이 있습니다. 여기에 신규 모델이 등장하는 속도를 곱하면, 연동 유지보수는 상시 발생하는 엔지니어링 비용이 됩니다. OpenRouter는 이 반복 비용을 하나의 의존성으로 바꿉니다. 그 교환이 합당한지가 진짜 평가 질문이며, 제한사항 항목에서 정면으로 다룹니다.
가장 특징적인 기능은 자동 모델 선택이고, 그 작동 방식은 정확히 이해할 가치가 있을 만큼 독특합니다. 라우터는 먼저 각 프롬프트를 약 30가지 세분화된 작업 유형 가운데 하나로 분류합니다. 코드 디버깅, 다단계 에이전트 계획, 지식 질의응답, 수학, 고객 지원 같은 범주입니다. 분류는 요청 중에 이뤄지며, 문서에 따르면 프롬프트 보관을 필요로 하지 않습니다.
두 번째 단계에서 일반적인 라우팅과 갈라집니다. 고정된 품질 순위에 기대는 대신, 해당 작업 유형에서 커뮤니티가 실제로 어떤 모델에 돈을 썼는지를 지난 7일 구간으로 집계해 참고합니다. 회사는 이를 시장 지수에 비유합니다. 예컨대 디버깅에서 더 나은 신규 모델로 사용이 옮겨가면 라우팅도 지출을 따라 자동으로 이동합니다. 이 체계는 안정 채널 openrouter/auto와 선행 채널 openrouter/auto-beta 두 슬러그로 운영됩니다.
모델을 고르는 것은 문제의 절반일 뿐입니다. 같은 모델이라도 여러 공급자가 서빙하며 가격과 속도, 신뢰도가 서로 다르기 때문입니다. 기본값으로 요청은 상위 공급자들 사이에 부하 분산되어 가동률을 최대화합니다. 이 기본값 위에서 라우팅은 요청 본문의 provider 객체로 폭넓게 설정할 수 있습니다. 공급자 순서, 폴백 허용 여부, 전체 파라미터 지원 요구, 데이터 수집 정책, 무보관 제한, 허용 및 무시 목록, 양자화 수준 필터, 가격 상한 등이 필드로 제공됩니다.
엔지니어링 팀에는 정렬과 임계값 제어가 가장 중요합니다. 공급자를 가격이나 처리량, 지연 시간으로 정렬할 수 있고, 선호하는 최소 처리량이나 최대 지연 시간을 백분위 기준으로 설정할 수 있으며, 요청당 최대 가격도 지정할 수 있습니다. 이로써 저렴하되 너무 느리지는 않게라는 모호한 선호가 명시적이고 강제 가능한 요청 파라미터로 바뀝니다.
도입 여부를 가르는 논거는 대개 신뢰성입니다. 문서에 적힌 동작은 분명합니다. 어떤 공급자가 오류를 반환하면 플랫폼이 자동으로 다음 공급자로 폴백합니다. 이 과정은 애플리케이션에 투명하므로, 여러분의 코드가 자체 재시도와 경로 변경 로직을 갖출 필요가 없습니다. 공급자 한 곳의 장애가 곧 사용자에게 보이는 실패로 이어지는 프로덕션 시스템이라면, 이 기능이 의존성을 정당화합니다.
플랫폼은 어떤 언어에서든 완전한 제어권을 주는 원시 API, 타입 안전한 클라이언트 SDK, 그리고 도구 호출과 루프, 상태 관리를 다루는 Agent SDK를 제공합니다. 계층 구분은 합리적입니다. curl로 엔드포인트를 두드리는 스크립트는 아무것도 설치할 필요가 없고, 타입이 있는 애플리케이션은 SDK에서 이득을 얻으며, 도구 호출과 상태 관리를 갖춘 에이전트 시스템은 손수 오케스트레이션을 짜는 대신 목적에 맞게 만들어진 계층을 받습니다.
기능 범위는 모델 선택을 훨씬 넘어섭니다. 문서는 응답 캐싱, 프롬프트 캐싱, 도구 호출, 구조화 출력, 메시지 변환, 스트리밍, 배치 처리, 커스텀 분류기, 가드레일, 서비스 티어, 프리셋, 제로 컴플리션 보험을 다룹니다. 팀 측면에서는 예산이 붙은 워크스페이스, 싱글 사인온, SCIM 그룹 매핑, 분석 기능이 있습니다. 이것이 취미 수준의 프록시와 조직이 표준으로 삼을 수 있는 기반의 차이입니다.
주된 활용은 단순합니다. LLM을 호출하는 제품을 만들되 한 공급자에 되돌릴 수 없이 묶이고 싶지 않은 경우입니다. OpenRouter를 통해 연동하면 모델 교체가 리팩터링이 아니라 문자열 변경이 됩니다. 더 낫거나 더 저렴한 모델이 나오면 먼저 연동 프로젝트를 세우지 않고도 평가할 수 있습니다.
작업마다 어울리는 모델이 다르고, 단순 분류에 최전선 모델 가격을 치르는 것은 낭비입니다. 가격이 그대로 전달되고 공급자를 가격순으로 정렬할 수 있으며 요청마다 가격 상한을 걸 수 있으므로, 팀은 저렴한 작업을 저렴한 모델로 보내고 비싼 모델은 정말 필요한 일에 남겨 둘 수 있습니다. 그 모든 것이 하나의 청구 관계 안에서 이뤄집니다.
모델 호출이 사용자 임계 경로에 놓인 애플리케이션이라면, 공급자 간 자동 폴백은 강한 의존성을 느슨한 의존성으로 바꿉니다. 처리량과 지연 시간 선호까지 결합하면, 라우팅 계층을 직접 만들지 않고도 의미 있는 서비스 수준 목표를 지탱할 수 있습니다.
특정 작업을 위해 모델을 비교하는 팀은 하나의 인터페이스로 같은 프롬프트를 여러 모델에 돌릴 수 있습니다. 공개 랭킹과 앱 리더보드는 두 번째 신호를 더합니다. 비슷한 작업에서 다른 개발자들이 프로덕션에 실제로 무엇을 쓰는지입니다.
에이전트 워크로드는 단일 공급자 구성의 약점을 모두 증폭합니다. 호출을 많이 발생시키고, 도구 호출이 필요하며, 중간 실패가 전체 실행 궤적을 낭비합니다. Agent SDK와 자동 폴백은 바로 이런 형태의 작업을 겨냥합니다.
규제 대상 조직을 위해 플랫폼은 기업 고객에게 유럽연합과 미국의 역내 라우팅을 제공하고, 여기에 무보관 엔드포인트 제한과 공급자 수준 데이터 정책 제어를 더합니다. 이 조합 덕분에 컴플라이언스 요건을 벤더 협상이 아니라 요청 설정으로 표현할 수 있습니다.
사용량은 선불 크레딧으로 운영됩니다. 신규 계정에는 테스트용 소액 무료 한도가 주어지며, 프로덕션 사용 전에는 플랫폼에서 크레딧을 구매합니다.
대시보드에서 키를 생성합니다. 키 하나로 목록의 모든 모델에 닿을 수 있으므로, 키 관리는 고권한 자격 증명과 동일한 주의로 다뤄야 합니다. 약관 역시 계정 자격 증명의 비밀 유지 책임이 사용자에게 있다고 명시합니다.
보통 가장 짧은 단계입니다. API가 OpenAI 사양을 구현하므로 /api/v1/chat/completions 엔드포인트로 표준 HTTP 요청을 보내면 되며, 대부분의 경우 기존 OpenAI SDK 연동에서 기본 URL과 키만 바꾸면 충분합니다.
특정 모델을 지목할지, 오토 라우터에 맡길지 결정합니다. 모델 지정은 결정성을 주고, 오토 라우팅은 모델 지형 변화에 맞춰 적응하는 능력을 줍니다. 많은 팀이 둘을 함께 씁니다. 출력에 민감한 경로는 모델을 고정하고, 일반 작업은 오토 라우팅으로 보냅니다.
제약이 있다면 기본값을 받아들이지 말고 명시적으로 표현하십시오. 비용 통제를 위한 가격 상한, 사용자 노출 경로를 위한 지연 시간이나 처리량 임계값, 규정이 요구하는 경우 데이터 수집이나 무보관 제한을 지정합니다. 모두 요청 단위 파라미터이므로 코드 경로마다 다른 정책을 실을 수 있습니다.
여러분의 설정에서 폴백이 기대대로 동작하는지 확인하십시오. 특히 공급자 목록을 좁혔다면 더욱 그렇습니다. 공급자를 과도하게 제한하면 폴백할 수 있는 풀이 줄어들어, 애당초 이 플랫폼을 택한 이유인 신뢰성 이득이 조용히 약해집니다.
대시보드 분석으로 모델별, 애플리케이션별 소비를 추적하십시오. 목록 안에서도 토큰당 비용이 수십 배씩 차이 나므로 라우팅 변경 하나가 지출을 크게 움직일 수 있습니다. 모니터링은 나중에 덧붙일 일이 아니라 연동의 일부로 다루십시오.
요청마다 최대 가격을 설정하십시오. max_price 파라미터는 예기치 않게 비싼 모델이 선택되는 것을 막는 가장 단순한 안전장치입니다. 특히 자동 라우팅 경로에서 열린 비용을 한계가 있는 비용으로 바꿔 줍니다.
라우팅 전략을 코드 경로에 맞추십시오. 출력 일관성이 중요한 곳에서는 모델을 고정하십시오. 한 모델에 맞춰 다듬은 프롬프트는 다른 모델에서 다르게 동작할 수 있습니다. 작업이 일반적이고 변화하는 시장에 적응하는 편이 결정성보다 가치 있는 곳에서는 오토 라우팅을 쓰십시오.
공급자 목록을 과도하게 좁히지 마십시오. 선호 공급자 하나로 좁히면 애초에 벗어나려던 단일 장애점을 다시 만드는 셈입니다. 특정 규정이 금지하지 않는 한 폴백을 허용하십시오.
데이터 정책을 문서가 아니라 코드로 표현하십시오. 워크로드가 보관을 피해야 한다면 요청에 무보관 제한과 데이터 수집 정책을 설정하십시오. 설정된 제약은 강제할 수 있지만, 적어 둔 의도는 그렇지 않습니다.
무료 모델은 평가용이지 프로덕션용이 아닙니다. 문서는 무료 모델이 속도 제한이 낮고 대체로 프로덕션에 적합하지 않다고 분명히 밝힙니다. 테스트를 위한 편의일 뿐입니다.
오토 라우팅 설정 시 플러그인 아이디를 확인하십시오. 다른 슬러그의 플러그인 아이디로 보낸 설정은 수용되지만 조용히 무시됩니다. 오류가 나지 않은 채 모델 제한과 비용 티어가 아무 일도 하지 않는 실패 방식입니다.
노출이 필요하면 앱 귀속을 설정하십시오. 선택적인 귀속 헤더는 여러분의 애플리케이션을 공개 리더보드에 올려 주므로, 공개용 제품을 만든다면 발견 가능성에 도움이 됩니다.
확장 전에 예산을 세우십시오. 워크스페이스 예산과 분석 기능이 있는 이유는 토큰 지출이 사용량에 비선형으로 늘기 때문입니다. 청구서를 받은 뒤가 아니라 트래픽이 몰리기 전에 한도를 설정하십시오.
LLM을 연동하는 애플리케이션 개발자가 핵심 대상입니다. 그렇지 않으면 여러 모델 API를 상대로 연동을 직접 작성하고 유지해야 하는 사람들입니다.
추론 비용을 최적화하는 팀은 가격 통과와 라우팅 제어의 조합에서 이득을 얻습니다. 둘이 겹치면 비용 대 품질 결정을 전역 타협이 아니라 요청 단위로 내릴 수 있습니다.
프로덕션 신뢰성을 책임지는 엔지니어는 공급자 간 자동 폴백을 얻습니다. 직접 잘 만들기에는 까다롭고 번거로운 기능입니다.
에이전트를 만드는 사람은 Agent SDK와 다단계 워크로드에 필요한 복원력의 혜택을 받습니다.
거버넌스 요건이 있는 기업은 워크스페이스, 싱글 사인온, SCIM, 역내 라우팅, 데이터 정책 제어로 대응됩니다.
AI 연구자와 평가자는 각 공급사에 개별 계정을 만들지 않고도 하나의 인터페이스에서 여러 모델을 비교할 수 있습니다.
적합하지 않은 경우: 채팅 비서를 찾는 최종 사용자입니다. 사이트에 채팅 화면이 있긴 하지만 이것은 개발자 인프라이며, 사용하려면 코드를 쓰거나 애플리케이션을 설정해야 합니다. 완성된 소비자 제품을 원한다면 소비자 제품을 쓰는 편이 맞습니다. 기업 계약으로 한 공급자에 표준화한 팀 역시 이 라우팅 계층의 추가 가치가 크지 않다고 느낄 수 있습니다.
OpenRouter는 웹 API로 제공되므로 실질적인 플랫폼 질문은 운영체제가 아니라 연동 표면입니다. API는 채팅 컴플리션 엔드포인트에서 OpenAI 사양을 구현하므로 HTTP 클라이언트가 있는 어떤 언어에서도 사용할 수 있고, 기존 OpenAI SDK 코드는 대체로 기본 URL만 바꾸면 동작합니다.
공식적으로 유지되는 연동 경로에는 원시 API, 타입이 있는 클라이언트 SDK, Agent SDK가 있습니다. 그 밖에 문서는 주요 개발 프레임워크마다 전용 가이드를 제공합니다. 오케스트레이션 쪽에는 LangChain과 Mastra가 있고, 프런트엔드와 애플리케이션 쪽에는 Vercel AI SDK와 TanStack AI가 있으며, 타입 기반 백엔드에는 PydanticAI, 관측성에는 Langfuse, 실시간 음성에는 LiveKit이 있습니다. 여기에 OpenAI SDK와 Anthropic Agent SDK를 위한 이전 안내, 그리고 Replit과 Xcode, Zapier 같은 개발 및 자동화 환경의 연결 방법이 더해집니다. 이는 유용한 신호입니다. 커뮤니티의 주장이 아니라 문서로 확인되는 일차 연동이기 때문입니다.
홈페이지에 공개된 규모 수치는 월 200조 이상 토큰, 1천만 이상 전 세계 사용자, 80곳 이상 공급자, 500개 이상 모델입니다. 공급사 자체 보고이자 특정 시점의 스냅숏으로 다루십시오. 다른 시기의 투자사 글은 상당히 다른 수치를 제시하는데, 이는 이 숫자들이 빠르게 변한다는 뜻이며 본 문서를 포함한 어떤 글에서도 인용하기보다 직접 확인해야 함을 알려 줍니다.
팀과 기업 기능에는 예산이 붙은 워크스페이스, 싱글 사인온, SCIM 그룹 매핑, 그리고 기업 고객을 위한 유럽연합과 미국 역내 라우팅이 포함됩니다.
가격 모델은 OpenRouter에서 가장 자주 오해받는 부분이며, 정확히 서술할 만큼 독특합니다.
추론에는 마진이 붙지 않습니다. 문서는 분명히 밝힙니다. 기반 모델 공급자의 가격을 마진 없이 그대로 전달하므로, 공급자와 직접 거래할 때와 같은 요율을 지불합니다. 따라서 토큰당 비용은 공급자가 매기는 그대로입니다. 수백 개 모델의 요율 차이가 매우 크고 공급자 자체 가격 조정에 따라 변하므로, 본 문서는 구체적인 토큰당 수치를 인용하지 않습니다. 현재 요율은 모델 페이지에서 확인하십시오.
수익은 크레딧 구매에서 나옵니다. 요금은 추론을 호출할 때가 아니라 크레딧을 구매할 때 부과됩니다. 회사는 이를 소액 수수료로 설명하며, 공급자 가격에는 결코 마진을 붙이지 않는다고 거듭 밝힙니다. 정확한 비율은 사이트에서 동적으로 표시되어 페이지 텍스트로 추출되지 않으므로, 결제 시점에 실제 수치를 확인하십시오.
크레딧은 선불이며 한도가 정해져 있습니다. 구매는 거래당 최소 5달러에서 최대 25,000달러입니다. Stripe 결제는 미국 달러로 정산되고 Coinbase 결제는 암호화폐 지갑을 거치며, 잔액이 지정한 임계값 아래로 떨어지면 자동 충전되도록 설정할 수 있습니다.
자체 키 사용에는 별도의 경제 논리가 있습니다. 공급자와 직접 계약을 맺고 있다면 BYOK로 그 계약을 플랫폼 안에서 쓸 수 있습니다. 여기에는 요금제별 무료 한도가 붙는데, 이 한도는 요청 횟수가 아니라 정가 기준 추론 비용으로 측정됩니다. 비싼 호출이 저렴한 호출 다수보다 한도를 빨리 소진한다는 뜻이라 중요한 구분입니다. 한도를 넘긴 사용분에는 비율 수수료가 붙어 크레딧에서 차감됩니다.
무료 접근은 있지만 의도적으로 제한됩니다. 신규 계정은 소액 무료 한도를 받고, 목록에는 무료 모델도 있습니다. 이들은 일일 요청 상한이 낮고 문서 역시 대체로 프로덕션에 적합하지 않다고 밝힙니다. 주목할 점은 무료 모델의 속도 제한이 구매한 크레딧에 따라 올라가므로, 유료 계정이 더 높은 무료 한도를 받는다는 것입니다.
환불 창구는 좁습니다. 사용하지 않은 크레딧은 거래 후 24시간 이내에 환불을 요청할 수 있고, 그 창구를 넘기면 사용하지 않은 크레딧도 환불되지 않습니다. 암호화폐 결제는 아예 환불되지 않습니다. 소진할 것으로 예상되는 단위로 나눠 구매하십시오.
구독은 없습니다. 구독이 없다는 홈페이지의 약속은 표준 제품에 대해 사실입니다. 반복 플랫폼 요금이 아니라 사용한 만큼 지불하며, 기업 계약은 별도로 처리됩니다.
비교 대상은 이 계층에서 어느 부분을 대체하려는지에 따라 달라집니다.
정직한 요약은 이렇습니다. OpenRouter는 목록의 폭, 라우팅의 정교함, 마진 없는 가격 구조로 경쟁합니다. 한 공급자의 한 모델만 계속 쓸 것이라면 직접 연결이 간단합니다. 모델 선택이 계속되는 결정이라면 이 계층은 제 자리를 값합니다.
임계 경로에 의존성을 하나 더합니다. 모든 추론 호출이 제삼자를 거칩니다. 개별 공급자 장애에 대한 복원력을 얻는 대신 플랫폼 자체가 잠재적 장애점이 됩니다. 모델 호출이 하중을 지는 애플리케이션이라면 이 교환은 의도적인 아키텍처 결정이어야 합니다.
지연 구간이 하나 늘어나는 것은 피할 수 없습니다. 공급자에 직접 호출할 때에 비해 중간 계층을 거치면 네트워크 오버헤드가 생깁니다. 회사가 이를 줄이려 노력하고 지연 선호 제어도 있지만, 이 구간은 실재하며 촘촘한 대화형 루프에서는 영향이 있습니다.
크레딧은 선불이고 환불 창구가 짧습니다. 사용하지 않은 크레딧은 24시간 뒤 환불되지 않고, 암호화폐 결제는 아예 환불되지 않으며, 약관은 크레딧이 법정 통화가 아니라고 명시합니다. 계정을 삭제하면 남은 크레딧은 사라집니다.
조용한 설정 실패가 가능합니다. 오토 라우팅 플러그인 아이디 불일치가 가장 뚜렷한 예입니다. 잘못된 설정이 수용되지만 조용히 무시되므로, 모델 제한과 비용 티어가 오류 없이 적용되지 않을 수 있습니다. 적용되었다고 가정하지 말고 효과를 검증하십시오.
무료 모델은 프로덕션 등급이 아닙니다. 낮은 속도 제한과 프로덕션에 적합하지 않다는 명시적 안내는 무료 목록이 평가 전용임을 뜻합니다.
데이터 처리는 설정 가능하며, 곧 여러분의 책임이라는 뜻입니다. 데이터 수집 정책의 기본값은 데이터를 저장할 수 있는 공급자를 허용하는 쪽입니다. 무보관 라우팅과 정책 제한이 제공되지만 직접 설정해야 합니다. 기본적으로 엄격하게 처리되리라 가정하는 팀은 자기 상태를 잘못 알고 있을 수 있습니다.
사용 규칙은 강제 가능한 계약 조항입니다. 약관은 불법 사용, 신원 허위 진술, 스크래핑, 보안 기능 우회, 승인되지 않은 모델 레드팀 테스트를 금지합니다. 적대적 테스트를 계획하는 연구 팀은 착수 전에 이 조항을 읽어야 합니다.
공급사 자체 보고 지표는 출처마다 다릅니다. 모델 수, 공급자 수, 토큰 사용량이 홈페이지와 시기가 다른 외부 글 사이에서 일치하지 않습니다. 어떤 구체적 수치든 시의성이 있는 값으로 다루십시오.
모델 동작은 균일하지 않습니다. 한 모델에 맞춘 프롬프트가 다른 모델에서는 다르게 작동할 수 있으므로 자동 라우팅이 출력 특성을 바꿀 수 있습니다. 일관성이 중요한 곳에서는 모델을 고정하십시오.
개발자 인프라입니다. 제품의 본체는 애플리케이션이 호출하는 API이며, 그 주위의 라우팅과 과금, 관측 기능이 함께합니다. 모델을 시험하고 프롬프트를 다듬기 위한 채팅 화면이 사이트에 있어 일부 디렉터리가 잘못 분류하지만, OpenRouter를 제대로 쓰려면 코드를 작성하거나 애플리케이션을 설정해야 합니다.
아닙니다. 문서는 공급자 가격을 마진 없이 그대로 전달하며 공급자와 직접 거래할 때와 같은 요율을 지불한다고 밝힙니다. 회사의 수익은 추론이 아니라 크레딧을 구매할 때 부과되는 수수료에서 나옵니다.
경량 분류기가 프롬프트를 약 서른 가지 세분화된 작업 유형 가운데 하나로 배정한 뒤, 라우터가 해당 작업 유형에서 OpenRouter 커뮤니티가 지난 7일간 실제로 지출한 규모로 모델의 순위를 매깁니다. 시장 지수처럼 작동하여, 그런 종류의 작업에서 실제 채택을 얻은 모델 쪽으로 이동합니다.
대개 그렇지 않습니다. API가 채팅 컴플리션 엔드포인트에서 OpenAI 사양을 구현하므로, 기존 OpenAI SDK 연동은 보통 기본 URL과 API 키만 바꾸면 동작합니다. 원시 HTTP 이상을 원한다면 타입이 있는 클라이언트 SDK와 Agent SDK도 있습니다.
플랫폼이 자동으로 다음 공급자로 폴백하며, 그 과정은 애플리케이션에 투명합니다. 이것이 신뢰성 논거의 핵심입니다. 공급자 한 곳의 장애를 견디기 위해 여러분의 코드가 자체 재시도와 경로 변경 로직을 갖출 필요가 없습니다.
신규 계정은 소액 무료 한도를 받고 목록에도 무료 모델이 있습니다. 이 무료 모델들은 일일 요청 제한이 낮으며 문서는 대체로 프로덕션에 적합하지 않다고 밝힙니다. 크레딧을 구매하면 무료 모델 한도가 올라가므로, 무료 등급은 평가 경로로 보는 편이 좋습니다.
가능하며, 이는 계정 전체 설정이 아니라 요청 단위 설정입니다. 데이터를 저장할 수 있는 공급자를 거부하도록 데이터 수집 정책을 지정하고, 무보관 엔드포인트로만 라우팅을 제한하며, 특정 공급자에 허용 또는 무시 목록을 적용할 수 있습니다. 기업 고객은 유럽연합이나 미국 역내 라우팅을 추가로 요구할 수 있습니다.
가능합니다. BYOK를 통해서입니다. 요금제별 무료 한도가 있으며 이 한도는 요청 횟수가 아니라 정가 기준 추론 비용으로 측정되고, 초과분에는 비율 수수료가 붙어 크레딧에서 차감됩니다. 이미 협상된 공급자 계약을 보유하면서도 통합 라우팅을 원하는 팀에 적합합니다.
거래 후 24시간 이내에만 가능하며, 크레딧 페이지의 환불 버튼으로 신청합니다. 그 창구가 지나면 사용하지 않은 크레딧은 환불되지 않고, 암호화폐 결제는 아예 환불되지 않습니다. 계정을 삭제해도 남은 크레딧은 사라집니다.
세 가지 고려가 큽니다. 추론 임계 경로에 제삼자를 추가하게 됩니다. 네트워크 구간이 하나 늘고 그만큼 지연 비용을 받아들이게 됩니다. 그리고 환불 창구가 좁은 선불 크레딧 모델에 들어가게 됩니다. 기업 계약으로 한 공급자에 표준화했거나 절대적인 최저 지연이 필요하다면, 그 공급자에 직접 호출하는 편이 나을 수 있습니다.