OpenRouter 是一层位于你的应用与各家 AI 模型供应商之间的基础设施。它对自己的定位很凝练:面向所有模型的统一接口,并承诺更好的价格、更好的可用性,且无需订阅。落到实处就是:你只集成一次、只对接一个端点,就能获得一个原本需要几十个独立厂商账户、SDK、结算关系与故障处理分支才能覆盖的模型目录。
官方文档把价值主张写得不加修饰:通过单一 API 端点访问数百个 AI 模型,并自动处理回退,同时为每个请求挑选性价比更优的选项。这两句话就是产品的全部:聚合,加上「该用哪个模型、走哪个供应商」的判断力。
有必要把读者身份直说,因为 OpenRouter 经常被归错类。站点确实带有一个浏览器聊天界面,这导致一些导航站把它与面向消费者的 AI 对话产品并列。这是误读。那个聊天页存在的目的,是让开发者试模型、调提示词;产品主体是一层带计费、路由与可观测性的 API。如果你不写代码、也不配置应用去调 API,这不是一款你会直接使用的工具。而如果你会,它解决的是一个很快就会变得棘手的问题:每家模型供应商都有自己的 SDK、自己的鉴权、自己的速率限制和自己的宕机。
服务由 OpenRouter, Inc. 运营,注册地址在纽约麦迪逊大道 169 号,条款适用纽约州法律。创始人 Alex Atallah 此前创办过 OpenSea,投资方文章把这套主张概括为「一个 API、一套集中账单」。后半句抓住了价值的另一半:把分散在多家供应商的支出合并到一个账户,而不是去对一堆发票。
设想直接对接五家模型供应商意味着什么:五套 API 密钥要轮换、五个 SDK 要跟版本、五个定价页要盯、五个状态页要看,再加上一家降级时自行编写的故障切换逻辑。把这些乘以新模型出现的速度,集成维护就成了一项常驻的工程成本。OpenRouter 把这项反复发生的成本,换成了一个依赖项。这笔交换划不划算,才是真正的评估问题,后文的限制章节会正面回答。
最具辨识度的功能是自动选模型,而它的机制特别到值得讲清楚。路由器首先会把每条提示词归入约 30 种细分任务类型之一——比如代码调试、多步智能体规划、知识问答、数学或客服。分类在请求过程中在线完成,按文档说明不需要留存提示词。
第二步才是它与常规路由分道扬镳的地方。它不依赖一份固定的质量排行,而是去看社区在该任务类型上真金白银花在了哪些模型上,统计窗口为过去七天。官方把这比作一个市场指数:当用量转向某个在调试任务上表现更好的新模型时,路由会自动跟着支出走。运行这套系统的有两个标识:稳定通道 openrouter/auto 与早期通道 openrouter/auto-beta。
选定模型只解决了一半问题,因为同一个模型往往由多家供应商承载,而它们在价格、速度与可靠性上并不相同。默认情况下,请求会在头部供应商之间做负载均衡以最大化可用性。在这个默认之上,路由可通过请求体中的 provider 对象做大量配置,字段涵盖供应商顺序、是否允许回退、是否要求支持全部参数、数据收集策略、零留存限制、允许与忽略名单、量化等级过滤与价格上限。
对工程团队而言,排序与阈值控制最为关键。你可以按价格、吞吐量或延迟对供应商排序,还能设定偏好的最低吞吐或最高延迟(支持按分位数设阈值),以及本次请求可接受的最高价格。这把「便宜但别太慢」这种含糊偏好,变成了一个明确且可强制执行的请求参数。
可靠性往往是决定是否采用的那个论据。文档描述得毫不含糊:若某个供应商返回错误,平台会自动回退到下一个供应商。这个过程对应用透明,意味着你不必自行编写重试与改道逻辑。对于「单家供应商宕机就会造成用户可见故障」的生产系统来说,这正是让这个依赖项站得住脚的功能。
平台提供的是:可在任意语言中获得完全控制权的原始 API、类型安全的客户端 SDK,以及面向工具调用、循环与状态管理的 Agent SDK。这个分层是合理的:用 curl 打端点的脚本什么都不用装;带类型的应用能从 SDK 获益;而具备工具调用与状态管理的智能体系统,拿到的是一层专门构建的能力,而不必手工拼装编排逻辑。
功能面远不止选模型。文档涵盖响应缓存、提示词缓存、工具调用、结构化输出、消息变换、流式返回、批处理、自定义分类器、护栏、服务档位、预设与零补全保险。团队侧则有带预算的工作区、单点登录、SCIM 组映射与分析面板。这正是「业余代理层」与「组织可以标准化依赖之物」之间的差别。
最主要的用法很直接:你在做一个要调用大模型的产品,但不想不可逆地押注一家供应商。通过 OpenRouter 集成,意味着换模型是改一个字符串,而不是一次重构。当更好或更便宜的模型上线时,你可以先评估,而不必先立一个集成项目。
不同任务配得上不同模型,为简单的分类任务支付前沿模型的价格是纯粹的浪费。由于价格原样透传,且供应商可按价格排序、每次请求还能设价格上限,团队可以把廉价任务路由到廉价模型,把昂贵模型留给真正需要它的工作——而这一切都在同一个结算关系里完成。
对于模型调用处在用户关键路径上的应用,跨供应商的自动回退把一个硬依赖变成了软依赖。再配合吞吐与延迟偏好,就能在不自建路由层的情况下支撑有意义的服务水平目标。
需要为特定任务比较模型的团队,可以通过一个接口把同一批提示词跑在多个模型上。公开排行榜与应用榜单还提供了第二重信号:其他开发者在可比工作上实际用的是什么。
智能体类负载会放大单一供应商方案的每一个弱点——它们发起大量调用、需要工具调用,而且中途失败会浪费整条执行轨迹。Agent SDK 加自动回退,针对的正是这种形态的工作。
对受监管的组织,平台为企业客户提供欧盟与美国的区域内路由,再加上零留存端点限制与供应商级数据策略控制。这组能力让合规要求可以表达为请求配置,而不必依赖与厂商逐条谈判。
用量基于预付积分运行。新账户会获得少量免费额度用于测试,进入生产使用前需要先在平台购买积分。
在控制台创建密钥。由于单个密钥就能触达目录里的每一个模型,密钥管理值得按高权限凭据的标准对待——条款也载明,你需自行负责账户凭据的保密。
这通常是最短的一步。API 实现了 OpenAI 规范,你只需向 /api/v1/chat/completions 端点发送标准 HTTP 请求;多数情况下,在既有的 OpenAI SDK 集成里改一个 base URL 和一个密钥就够了。
决定是点名指定某个模型,还是交给自动路由器。指定模型带来确定性;自动路由则带来随模型格局变化而自我调整的能力。很多团队两者并用——对输出敏感的路径固定模型,通用工作走自动路由。
如果你有约束条件,请显式表达出来,而不是接受默认值。为成本控制设价格上限,为用户可见路径设延迟或吞吐阈值,在合规要求下设数据收集或零留存限制。这些都是逐请求参数,因此不同代码路径可以携带不同策略。
请验证在你的配置下回退行为是否符合预期,尤其是当你收窄了供应商名单时。过度限制供应商会缩小可供回退的池子,这会悄悄削弱你当初采用该平台所看重的可靠性收益。
用控制台的分析面板按模型与应用追踪消耗。由于目录内各模型的单 token 成本相差数个数量级,一次路由变更就可能显著改变支出,因此请把监控当作集成的一部分,而不是事后补的动作。
为每次请求设置最高价格。 max_price 参数是防止意外选中昂贵模型的最简单护栏。尤其在自动路由的路径上,它把一笔开放式成本变成了有界成本。
让路由策略匹配代码路径。 在输出一致性重要的地方固定模型——针对某个模型调好的提示词,换到另一个模型上表现可能不同。在任务通用、且「跟上变动的市场」比确定性更值钱的地方,用自动路由。
不要过度收窄供应商名单。 把范围缩到单一偏好供应商,等于重新制造了你本想摆脱的单点故障。除非有明确的合规规则禁止,否则请允许回退。
把数据策略写进代码,而不是写进文档。 如果你的负载必须避免留存,就在请求上设置零留存限制与数据收集策略。配置好的约束是可强制执行的,写下来的意愿不是。
免费模型用于评估,不要用于生产。 文档明确说明免费模型速率限制低,且通常不适合生产使用。它们是测试时的便利,仅此而已。
配置自动路由时请核对插件 ID。 发到另一个标识的插件 ID 下的设置会被接受但静默忽略——这种失败模式不报任何错,而你的模型限制与成本档位却悄悄失效了。
如果需要曝光,就给应用加归属标识。 可选的归属请求头会把你的应用放上公开排行榜,如果你在做面向公众的产品,这对被发现有帮助。
先做预算,再谈扩量。 工作区预算与分析面板之所以存在,是因为 token 支出会随用量非线性增长。请在流量高峰之前配置好上限,而不是在收到账单之后。
集成大模型的应用开发者是核心受众——也就是那些否则就要针对多个模型 API 编写并维护集成的人。
在做推理成本优化的团队受益于「价格透传 + 路由控制」的组合,两者叠加让成本与质量的取舍可以逐请求决策,而不是全局做一次妥协。
负责生产可靠性的工程师得到的是跨供应商的自动回退,这件事自建起来既难做好又琐碎。
智能体构建者由 Agent SDK 以及多步负载所需的韧性来服务。
有治理要求的企业通过工作区、单点登录、SCIM、区域路由与数据策略控制得到覆盖。
AI 研究者与评测者可以在一个接口内比较众多模型,而不必为每家单独开户。
不适合的人: 想找一个聊天助手的终端用户。尽管站点上确有聊天界面,但这是开发者基础设施,使用它意味着写代码或配置应用。想要开箱即用消费级产品的人,应该去用消费级产品。已经与某家供应商签订企业合约、并完全押注其上的团队,可能也会觉得这层路由带来的增量有限。
OpenRouter 以 Web API 形式交付,因此真正的平台问题不是操作系统,而是集成面。API 在对话补全端点上实现了 OpenAI 规范,这意味着任何具备 HTTP 客户端的语言都能使用它,而既有的 OpenAI SDK 代码通常改一个 base URL 就能跑通。
官方维护的集成路径包括原始 API、类型化客户端 SDK 与 Agent SDK。除此之外,文档还为主流开发框架逐一提供了专门指南:编排框架有 LangChain 与 Mastra,前端与应用侧有 Vercel AI SDK 及 TanStack AI,类型化后端有 PydanticAI,可观测性有 Langfuse,实时语音场景有 LiveKit,另有面向 OpenAI SDK 与 Anthropic Agent SDK 的迁移说明,以及 Replit、Xcode 与 Zapier 等开发与自动化环境的接入方式。这是个有用的信号:它们是第一方记录在案的集成,而非社区宣称。
官网首页公布的规模数字为每月 2000 亿以上 token、1000 万以上全球用户、80 家以上供应商与 500 个以上模型。请把它们当作厂商自报且是某一时点的快照——来自另一时期的投资方文章给出的计数与之明显不同,这恰恰说明这些数字变动很快,应该实时去查,而不是从任何文章里照抄,包括本文。
团队与企业能力包括带预算的工作区、单点登录、SCIM 组映射,以及面向企业客户的欧盟与美国区域内路由。
定价模式是 OpenRouter 最常被误解的部分,而它特殊到值得精确表述。
推理不加价。 文档写得很明确:原样透传底层模型供应商的定价、不做任何加价,你支付的费率与直连供应商相同。因此单 token 成本就是供应商收多少。由于目录里数百个模型的费率差异极大、且会随供应商自身调价而变动,本文不引用任何具体的单 token 数字——请到模型页查当前费率。
收入来自积分购买。 费用在你购买积分时收取,而不是在你发起推理调用时收取。官方将其描述为一笔小额费用,并重申绝不对供应商价格加价。具体百分比在站点上以动态方式呈现,而非可抓取的页面文本,因此请在付款环节核对当时的实际数值。
积分为预付制,并设有额度边界。 单笔购买从最低 5 美元到最高 25,000 美元。Stripe 支付以美元结算,Coinbase 支付走加密钱包,另可设置余额低于你指定阈值时自动充值。
自带密钥有其自身的经济账。 如果你已与供应商签有直接合约,BYOK 允许你在平台内使用它们。它带有一份按订阅计划分配的免费额度,且该额度以按目录价计算的推理成本衡量,而非按请求次数——这个区别很重要,因为昂贵调用会比大量廉价调用更快耗尽额度。超出部分按比例收费,并从积分中扣除。
存在免费入口,但被刻意限制。 新账户获得少量免费额度,目录中亦包含免费模型。它们每日请求上限很低,且文档说明通常不适合生产使用。值得注意的是,免费模型的速率上限会随已购积分提高,因此付费账户能拿到更高的免费档配额。
退款窗口很窄。 未使用积分可在交易后 24 小时内申请退款;超过该窗口,任何未使用积分都变为不可退。加密货币支付则完全不可退。请按你预期会用完的额度分批购买。
没有订阅制。 首页关于「无需订阅」的说法对标准产品是成立的——你为用量付费,而不是缴一笔周期性平台费,企业方案则另行安排。
参照系取决于你要替换的是这层价值中的哪一部分。
诚实的结论是:OpenRouter 竞争的是目录广度、路由精细度与不加价的定价结构。如果你会永远只用一家供应商的一个模型,直连更省事;如果模型选择是一件持续要做的决策,这一层就配得上它的位置。
你在关键路径上新增了一个依赖。 每一次推理调用都会经过一个第三方。这买来的是对单家供应商宕机的韧性,但也把平台自身引入为潜在故障点。对于模型调用承重的应用,这笔交换应当是一项经过深思的架构决策。
多一跳延迟无法避免。 相比直连供应商,经中间层路由会增加网络开销。官方在努力压低它,也提供了延迟偏好控制,但这一跳是真实存在的,对紧凑的交互循环有影响。
积分为预付且退款窗口很短。 未使用积分在 24 小时后变为不可退,加密支付永远不可退,条款还载明积分不是法定货币。删除账户会导致未使用积分作废。
存在静默的配置失效。 自动路由的插件 ID 错配就是最典型的例子:错误的设置会被接受但静默忽略,于是模型限制与成本档位可能根本没生效,却不会报错。请验证配置是否真的起了作用,而不是假定它已生效。
免费模型不是一个生产档位。 低速率上限,加上文档明说不适合生产,意味着免费目录只适用于评估。
数据处理是可配置的,也就意味着责任在你。 数据收集策略的默认值是允许可能留存数据的供应商。零留存路由与策略限制都可用,但必须由你去设置。一个默认假定「严格处理」的团队,很可能对自己的实际状态判断有误。
使用规则是可强制执行的合同条款。 条款禁止非法使用、身份虚假陈述、爬取、绕过安全机制以及未经授权对模型进行红队测试。计划做对抗性测试的研究团队,应在动手前先读这一条。
厂商自报指标因来源而异。 模型数、供应商数与 token 用量在官网与不同时期的第三方文章之间并不一致。请把任何具体数字都当作有时效性的。
模型行为并不统一。 为某个模型调好的提示词换到另一个模型上表现可能不同,因此自动路由可能改变输出特征。在一致性重要的地方,请固定模型。
它是开发者基础设施。产品主体是一个供你的应用调用的 API,外加围绕它的路由、计费与可观测能力。站点上确有一个用于试模型和调提示词的聊天界面,这也是部分导航站把它归错类的原因,但要真正用起 OpenRouter,仍需要写代码或配置应用。
不会。文档写明供应商定价原样透传、不做加价,你支付的费率与直连供应商相同。公司的收入来自你购买积分时收取的费用,而不是来自推理本身。
一个轻量分类器会把你的提示词归入约三十种细分任务类型之一,随后路由器按 OpenRouter 社区在该任务类型上过去七天的真实支出对模型排序。它的行为像一个市场指数,会向那些在这类工作上获得实际采用的模型倾斜。
通常不需要。API 在对话补全端点上实现了 OpenAI 规范,因此既有的 OpenAI SDK 集成一般改一个 base URL 和密钥即可运行。如果你想要的不止是裸 HTTP,还有类型化客户端 SDK 与 Agent SDK 可用。
平台会自动回退到下一个供应商,且对你的应用透明。这正是它可靠性论据的核心:你的代码不需要自带重试与改道逻辑,就能扛住单家供应商的宕机。
新账户会获得少量免费额度,目录中也包含免费模型。这些免费模型每日请求上限很低,文档也说明它们通常不适合生产。购买积分后免费模型的上限会提高,因此免费档最好当作评估通道来看待。
可以,而且这是逐请求配置而非账户级设置。你可以把数据收集策略设为拒绝可能留存数据的供应商、把路由限制为仅使用零留存端点,并对特定供应商使用允许或忽略名单。企业客户还可额外要求在欧盟或美国区域内路由。
可以,通过 BYOK。它带有按订阅计划分配的免费额度,该额度按目录价推理成本而非请求次数衡量,超出部分按比例收费并从积分中扣除。这适合已经握有议价合约、但仍希望获得统一路由能力的团队。
仅限交易后 24 小时内,通过积分页面的退款按钮申请。超过该窗口,未使用积分不可退,加密货币支付则完全不可退。此外,删除账户也会导致未使用积分作废。
主要是三点考量。你在推理关键路径上新增了一个第三方。你接受了额外一跳网络开销及其延迟代价。你还承诺进入一个退款窗口很窄的预付积分模式。如果你已在企业合约下标准化到单一供应商,或者你需要绝对最低的延迟,直连那家供应商可能更适合你。