
OpenRouter es infraestructura para desarrolladores que reúne más de 500 modelos de más de 80 proveedores tras una sola API compatible con OpenAI. Clasifica cada petición para elegir modelo, reparte carga entre proveedores, conmuta automáticamente ante fallos y traslada los precios sin recargo.
¿Has usado esta herramienta? Valórala
¿Has usado esta herramienta? Valórala
OpenRouter es infraestructura que se sitúa entre su aplicación y los proveedores de modelos de IA que desea utilizar. Su propio posicionamiento es compacto: una interfaz unificada para cada modelo, con la promesa de mejores precios, mejor disponibilidad y ninguna suscripción. En la práctica esto significa que integra una sola vez, contra un único punto de acceso, y obtiene un catálogo que de otro modo exigiría decenas de cuentas de proveedor separadas, kits de desarrollo, relaciones de facturación y rutas de manejo de fallos.
La documentación enuncia la propuesta de valor sin adornos: acceder a cientos de modelos de IA mediante un solo punto de acceso, con manejo automático de conmutaciones y elección de una opción económicamente razonable en cada petición. Esas dos frases contienen todo el producto: agregación, más la inteligencia sobre qué modelo y qué proveedor deben atender una llamada concreta.
Conviene ser directo sobre el público, porque OpenRouter se clasifica mal con frecuencia. El sitio aloja una interfaz de conversación en el navegador, y eso lleva a algunos directorios a colocarlo junto a productos de chat para consumidores. Es una lectura equivocada. Esa página existe para que quienes programan prueben modelos y depuren indicaciones; el producto es una capa de API con facturación, enrutamiento y observabilidad. Si no escribe código ni configura una aplicación para llamar a una API, esta no es una herramienta que usaría directamente. Si lo hace, aborda un problema que se vuelve doloroso enseguida: cada proveedor de modelos tiene su propio kit, su propia autenticación, sus propios límites de tasa y sus propias caídas.
El servicio lo opera OpenRouter, Inc., registrada en el 169 de Madison Avenue, Nueva York, y las condiciones se rigen por el derecho del estado de Nueva York. Fue fundada por Alex Atallah, antes cofundador de OpenSea, y un comentario de un inversor resume la propuesta como una API, una facturación centralizada. Esa fórmula captura la otra mitad del valor: consolidar el gasto repartido entre muchos proveedores en una sola cuenta en lugar de conciliar una docena de facturas.
Piense en lo que implica integrar directamente con cinco proveedores de modelos: cinco claves de API que rotar, cinco kits que mantener al día, cinco páginas de precios que vigilar, cinco páginas de estado que consultar y una lógica propia de conmutación cuando uno se degrada. Multiplique eso por el ritmo al que aparecen modelos nuevos y el mantenimiento de integraciones se convierte en un coste de ingeniería permanente. OpenRouter transforma ese coste recurrente en una única dependencia. Si el intercambio compensa es la verdadera pregunta de evaluación, y se aborda de frente en el apartado de limitaciones.
La función más distintiva es la selección automática de modelo, y su mecánica resulta lo bastante inusual como para describirla con precisión. El enrutador asigna primero a cada indicación uno de unos treinta tipos de tarea finamente divididos: categorías como depuración de código, planificación de agente en varios pasos, preguntas de conocimiento, matemáticas o atención al cliente. La clasificación ocurre sobre la marcha y, según la documentación, sin requerir conservación de las indicaciones.
El segundo paso es el que lo aparta del enrutamiento convencional. En lugar de apoyarse en una clasificación de calidad fija, el enrutador observa en qué gasta realmente la comunidad para ese tipo de tarea, medido en una ventana móvil de siete días. La empresa lo compara con un índice de mercado: cuando el uso se desplaza hacia un modelo recién lanzado que rinde mejor en, digamos, depuración, el enrutamiento sigue automáticamente al gasto. Dos identificadores gobiernan el sistema: la vía estable openrouter/auto y la vía de acceso anticipado openrouter/auto-beta.
Elegir modelo resuelve solo la mitad del problema, porque un mismo modelo suele servirse desde varios proveedores con precios, velocidades y fiabilidades distintas. Por defecto, las peticiones se reparten entre los mejores proveedores para maximizar la disponibilidad. Más allá de ese valor por defecto, el enrutamiento se configura ampliamente mediante un objeto provider en el cuerpo de la petición, con campos para el orden de proveedores, el permiso de conmutación, la exigencia de soporte de todos los parámetros, la política de recopilación de datos, la restricción sin conservación, listas de permitidos y excluidos, filtros por nivel de cuantización y topes de precio.
Para los equipos de ingeniería, la ordenación y los umbrales son lo que más pesa. Puede ordenar proveedores por precio, rendimiento o latencia, fijar un rendimiento mínimo o una latencia máxima preferidos con cortes por percentil, y establecer un precio máximo para la petición. Así una preferencia vaga como «barato pero no lento» se convierte en un parámetro de petición explícito y exigible.
La fiabilidad suele ser el argumento que decide la adopción. El comportamiento documentado es inequívoco: si un proveedor devuelve un error, la plataforma conmuta automáticamente al siguiente. Sucede de forma transparente, de modo que su aplicación no necesita lógica propia de reintento y redirección. Para sistemas en producción donde la caída de un solo proveedor causaría un fallo visible al usuario, esta es la función que justifica la dependencia.
La plataforma ofrece la API en bruto para control total en cualquier lenguaje, kits de cliente con tipado, y un kit para agentes con el que construir sistemas con llamada a herramientas, bucles y gestión de estado. La gradación tiene sentido: un script que golpea el punto de acceso con curl no necesita instalar nada; una aplicación tipada gana con el kit; y un sistema de agentes con llamada a herramientas y estado recibe una capa creada a propósito en lugar de una orquestación improvisada.
La superficie funcional excede con mucho la elección de modelo. La documentación cubre caché de respuestas, caché de indicaciones, llamada a herramientas, salidas estructuradas, transformaciones de mensajes, transmisión continua, procesamiento por lotes, clasificadores propios, barreras de seguridad, niveles de servicio, ajustes preestablecidos y un seguro frente a compleciones vacías. Del lado de equipo hay espacios de trabajo con presupuestos, inicio de sesión único, correspondencia de grupos SCIM y analíticas. Esa es la diferencia entre un proxy aficionado y algo sobre lo que una organización puede estandarizar.
El uso principal es sencillo: está construyendo un producto que llama a un modelo de lenguaje y no quiere comprometerse de forma irreversible con un proveedor. Integrar mediante OpenRouter significa que cambiar de modelo es modificar una cadena de texto y no una refactorización. Cuando aparece un modelo mejor o más barato, lo evalúa sin montar antes un proyecto de integración.
Tareas distintas merecen modelos distintos, y pagar precios de vanguardia por una clasificación simple es desperdicio. Como los precios se trasladan tal cual, los proveedores pueden ordenarse por precio y cada petición admite un tope, los equipos pueden dirigir tareas baratas a modelos baratos y reservar los caros para el trabajo que los exige, todo dentro de una misma relación de facturación.
Para aplicaciones donde las llamadas al modelo están en una ruta crítica visible al usuario, la conmutación automática entre proveedores convierte una dependencia dura en una blanda. Combinada con las preferencias de rendimiento y latencia, permite sostener objetivos de nivel de servicio significativos sin construir una capa de enrutamiento propia.
Los equipos que comparan modelos para una tarea concreta pueden ejecutar las mismas indicaciones sobre muchos modelos desde una única interfaz. Las clasificaciones públicas y las listas de aplicaciones aportan una segunda señal: qué usan realmente en producción otros desarrolladores para trabajo comparable.
Las cargas de agentes amplifican todas las debilidades de una configuración con un solo proveedor: generan muchas llamadas, necesitan invocar herramientas y un fallo a mitad de camino desperdicia toda la trayectoria. El kit para agentes junto a la conmutación automática apunta exactamente a esa forma de trabajo.
Para organizaciones reguladas, la plataforma admite enrutamiento dentro de la región en la Unión Europea y Estados Unidos para clientes empresariales, junto con la restricción a puntos de acceso sin conservación y controles de política de datos por proveedor. Esa combinación permite expresar requisitos de cumplimiento como configuración de la petición en vez de como negociación con el proveedor.
El uso se apoya en créditos prepagados. Las cuentas nuevas reciben una pequeña dotación gratuita para pruebas, y los créditos se compran en la plataforma antes del uso en producción.
Cree una clave desde el panel. Como una sola clave alcanza todos los modelos del catálogo, su gestión merece el mismo cuidado que cualquier credencial de privilegio alto: las condiciones le hacen único responsable de mantener confidenciales sus credenciales de cuenta.
Suele ser el paso más corto. La API implementa la especificación de OpenAI, así que envía peticiones HTTP estándar al punto de acceso de compleción de conversación; en la mayoría de los casos basta con cambiar una URL base y una clave en una integración existente.
Decida si nombra un modelo concreto o delega en el enrutador automático. Nombrar un modelo aporta determinismo; el enrutador automático aporta adaptación a un panorama de modelos cambiante. Muchos equipos hacen ambas cosas: modelos fijados en rutas sensibles a la salida y enrutamiento automático para el trabajo general.
Si tiene restricciones, expréselas explícitamente en lugar de aceptar los valores por defecto. Fije topes de precio para controlar costes, umbrales de latencia o rendimiento para rutas visibles al usuario, y restricciones de recopilación o de no conservación donde el cumplimiento lo exija. Son parámetros por petición, de modo que distintas rutas de código pueden llevar políticas distintas.
Verifique que el repliegue se comporta como espera con su configuración, sobre todo si ha estrechado la lista de proveedores. Restringir en exceso reduce el conjunto disponible al que conmutar, lo que debilita en silencio el beneficio de fiabilidad por el que adoptó la plataforma.
Use las analíticas del panel para seguir el consumo por modelo y por aplicación. Como los costes por token varían en órdenes de magnitud dentro del catálogo, un cambio de enrutamiento puede desplazar el gasto de forma notable: trate la vigilancia como parte de la integración y no como un añadido posterior.
Fije un precio máximo por petición. El parámetro max_price es la salvaguarda más simple frente a la selección inesperada de un modelo caro. En las rutas con enrutamiento automático sobre todo, convierte un coste abierto en uno acotado.
Ajuste la estrategia de enrutamiento a la ruta de código. Fije modelos donde importe la constancia de la salida: una indicación afinada para un modelo puede comportarse distinto en otro. Use enrutamiento automático donde la tarea sea genérica y adaptarse a un mercado en movimiento valga más que el determinismo.
No estreche en exceso su lista de proveedores. Reducirla a un único proveedor preferido reproduce el punto único de fallo del que intentaba escapar. Permita conmutaciones salvo que una regla concreta de cumplimiento lo prohíba.
Exprese la política de datos en código, no en un documento. Si su carga debe evitar la conservación, fije en la petición la restricción sin conservación y la política de recopilación. Una restricción configurada es exigible; una intención escrita no lo es.
Use los modelos gratuitos para evaluar, no para producción. La documentación es explícita: los modelos gratuitos tienen límites de tasa bajos y por lo general no resultan adecuados para producción. Son una comodidad de prueba.
Verifique el identificador de complemento al configurar el enrutamiento automático. Los ajustes enviados bajo el identificador de la otra vía se aceptan pero se ignoran en silencio: un modo de fallo que no produce error mientras sus restricciones de modelo y su nivel de coste dejan de hacer nada.
Atribuya su aplicación si busca visibilidad. Las cabeceras opcionales de atribución colocan su aplicación en las clasificaciones públicas, lo que ayuda al descubrimiento si construye algo dirigido al público.
Presupueste antes de escalar. Los presupuestos de espacio de trabajo y las analíticas existen porque el gasto en tokens crece de forma no lineal con el uso. Configure límites antes de un pico de tráfico y no después de una factura.
Los desarrolladores de aplicaciones que integran modelos de lenguaje son el público central: quienes de otro modo tendrían que escribir y mantener integraciones contra varias API de modelos.
Los equipos que optimizan el coste de inferencia se benefician del traslado de precios sumado a los controles de enrutamiento, que juntos permiten decidir coste frente a calidad por petición en lugar de un único compromiso global.
Los ingenieros responsables de la fiabilidad en producción obtienen conmutación automática entre proveedores, algo difícil y tedioso de construir bien internamente.
Quienes construyen agentes quedan servidos por el kit específico y por la robustez que exigen las cargas de varios pasos.
Las empresas con requisitos de gobernanza se atienden mediante espacios de trabajo, inicio de sesión único, SCIM, enrutamiento regional y controles de política de datos.
Los investigadores y evaluadores de IA pueden comparar muchos modelos desde una interfaz sin abrir una cuenta en cada proveedor.
Para quién no es: para usuarios finales que buscan un asistente conversacional. Aunque existe una interfaz de chat en el sitio, esto es infraestructura para desarrolladores, y usarla supone escribir código o configurar una aplicación. Quien quiera un producto de consumo listo para usar debería usar uno. Los equipos comprometidos con un único proveedor bajo contrato empresarial también pueden encontrar que esta capa aporta poco.
OpenRouter se entrega como API web, así que la cuestión de plataforma no es el sistema operativo sino la superficie de integración. La API implementa la especificación de OpenAI en el punto de acceso de compleción de conversación, de modo que cualquier lenguaje con cliente HTTP puede usarla y el código existente suele funcionar cambiando la URL base.
Las vías de integración mantenidas oficialmente incluyen la API en bruto, kits de cliente tipados y un kit para agentes. Más allá, la documentación ofrece guías dedicadas para los principales marcos de desarrollo: en orquestación están LangChain y Mastra, en el lado de aplicación y frontal Vercel AI SDK y TanStack AI, para backend tipado PydanticAI, para observabilidad Langfuse, para voz en tiempo real LiveKit, a lo que se suman notas de migración desde los kits de OpenAI y Anthropic, y formas de conexión para entornos de desarrollo y automatización como Replit, Xcode y Zapier. Es una señal útil: son integraciones documentadas de primera mano, no afirmaciones de la comunidad.
Las cifras de escala publicadas en la portada indican más de doscientos billones de tokens mensuales, más de diez millones de usuarios en el mundo, más de ochenta proveedores y más de quinientos modelos. Trátelas como declaradas por el proveedor y como una instantánea: un comentario de inversor de otro periodo cita recuentos claramente distintos, lo que indica que estos números se mueven rápido y conviene comprobarlos en vivo antes que citarlos de un artículo, incluido este.
Las capacidades para equipos y empresas incluyen espacios de trabajo con presupuestos, inicio de sesión único, correspondencia de grupos SCIM y, para clientes empresariales, enrutamiento dentro de la región en la Unión Europea y Estados Unidos.
El modelo de precios es el aspecto de OpenRouter que más a menudo se malinterpreta, y resulta bastante inusual como para exponerlo con precisión.
No hay recargo sobre la inferencia. La documentación es explícita: los precios de los proveedores de modelos subyacentes se trasladan sin recargo alguno, de modo que paga la misma tarifa que tratando directamente con el proveedor. Los costes por token son, por tanto, los que cobra el proveedor. Como esas tarifas varían enormemente en un catálogo de cientos de modelos y cambian cuando los proveedores ajustan sus precios, aquí no se cita ninguna cifra por token: consulte la página de modelos para conocer las tarifas vigentes.
Los ingresos proceden de la compra de créditos. Se cobra una comisión al comprar créditos, no al realizar llamadas de inferencia. La empresa la describe como una comisión pequeña y reitera que los precios de los proveedores nunca se incrementan. El porcentaje exacto se muestra de forma dinámica en el sitio y no como texto recuperable de la página, así que verifique la cifra vigente en el momento de pagar.
Los créditos son prepagados, con límites definidos. Las compras van de un mínimo de cinco dólares a un máximo de veinticinco mil por transacción. Los pagos con Stripe se liquidan en dólares estadounidenses y los de Coinbase pasan por una cartera de criptomonedas; una recarga automática puede completar el saldo cuando cae por debajo del umbral que usted fije.
Usar sus propias claves tiene su propia economía. Si mantiene contratos directos con proveedores, esta opción le permite emplearlos a través de la plataforma. Incluye una dotación gratuita dependiente del plan, medida en coste de inferencia a precio de tarifa y no en número de peticiones, distinción importante porque las llamadas caras agotan la dotación antes que muchas baratas. El uso por encima conlleva una comisión porcentual descontada de los créditos.
Existe acceso gratuito, pero deliberadamente limitado. Las cuentas nuevas reciben una pequeña dotación y el catálogo incluye modelos gratuitos. Estos tienen topes diarios de peticiones bajos y la documentación señala que por lo general no resultan adecuados para producción. Cabe destacar que el límite de tasa de los modelos gratuitos sube con los créditos comprados, de modo que las cuentas de pago obtienen topes gratuitos mayores.
Los reembolsos son estrechos. Los créditos no utilizados pueden reembolsarse dentro de las veinticuatro horas siguientes a la transacción; pasada esa ventana, cualquier crédito no utilizado deja de ser reembolsable. Los pagos en criptomoneda no son reembolsables en ningún caso. Compre en tramos que espere consumir.
Sin suscripción. La promesa de la portada de no exigir suscripción es exacta para el producto estándar: paga por lo que usa en lugar de una cuota recurrente de plataforma, y los acuerdos empresariales se tratan aparte.
El conjunto de comparación depende de qué parte del valor está sustituyendo.
Resumen honesto: OpenRouter compite por amplitud de catálogo, sofisticación del enrutamiento y una estructura de precios sin recargo. Si va a usar un modelo de un proveedor para siempre, el camino directo es más simple. Si la elección de modelo es una decisión continua, esta capa se gana su lugar.
Añade una dependencia en su ruta crítica. Cada llamada de inferencia pasa por un tercero. Eso compra resistencia frente a caídas de proveedores concretos, pero introduce la propia plataforma como posible punto de fallo. En aplicaciones donde las llamadas al modelo soportan carga, este intercambio debería ser una decisión de arquitectura deliberada.
Un salto de latencia es inevitable. Enrutar a través de un intermediario añade sobrecarga de red frente a llamar directamente al proveedor. La empresa trabaja en minimizarla y existen controles de preferencia, pero el salto es real e importa en bucles interactivos ajustados.
Los créditos son prepagados y la ventana de reembolso es corta. Los créditos no utilizados dejan de ser reembolsables tras veinticuatro horas, los pagos en criptomoneda no lo son nunca, y las condiciones señalan que los créditos no son moneda de curso legal. Eliminar la cuenta hace perder los créditos restantes.
Son posibles fallos silenciosos de configuración. El desajuste del identificador de complemento en el enrutamiento automático es el ejemplo más claro: los ajustes incorrectos se aceptan pero se ignoran en silencio, de modo que restricciones de modelo y niveles de coste pueden no aplicarse sin levantar error. Verifique los efectos en lugar de darlos por hechos.
Los modelos gratuitos no son un nivel de producción. Los límites de tasa bajos y la indicación explícita de que no convienen para producción implican que el catálogo gratuito sirve solo para evaluación.
El tratamiento de datos es configurable, lo que significa que es su responsabilidad. El valor por defecto de la política de recopilación permite proveedores que podrían almacenar datos. El enrutamiento sin conservación y las restricciones están disponibles, pero deben fijarse. Un equipo que presuma un tratamiento estricto por defecto puede equivocarse sobre su propia posición.
Las reglas de uso son cláusulas contractuales exigibles. Las condiciones prohíben el uso ilegal, la falsedad sobre la identidad, la extracción masiva, la elusión de mecanismos de seguridad y las pruebas adversas no autorizadas sobre modelos. Los equipos de investigación que planeen ese tipo de pruebas deberían leer esta cláusula antes de empezar.
Las métricas declaradas por el proveedor varían según la fuente. Recuentos de modelos y de proveedores y volúmenes de tokens difieren entre la portada y artículos de terceros de periodos distintos. Trate cualquier cifra concreta como sensible al tiempo.
El comportamiento de los modelos no es uniforme. Una indicación afinada para un modelo puede rendir distinto en otro, de modo que el enrutamiento automático puede alterar las características de la salida. Donde importe la constancia, fije el modelo.
Es infraestructura para desarrolladores. El producto es una API que llama su aplicación, junto con el enrutamiento, la facturación y la observabilidad que la rodean. En el sitio existe una interfaz de chat para probar modelos y depurar indicaciones, razón por la que algunos directorios lo clasifican mal, pero usar OpenRouter de forma significativa exige escribir código o configurar una aplicación.
No. La documentación afirma que los precios del proveedor se trasladan sin recargo y que paga la misma tarifa que tratando directamente. Los ingresos de la empresa proceden de una comisión cobrada al comprar créditos, no de la inferencia.
Un clasificador ligero asigna a su indicación uno de unos treinta tipos de tarea finamente divididos, y después el enrutador ordena los modelos según cuánto gastó realmente la comunidad de OpenRouter en ese tipo de tarea durante una ventana móvil de siete días. Se comporta como un índice de mercado, desplazándose hacia modelos que ganan adopción real en esa clase de trabajo.
Normalmente no. La API implementa la especificación de OpenAI en el punto de acceso de compleción de conversación, así que una integración existente suele funcionar tras cambiar la URL base y la clave. Hay kits de cliente tipados y un kit para agentes si desea algo más que HTTP en bruto.
La plataforma conmuta automáticamente al siguiente proveedor, de forma transparente para su aplicación. Ese es el argumento central de fiabilidad: su código no necesita lógica propia de reintento y redirección para sobrevivir a la caída de un proveedor.
Las cuentas nuevas reciben una pequeña dotación gratuita y el catálogo incluye modelos gratuitos. Esos modelos tienen límites diarios bajos y la documentación indica que por lo general no convienen para producción. El límite de los modelos gratuitos aumenta una vez comprados créditos, así que el nivel gratuito se entiende mejor como una vía de evaluación.
Sí, y es una configuración por petición y no un ajuste de toda la cuenta. Puede fijar la política de recopilación para rechazar proveedores que podrían almacenar datos, restringir el enrutamiento solo a puntos de acceso sin conservación y usar listas de permitidos o excluidos para proveedores concretos. Los clientes empresariales pueden exigir además enrutamiento dentro de la Unión Europea o Estados Unidos.
Sí. Incluye una dotación gratuita dependiente del plan, medida en coste de inferencia a precio de tarifa y no en número de peticiones, y el uso por encima conlleva una comisión porcentual descontada de sus créditos. Conviene a equipos que ya tienen contratos negociados con proveedores pero quieren enrutamiento unificado.
Solo dentro de las veinticuatro horas siguientes a la transacción, mediante el botón de reembolso de la página de créditos. Pasada esa ventana los créditos no utilizados dejan de ser reembolsables, y los pagos en criptomoneda no lo son en absoluto. Los créditos restantes también se pierden si elimina su cuenta.
Dominan tres consideraciones. Añade un tercero a la ruta crítica de su inferencia. Acepta un salto de red adicional y su coste en latencia. Y se compromete con un modelo de créditos prepagados con una ventana de reembolso estrecha. Si se ha estandarizado en un proveedor bajo acuerdo empresarial, o si necesita la latencia mínima absoluta, llamar directamente a ese proveedor puede servirle mejor.