¿Has usado esta herramienta? Valórala
¿Has usado esta herramienta? Valórala
Runpod es una nube de GPU para desarrolladores que necesitan cómputo acelerado sin comprar hardware ni firmar contratos empresariales. Se describe como la nube para desarrolladores de IA, y en la práctica eso toma la forma de tres líneas de producto que comparten el mismo catálogo de GPU bajo una sola cuenta: Pods, instancias de GPU para cómputo persistente y desarrollo; Serverless, que ofrece endpoints de GPU con escalado automático que bajan a cero cuando están inactivos; y Clusters, cómputo distribuido multi-GPU para entrenamiento e inferencia por lotes grandes. Los tres están disponibles bajo demanda, sin contratos ni compromisos mínimos, y el objetivo de diseño declarado es pasar del experimento a la producción sin cambiar de plataforma entre etapas.
El origen de la empresa explica mucho sobre a quién sirve. Dos antiguos desarrolladores de Comcast, Zhen Lu y Pardeep Singh, convirtieron a finales de 2021 equipos de minería de criptomonedas alojados en sótanos de Nueva Jersey en servidores de IA, motivados —en palabras de Lu— por la constatación de que «la experiencia real de desarrollar software sobre GPU era sencillamente pésima». A principios de 2022 publicaron en subreddits dedicados a la IA una oferta de acceso gratuito a GPU a cambio de comentarios; a los nueve meses del lanzamiento habían dejado sus empleos y alcanzado un millón de dólares de ingresos. Ese origen comunitario y centrado en desarrolladores sigue notándose en el producto, incluso en cómo se suministra parte de su capacidad.
La escala alcanzada desde entonces es considerable y conviene fecharla, porque las cifras se mueven deprisa. TechCrunch informó en enero de 2026 de que Runpod había llegado a 120 millones de dólares de ingresos recurrentes anuales con 500.000 clientes desarrolladores repartidos en 31 regiones, tras superar los 24 millones de dólares de ingresos por sus propios medios antes de recibir capital institucional. En el anuncio de su serie A en junio de 2026 —100 millones liderados por Summit Partners con una valoración de mil millones, elevando la financiación total a 122 millones tras una ronda semilla de 20 millones colíderada por Intel Capital y Dell Technologies Capital en mayo de 2024— la cifra de desarrolladores se situaba por encima del millón, con más de 20.000 millones de peticiones de inferencia atendidas desde el lanzamiento. Entre los clientes citados figuran Replit, Cursor, OpenAI, Perplexity, Wix y Zillow.
Runpod se usa mediante un panel web, una interfaz de línea de comandos y API REST, con documentación que cubre las API v1 y v2 junto a referencias de modelos y CLI. La unidad de despliegue es un contenedor Docker, lo que significa que tu framework, tus dependencias y tu código viajan contigo: la postura declarada es «tus contenedores, tu framework, tu código» en lugar de un entorno de ejecución impuesto.
La infraestructura abarca 31 regiones y más de 30 modelos de GPU, y funciona en dos clases bien distintas. Community Cloud obtiene capacidad de anfitriones externos verificados en un esquema entre pares, donde los pods comparten máquina con aislamiento por contenedor a nivel de software. Secure Cloud funciona en centros de datos de nivel 3 y 4 con máquinas y GPU dedicadas, mejores SLA y volúmenes de red persistentes sobre NVMe. Ambas aparecen una junto a otra en la tabla de precios para los mismos modelos, y elegir entre ellas es tanto una decisión de fiabilidad y aislamiento como de coste.
En cuanto a integración, los endpoints Serverless son API HTTP: envías trabajos, consultas su estado y recuperas resultados, o usas llamadas síncronas para tareas cortas. Los endpoints con balanceo permiten traer tu propio framework HTTP y definir rutas propias. Los registros, la supervisión y las métricas en tiempo real se ofrecen sin instrumentación adicional, y el paquete Runpod skills extiende el despliegue y la gestión de recursos a agentes de programación como Claude Code y Cursor.
Runpod factura por hora o por segundo, sin niveles de suscripción: pagas el cómputo que usas, y la página de precios aparecía marcada como actualizada por última vez el 27 de julio de 2026.
Los Pods se tarifican por modelo de GPU. En la gama alta, la B300 cuesta 7,89 dólares la hora, la B200 6,79, la H200 4,59, la H100 SXM 3,29, la H100 PCIe 2,89 y la H100 NVL 3,19. En el tramo medio, la A100 SXM está a 1,59, la A100 PCIe a 1,39, la RTX Pro 6000 a 2,09, la L40S a 0,99 y la RTX 6000 Ada a 0,84. En la entrada, la RTX 4090 está a 0,74, la RTX 3090 a 0,50, la L4 a 0,49, la A40 a 0,44 y la RTX A5000 a 0,27 dólares la hora. La misma tabla presenta las dos clases de infraestructura en columnas separadas, de modo que el precio efectivo depende de cuál elijas.
Serverless se tarifica aparte y resulta sistemáticamente más caro por hora que el Pod equivalente, el hecho de precios más importante que conviene interiorizar: la H100 cuesta 4,79 dólares la hora en Serverless frente a 3,29 como Pod, la A100 2,72 frente a 1,59 y la RTX 4090 1,10 frente a 0,74. El nivel de 16 GB está a 0,58 la hora y el nivel compartido de 24 GB a 0,69. Runpod afirma que esto supone un ahorro del 25 % en workers flex frente a otros proveedores serverless. El sobreprecio compra escalado automático y coste nulo en reposo: justificado con tráfico irregular y desperdiciado con carga estable.
Los Clusters solo publican dos precios bajo demanda —H200 SXM a 4,31 dólares la hora y A100 SXM a 1,79— mientras que L40S, H100 SXM y B200 remiten al equipo comercial. Los Reserved Clusters no publican precio para ninguna duración: todas las casillas de 1, 3, 6, 12 meses y más indican contactar con ventas.
El almacenamiento se factura de forma independiente: disco de contenedor a 0,10 dólares por GB al mes; disco de volumen a 0,10 en funcionamiento y 0,20 inactivo; almacenamiento de red a 0,07 por debajo de 1 TB, 0,05 por encima y 0,14 para el nivel de alto rendimiento. Los Public Endpoints se facturan por llamada, con gran variación según modelo.
Una advertencia sobre los precios publicados: la sección de lenguaje de Public Endpoints muestra Deep Cogito v2 Llama 70B a 0,00001 dólares por millón de tokens cuando, en esa misma sección, Qwen3 32B AWQ está a 10,00 e IBM Granite 4.0 H Small a 1,00. Una diferencia de un factor de un millón dentro de una misma tabla apunta con fuerza a un error de página más que a un precio real, y aquí se recoge tal cual. Runpod además declara que mueve sus precios para mantener disponibles las GPU, así que trata cada cifra como una instantánea y verifícala en la página en vivo.
La comparación depende de qué faceta de Runpod estés sopesando. Frente a los grandes proveedores —AWS, Azure, GCP— el intercambio es fricción de compra y precio contra profundidad de ecosistema y contratos empresariales; Runpod reivindica costes de cómputo hasta un 90 % inferiores y ausencia de cargos de salida, mientras aquellos ofrecen servicios integrados que Runpod ni siquiera intenta cubrir. Frente a las nubes de GPU centradas en IA como CoreWeave y Lambda, la escala de capacidad y la contratación empresarial se inclinan hacia los proveedores mayores, mientras Runpod compite en acceso autoservicio y amplitud de modelos de GPU. Frente a los especialistas en inferencia serverless como Modal, Replicate, Baseten y Together, la comparación se juega en el comportamiento del arranque en frío, la experiencia de desarrollo y la forma de la tarificación, y las pruebas independientes muestran que el orden cambia según el tamaño del modelo en lugar de que una plataforma domine. Frente al alquiler de GPU tipo mercado como Vast.ai, el Community Cloud de Runpod ocupa un terreno parecido, mientras Secure Cloud añade una opción de nivel centro de datos que los mercados puros no suelen ofrecer. La evaluación práctica consiste en medir tu modelo real en dos o tres de ellas, porque las cifras publicadas rara vez sobreviven al contacto con una carga concreta.
La afirmación de arranque en frío por debajo de 200 ms necesita sus condiciones. La página de inicio de Runpod la anuncia mediante FlashBoot. Su propia documentación es más precisa: un arranque en frío abarca iniciar el contenedor, cargar los modelos en memoria de GPU e inicializar el entorno, y señala explícitamente que los modelos más grandes tardan más en cargarse, alargando el arranque. Pruebas independientes sobre Qwen Image fp16, que requiere 56 GB de memoria de vídeo, midieron entre 120 y 160 segundos de arranque en frío total frente a 30 a 40 segundos de generación real, un sobrecoste de tres a cuatro veces. No son datos contradictorios: la cifra de marketing describe una ruta en caliente con el modelo en caché, y la medición describe un modelo grande partiendo de cero. Pero quien solo lea la página de inicio dimensionará mal su presupuesto de latencia. Conviene señalar además que el autor de esa prueba revela que su propia plataforma figuraba entre las comparadas.
Las valoraciones independientes son medias y muy polarizadas. Runpod obtiene 3,7 sobre 5 en Trustpilot con 302 reseñas, 156 de ellas en los últimos doce meses. Lo llamativo es la distribución: 65 % de cinco estrellas y 19 % de una estrella, con muy poco en medio. Esa forma bimodal sugiere que las experiencias divergen con nitidez en lugar de agruparse en torno a lo aceptable. El perfil aparece marcado como que invita a los clientes a opinar, lo que introduce un sesgo de selección a tener en cuenta al leer la nota agregada.
Las quejas operativas recurrentes son concretas y coherentes. Hay usuarios que informan de que agotar el crédito de la cuenta provoca la eliminación de los pods en lugar de su simple parada, obligando a una reconstrucción completa. Otros describen periodos de grave escasez de GPU, facturación que no se correspondía con las especificaciones entregadas —una reseña menciona pagar por 1 TB de memoria y recibir 300 GB— y máquinas con NVSwitch averiado, GPU bloqueadas, memoria ausente o discos sin montar, que un reseñador calificó de ruleta. Otras agregaciones recogen pods que tardan hasta 30 minutos en arrancar o que no llegan a inicializarse mientras siguen facturando, y una atención que va de ágil a completamente silenciosa.
Merece la pena conocer una disputa de facturación sin resolver. Un reseñador de Trustpilot afirma que nunca fue cliente de Runpod, que su medio de pago se utilizó para abrir una cuenta que generó 810 dólares en cargos no autorizados en dos semanas, y que Runpod bloqueó esa cuenta por acceso de terceros mientras denegaba el reembolso alegando que no halló pruebas de acceso de terceros. Es el relato de un único usuario, recogido como tal y no como hecho establecido.
Las dos clases de infraestructura no son intercambiables. Community Cloud obtiene capacidad de anfitriones externos verificados, con pods que comparten máquina aislados solo a nivel de contenedor y una fiabilidad que varía según el anfitrión. Secure Cloud proporciona hardware dedicado en centros de datos de nivel 3 y 4. La documentación de Runpod recomienda Secure Cloud para cargas sensibles. Buena parte de la divergencia en la experiencia de usuario probablemente proceda de esta elección, y las tablas que muestran ambas columnas juntas facilitan escoger solo por precio sin registrar a qué se renuncia.
El cumplimiento es condicional y no general. Runpod ha completado SOC 2 Type 2, y su Trust Center enumera SOC 2 Type 2, SOC 3, HIPAA, RGPD y una carta de transición de 2026, con documentos que requieren acceso aprobado. Pero la página de cumplimiento indica sin rodeos que la cobertura puede variar según la carga, la región, el proveedor y el modelo de despliegue, y aconseja confirmar los requisitos concretos durante la revisión de seguridad. Añade que informes, certificaciones y cobertura de socios pueden cambiar con el tiempo. La certificación a nivel de empresa es, por tanto, un punto de partida de la diligencia, no su conclusión.
El sitio ofrece dos cifras de disponibilidad distintas. La sección empresarial de la página de inicio indica un 99,9 % de disponibilidad mientras que las preguntas frecuentes de esa misma página hablan de una garantía del 99,99 %. Runpod no ha publicado explicación alguna, y ambas se recogen tal cual.
Al menos un precio publicado parece erróneo. Deep Cogito v2 Llama 70B aparece a 0,00001 dólares por millón de tokens en una sección donde modelos comparables cuestan 1,00 y 10,00 dólares por millón. Es casi con seguridad un error de página, y aquí no se formula ninguna hipótesis sobre cuál sería la cifra correcta.
Serverless cuesta más por hora de GPU que los Pods. Es un rasgo de diseño y no un defecto, pero sorprende a los equipos que dan por hecho que lo serverless es automáticamente más barato. Con carga estable y previsible, un Pod resulta bastante más económico; Serverless solo justifica su sobreprecio cuando el tiempo de inactividad es sustancial.
Los endpoints con balanceo cambian la cola por flexibilidad. Permiten traer tu propio framework HTTP pero no ofrecen cola para peticiones acumuladas, a diferencia de los endpoints estándar. Bajo cargas repentinas, esa diferencia determina si las peticiones sobrantes esperan o fallan.
Las cifras publicadas llevan salvedades de fecha. El número de desarrolladores era de 500.000 en la información de enero de 2026 y de más de un millón en junio de 2026; ambas se citan con su fecha en lugar de reconciliarse. Las cifras de escala, las tasas de éxito de despliegue y los datos de retención los declara la empresa y no han sido auditados de forma independiente, igual que los ahorros comunicados por clientes, como una reducción del 90 % en la factura de infraestructura.
Los Pods son instancias de GPU para cómputo persistente y desarrollo, disponibles como Reserved garantizado o como Spot interrumpible y más barato. Serverless ofrece endpoints de GPU con escalado automático que bajan a cero en reposo y no facturan nada cuando no se ejecutan. Los Clusters aportan cómputo distribuido multi-GPU para entrenamiento e inferencia en lotes grandes, hasta 64 GPU bajo demanda y más mediante reserva. Los tres comparten el mismo catálogo bajo una sola cuenta, y el recorrido previsto es usarlos en distintas etapas sin cambiar de plataforma.
Describe una condición concreta y no todos los casos. FlashBoot, con el modelo en caché y una ruta en caliente, puede alcanzar esa velocidad. La propia documentación de Runpod señala que el arranque en frío incluye iniciar el contenedor, cargar el modelo en memoria de GPU e inicializar el entorno, y que los modelos más grandes tardan más. Pruebas independientes sobre un modelo de imagen de 56 GB de memoria de vídeo midieron entre 120 y 160 segundos de arranque frente a 30 a 40 segundos de generación. Mide con tu propio modelo en lugar de planificar la latencia en torno a la cifra de titular.
Tres palancas, según la documentación. Guarda el modelo en caché: incrusta los pesos en la imagen del worker o mantenlos en un volumen de red para no descargarlos en el momento de la petición. Activa FlashBoot. Y fija un número de workers activos por encima de cero, lo que elimina el arranque en frío de la primera petición pero renuncia al ahorro de bajar a cero. Esta tercera es un intercambio directo entre coste y latencia, y resolverlo depende por completo de si tu tráfico es irregular o estable.
Community Cloud obtiene GPU de anfitriones externos verificados en un esquema entre pares; los pods comparten máquina con aislamiento por contenedor a nivel de software, los precios son más bajos y la fiabilidad varía según el anfitrión. Secure Cloud funciona en centros de datos de nivel 3 y 4 con máquinas y GPU dedicadas, mejores SLA y volúmenes de red persistentes sobre NVMe. La documentación de Runpod recomienda Secure Cloud para cargas sensibles, y también es la opción por defecto adecuada para la fiabilidad en producción.
Los Pods se facturan por hora según el modelo de GPU: por ejemplo B300 a 7,89, H200 a 4,59, H100 SXM a 3,29, A100 SXM a 1,59, L40S a 0,99, RTX 4090 a 0,74 y RTX A5000 a 0,27 dólares la hora, con las dos clases de infraestructura en columnas separadas. Serverless se tarifica aparte y más alto: H100 a 4,79 y A100 a 2,72 dólares la hora. El almacenamiento se factura por separado desde 0,05 dólares por GB al mes. Los Clusters publican dos precios bajo demanda y el resto remite a ventas, y los Reserved Clusters no publican ninguno. Los precios se mueven deliberadamente, así que consulta la página en vivo.
Porque compras cosas distintas. Un Pod es capacidad dedicada que retienes y pagas de forma continua. Un worker Serverless es capacidad que aparece bajo demanda, escala automáticamente y no cuesta nada en reposo, y esa elasticidad lleva un recargo por hora. La economía se inclina hacia Serverless cuando tu endpoint está inactivo la mayor parte del tiempo y hacia Pods cuando la carga es estable. Hacer el cálculo con tu ciclo de uso real es más fiable que cualquiera de las dos suposiciones por defecto.
Puede serlo, con condiciones. Runpod ha completado SOC 2 Type 2, su Trust Center enumera recursos de SOC 3, HIPAA y RGPD, Secure Cloud añade aislamiento de red y las preguntas frecuentes citan un SLA del 99,99 % de disponibilidad, aunque esa misma página de inicio indica en otro lugar un 99,9 %. La salvedad esencial procede de la propia página de cumplimiento de Runpod: la cobertura varía según la carga, la región, el proveedor y el modelo de despliegue, y debe confirmarse durante la revisión de seguridad. Trata la certificación como el inicio de la diligencia, no como su conclusión.
Varias reseñas de usuarios informan de que los pods se eliminan en lugar de simplemente detenerse cuando se agota el crédito, obligándote a crear un pod nuevo y reconfigurar tus ajustes desde cero. Como es un comportamiento reportado por usuarios con consecuencias reales para el trabajo no guardado, mantén un margen de crédito, conserva lo valioso en almacenamiento de red y no en el disco local del pod, y vigila el saldo si dejas pods en marcha.
Las señales independientes son mixtas y polarizadas. Trustpilot muestra 3,7 sobre 5 con 302 reseñas, con un 65 % de cinco estrellas y un 19 % de una estrella y poco en medio, en un perfil que invita a opinar. Las quejas recurrentes incluyen escasez de GPU, máquinas con fallos de hardware, facturación que no coincide con lo entregado, pods lentos en arrancar o que fallan pero siguen facturando, y atención desigual. La distribución bimodal se explica sobre todo por la separación entre Community y Secure Cloud y por las fluctuaciones de oferta, así que tu experiencia depende en buena medida de qué infraestructura elijas y qué tarjeta necesites.
Frente a los grandes proveedores, Runpod compite en precio —reivindicando costes de cómputo hasta un 90 % inferiores y ausencia de cargos de salida— y en acceso autoservicio sin procesos de compra, renunciando al ecosistema de servicios circundante. Frente a CoreWeave y nubes de IA similares, los proveedores mayores suelen liderar en escala de capacidad y contratación empresarial, mientras Runpod lidera en amplitud de GPU disponibles en autoservicio. Frente a Modal, Replicate y otros especialistas en serverless, los factores decisivos son el comportamiento del arranque en frío con tu modelo, la experiencia de desarrollo y la forma de la tarificación, y las pruebas independientes no señalan un ganador en todos los tamaños de modelo. Pruébalo con tu propia carga.