Ramp abre Router.com: gratis hasta 2026 y retiene un año

Ramp abre Router.com: gratis hasta 2026 y retiene un año

Router.com de Ramp enruta modelos de IA; es gratis hasta 2026, solo en EE. UU., y retiene datos un año por defecto.

Por Humberto Toledo el 20 de agosto del 2026 a las 11:45 pm PDT

✨︎ Resumen (TL;DR):

  • Ramp lanzó Router.com el 19 de agosto de 2026 para enviar cada petición al modelo de IA más barato que cumpla la calidad solicitada.
  • El enrutamiento es gratis hasta el 31 de diciembre de 2026 e incluye 26 dólares en créditos; los tokens se cobran a precio de lista.
  • El registro está limitado a Estados Unidos, no existe una tarifa anunciada para 2027 y la retención predeterminada dura 1 año.

Ramp lanzó Router.com el miércoles 19 de agosto de 2026 para que las aplicaciones envíen cada petición al modelo de IA más barato que cumpla la calidad solicitada. El enrutamiento es gratis hasta el 31 de diciembre de 2026, incluye 26 dólares en créditos y solo está disponible en Estados Unidos. TechCrunch reportó que guarda por defecto las entradas, salidas y llamadas a herramientas durante 1 año.

Router.com es un servicio de enrutamiento de modelos de IA que recibe las peticiones de una aplicación y las manda al modelo más barato que alcance el nivel de calidad pedido por el desarrollador. Ramp, una empresa de gestión de gastos corporativos, lo usó puertas adentro durante 3 años antes de abrirlo al público. Su página de preguntas frecuentes indica que no hace falta ser cliente de Ramp.

Los tokens, en cambio, se pagan a precio de lista. Ramp no ha dicho cuánto costará Router.com a partir de 2027. El lanzamiento ocurrió el mismo día en que Stripe confirmó la compra de OpenRouter.

Anthropic domina el 73% del nuevo gasto empresarial en IA
Te podría interesar:
Anthropic domina el 73% del nuevo gasto empresarial en IA
Primer plano de una mujer sosteniendo un elegante brazo protésico negro en un entorno de estudio.
Foto: cottonbro studio / Pexels

Cuatro estrategias para no pagar el modelo caro en cada paso

Router expone una API compatible con las de OpenAI y Anthropic. Quien ya trabaja con esos SDK puede cambiar una línea, la dirección base, y seguir trabajando. Ramp guarda las credenciales de cada proveedor y nunca se las pide al desarrollador.

Veeral Patel, responsable de IA aplicada y uno de los primeros ingenieros de Ramp, documentó las estrategias en el blog de lanzamiento. Son cuatro:

  • Nivel flex: Los proveedores venden el mismo modelo a menor precio a cambio de una latencia menos predecible. Router vigila cuánto tarda cada nivel y envía la petición a flex solo mientras responda tan rápido como el estándar.
  • Modelos en sombra: Router envía una muestra del tráfico real a un modelo candidato mientras el modelo actual sigue atendiendo a los usuarios. Así puede comparar costo y latencia sobre la misma carga.
  • Enrutamiento por benchmarks: El equipo elige hasta 3 pruebas y les asigna peso relativo. Router ordena los modelos disponibles con esa ponderación y manda la petición al mejor calificado.
  • Switchyard, de NVIDIA: Mantiene los pasos rutinarios de un flujo con agentes en un modelo barato y escala solo los difíciles a otro más capaz. En una corrida interna con un agente de programación, Ramp cuenta que el sistema resolvió 58 turnos con el modelo barato y envió apenas los últimos 5 al caro.

Si un proveedor se cae o impone un límite de peticiones, Router puede desviar el tráfico a otro modelo disponible. Su panel muestra, por cada petición, el modelo, el proveedor, el nivel de servicio, los tokens, la latencia, el costo y los intentos de respaldo.

Para decidir sus valores por defecto, Ramp usa Ramp SWE-Bench, un banco de pruebas armado con trabajo real de su equipo de ingeniería. La compañía dice que las tablas públicas no respondían a lo que necesitaba saber.

El ahorro anunciado lo mide la misma Ramp

El comunicado abre con un recorte promedio de 40% en el costo de inferencia de los clientes que ya usaban Router. Dentro de Ramp, la cifra es de 30%, y la misma aparece en la página del producto.

Rahul Sengottuvelu, director de tecnología de Ramp, dijo que, en la mayoría de las empresas, la IA “es la partida que más rápido crece y la que menos pueden medir”.

Ninguna de las dos cifras tiene verificación independiente. La página también atribuye a Router un recorte de 92% en el caso de Valentin De Matos, de Delphi. Para Switchyard, Ramp reporta cifras de 59% en costo y 35% en tiempo. El único respaldo disponible para estos resultados es la propia empresa que ofrece y administra el servicio.

El comunicado también sostiene que el gasto en IA se multiplicó por 20.7 desde junio de 2025. La cifra proviene de Ramp AI Index, el índice que la compañía construye con los pagos que pasan por su plataforma. El índice que mide el crecimiento del gasto y Router, el producto que busca reducirlo, tienen el mismo origen corporativo.

Router.com y OpenRouter operan a escalas distintas

La coincidencia de fechas no pone a los dos servicios en la misma escala. Stripe confirmó la compra de OpenRouter el 19 de agosto de 2026, el mismo día del lanzamiento público de Router.com. Estos son los datos publicados para cada operación:

Punto Router.com (Ramp) OpenRouter (Stripe)
Fecha Lanzamiento público: 19 de agosto de 2026 Compra confirmada: 19 de agosto de 2026
Catálogo declarado OpenAI, Anthropic, la familia Grok y modelos abiertos como DeepSeek, Kimi, GLM y Qwen Más de 400 modelos de más de 80 proveedores
Volumen declarado Más de 2.75 billones de tokens al mes en la operación interna de Ramp Más de 10 billones de tokens al día
Cobro Enrutamiento gratis hasta fin de 2026; tokens a precio de lista Comisión de 5.5% al comprar créditos y cero margen sobre la inferencia
Empresa y valor reportado Ramp, valuada en 44,000 millones de dólares en junio de 2026 Operación de Stripe situada por la prensa por arriba de 7,000 millones de dólares

Con esos datos, la operación interna de Ramp enruta en un mes lo que OpenRouter declara mover en menos de un día.

El catálogo de Router todavía no contiene todo lo anunciado. El comunicado enumera modelos de OpenAI, Anthropic y la familia Grok, además de modelos abiertos servidos por Fireworks AI. Gemini y proveedores como Google, AWS, Together AI, Baseten y Crusoe todavía estaban en camino; TechCrunch, que revisó el servicio, sumó Minimax a la lista.

Fuera del enrutamiento, Ramp y Stripe ya tienen una relación. Las divulgaciones legales del sitio de Ramp indican que Stripe Payments UK Limited emite sus tarjetas en Reino Unido, mientras Stripe Technology Europe Limited lo hace en el Espacio Económico Europeo.

Un año de retención por defecto

La página de Router dice que conserva las entradas, las salidas y los metadatos, y que usa esa información para mejorar el producto. También ofrece elegir modelos alojados en Estados Unidos con retención cero, usar llaves propias del proveedor y controlar algunas de esas opciones.

El plazo no aparece en esa página. TechCrunch reportó que la retención dura 1 año por defecto, se mantiene activa salvo que el desarrollador la desactive y cubre entradas, salidas y llamadas a herramientas.

Ramp le dijo a ese medio que elimina la información que identifica a personas antes de usar el contenido para mejorar el producto.

El contraste con OpenAI y Anthropic es directo. Las políticas de sus API, revisadas la semana pasada, fijaban 30 días por defecto, con fines antiabuso y no de mejora del producto.

Estados Unidos primero, México después

Router está dirigido a desarrolladores y equipos de Estados Unidos. Ramp promete sumar más países, sin fecha, y las funciones para empresas siguen anunciadas como próximas.

Para quienes programan en México, España o América Latina, el registro está limitado a Estados Unidos; por ahora no hay nada que probar desde esas regiones. Sobre el precio de 2027, TechCrunch y The Stack coinciden: Ramp no lo ha publicado.

En su FAQ, la empresa también explica por qué compró el dominio router.com: la alternativa, bromea, era pasarse el año deletreando una dirección más larga en podcasts.

El calendario sí es verificable: el enrutamiento gratis termina el 31 de diciembre de 2026. La tarifa posterior no está publicada, los porcentajes de ahorro siguen sin una medición independiente y los equipos de México, España y América Latina todavía no pueden registrarse. Para quienes sí tengan acceso, la retención predeterminada de 1 año se puede desactivar desde la configuración correspondiente.

Fuentes: 1, 2, 3, 4

+ Temas Relacionados

Más de AI

Feed