Los precios de las AI gateway son fáciles de subestimar porque la tarifa visible del modelo es solo una parte de la factura.
El precio de tokens más bajo anunciado no produce automáticamente el menor costo operativo. Los compradores también deben tener en cuenta las tarifas de la gateway, las asignaciones de suscripción, los cargos por compra de créditos, los reintentos, el tráfico de respaldo, la observabilidad, los controles de cuota y el tiempo necesario para conciliar el uso entre proveedores.
Esta guía ofrece a los equipos de compras, ingeniería y finanzas una forma práctica de comparar esos costos. También explica cómo los planes actuales de Flatkey encajan con los equipos que quieren una sola clave de API, una sola URL base, visibilidad centralizada del uso y acceso a modelos de texto, imagen y video.
Nota sobre precios: Los precios de los productos y los límites de los planes de esta guía se verificaron el 27 de julio de 2026. Los precios cambian con frecuencia. Confirme las condiciones vigentes en la página oficial de precios de cada proveedor antes de tomar una decisión de compra.
The Short Answer: Compare Total Gateway Economics
Una comparación útil de precios de AI gateway debería responder siete preguntas:
- ¿Cuánto cuestan los modelos subyacentes para las cargas de trabajo que realmente ejecuta?
- ¿La gateway añade un recargo, una tarifa por compra de créditos, una suscripción o un cargo de plataforma basado en el uso?
- ¿El uso del proveedor está incluido en el plan, se repercute o se factura por separado a través de sus propias claves de proveedor?
- ¿Qué ocurre cuando la aplicación reintenta una solicitud o hace fallback a otro modelo?
- ¿Puede establecer cuotas antes de que un experimento, equipo o entorno se exceda en el gasto?
- ¿Pueden ingeniería y finanzas conciliar la misma evidencia a nivel de solicitud?
- ¿El plan coincide con su patrón de tráfico, incluidos los picos cortos y la generación de medios?
La comparación debería terminar con un costo efectivo por tarea exitosa, no simplemente con el costo por millón de tokens.
costo efectivo por tarea exitosa =
uso del modelo + tarifas de la gateway + costo de reintento/fallback + sobrecarga operativa
/ resultados de tareas aceptadas
Esa fórmula funciona para una respuesta de soporte, una extracción de documentos, una imagen, un clip de video o cualquier otro resultado de producto.
The Four Common AI Gateway Pricing Models
Las AI gateways estructuran los costos de distintas maneras. Antes de comparar precios, identifique qué modelo utiliza cada proveedor.
| Modelo de precios | Lo que pagas | Mejor opción para | Principal riesgo de comparación |
|---|---|---|---|
| Suscripción con uso incluido | Un plan mensual fijo con asignaciones definidas de texto o medios | Equipos que quieren un punto de entrada predecible y acceso en paquete | Las asignaciones, los límites a corto plazo y el comportamiento de excedentes pueden importar más que la suscripción destacada |
| Créditos prepago con comisión de compra | Uso del modelo más un porcentaje o una comisión fija cuando se compran créditos | Equipos que valoran un acceso amplio sin cuentas separadas de proveedores | La comisión de financiación se acumula a medida que crece el uso |
| Tarifas del modelo de paso directo | Tarifas del proveedor sin recargo declarado del gateway, a veces combinadas con cargos de plataforma o alojamiento | Equipos que quieren costes del modelo transparentes | La observabilidad, el despliegue, la transferencia de datos u otros costes de plataforma pueden quedar en otra parte |
| Suscripción SaaS del gateway más uso | Una tarifa mensual de plataforma con límites de registros, solicitudes, asientos o funciones | Equipos que traen sus propias cuentas de proveedor y compran software de plano de control | Las facturas del proveedor y del gateway deben combinarse para ver el coste total |
No existe un modelo universalmente más barato. La mejor opción depende del volumen de tráfico, el tamaño de las solicitudes, las modalidades, la combinación de proveedores, la madurez operativa y cuánto control necesita el equipo.
Una instantánea actual del mercado
Las páginas oficiales de precios ilustran por qué una comparación por categoría no puede usar una sola columna etiquetada como “precio”.
| Gateway | Estructura de precios pública verificada el 27 de julio de 2026 | Qué debe verificar un comprador |
|---|---|---|
| Flatkey | Las suscripciones mensuales Go, Pro y Max incluyen acceso a todos los modelos listados, uso definido de modelos de texto y créditos multimedia; Enterprise usa condiciones personalizadas | Adecuación de las asignaciones, límites a corto plazo, consumo de créditos multimedia y condiciones de facturación o enrutamiento empresarial |
| Cloudflare AI Gateway | Las funciones básicas del gateway están disponibles sin tarifa de gateway; usar acceso a proveedores gestionado por Cloudflare mediante Unified Billing añade una comisión porcentual sobre los créditos comprados | Si usará Unified Billing o sus propias claves de proveedor, además de cualquier uso relacionado con Workers o la plataforma |
| Vercel AI Gateway | El acceso al modelo se presenta al precio de lista del proveedor sin recargo; las cuentas reciben crédito mensual de AI Gateway y pueden comprar créditos adicionales | Si el plan de Vercel asociado, la observabilidad, el despliegue o las necesidades del equipo añaden costes fuera del uso del modelo |
| OpenRouter | Los créditos prepago incluyen una comisión de compra; las solicitudes con claves propias (BYOK) tienen una asignación gratuita separada y luego una tarifa de plataforma | Frecuencia de financiación de créditos, volumen de solicitudes BYOK, enrutamiento de proveedores y costes del método de pago |
| Portkey | Un plan mensual de producción incluye un volumen definido de registros, con opciones de mayor volumen y empresariales | Gasto en proveedores, excedentes de registros, retención, asientos y requisitos de funciones empresariales |
| Helicone | Un plan mensual Pro incluye funciones de plataforma y una asignación de uso, con cargos basados en el uso y condiciones empresariales personalizadas | Gasto en proveedores, volumen de solicitudes, retención, asientos y qué funciones requieren un plan superior |
Estos no son productos idénticos. Algunos venden acceso gestionado a modelos, otros venden una capa de control para tus propias cuentas de proveedor, y algunos combinan ambos. Una comparación justa debe decidir primero si el comprador quiere una sola relación comercial para el acceso al modelo o software superpuesto sobre relaciones de proveedor existentes.
Cost Layer 1: Underlying Model Usage
Empieza por la carga de trabajo, no por la página principal del proveedor.
Para modelos de texto, estima:
- tokens de entrada;
- tokens de entrada en caché cuando el modelo los admita;
- tokens de salida;
- solicitudes por acción del usuario;
- crecimiento esperado del contexto;
- porcentaje de solicitudes enrutadas a modelos premium.
Los modelos de imagen, audio y video pueden usar unidades diferentes, como imágenes generadas, segundos, minutos, niveles de resolución o trabajos. No normalices estas cargas de trabajo solo en conteos de solicitudes.
Una estimación útil del costo mensual del modelo es:
monthly model cost =
Σ(requests × input units × input rate)
+ Σ(requests × output units × output rate)
+ media generation charges
Si aún no has medido cargas de trabajo reales, usa tres escenarios: normal, crecimiento e incidente. El caso de incidente debe incluir prompts más largos, llamadas repetidas y alternativas a modelos premium.
Para un flujo de trabajo de previsión más profundo, consulta AI API spend forecasting.
Cost Layer 2: Gateway Fees, Funding Fees, and Subscriptions
A continuación, traduce el modelo comercial del proveedor a la misma unidad mensual.
Para un modelo de suscripción:
gateway cost = monthly subscription + overages + add-ons
Para un modelo de compra de créditos:
gateway cost = model credits purchased × purchase-fee percentage
Para una control plane SaaS:
gateway cost = platform plan + request/log overages + seats + retention or enterprise add-ons
Para configuraciones bring-your-own-key, no trates el plan del gateway como toda la factura. Añade cada factura del proveedor al cargo de la plataforma. Incluye también el costo operativo de mantener cuentas de proveedor, métodos de pago, límites, claves y acceso regional.
Cost Layer 3: Retries and Fallback Routing
Una solicitud que llega al usuario puede contener varios intentos facturables.
Por ejemplo:
- El modelo principal expira tras procesar la entrada.
- El cliente reintenta el mismo modelo.
- El gateway hace fallback a un segundo modelo.
- La aplicación acepta la respuesta final.
El usuario ve un solo resultado, mientras que el sistema de facturación puede registrar tres solicitudes.
Pregunta a cada proveedor si los registros de solicitudes muestran la cadena completa: solicitud original, respuesta del proveedor, reintento, fallback, modelo final, unidades consumidas y costo. Luego calcula:
retry amplification = total billable attempts / accepted outcomes
Aunque sea un aumento modesto en retry amplification puede eliminar una ventaja en la tarifa del modelo. Por eso la fiabilidad del enrutamiento y la visibilidad de costes pertenecen a la misma decisión de compra.
Cost Layer 4: Quotas and Spend Controls
Los controles de costos solo tienen valor económico si funcionan antes de que se gaste el dinero.
Evalúa si el gateway te permite:
- crear claves separadas para productos, equipos, clientes o entornos;
- establecer cuotas a nivel de clave o de equipo;
- ver el consumo frente a esas cuotas;
- restringir el acceso a modelos costosos;
- identificar cambios repentinos en el tráfico o en la mezcla de modelos;
- revisar el historial de recargas y saldos;
- deshabilitar o rotar una clave sin cambiar cada integración con el proveedor.
Una tarifa de proveedor que sea un 5% más baja puede no resultar más barata si una clave compartida permite que una prueba sin control consuma un gran presupuesto de producción.
Usa límites de cuota de API de IA para construir el primer conjunto de barreras de protección para equipos y entornos.
Cost Layer 5: Trabajo de finanzas y conciliación
El precio del gateway también debe tener en cuenta el esfuerzo mensual necesario para explicar la factura.
Las cuentas separadas de proveedores pueden generar múltiples facturas, monedas, saldos de crédito, métodos de pago y formatos de exportación. Ingeniería puede saber qué modelo atendió una solicitud mientras finanzas solo ve totales a nivel de cuenta.
Un gateway centralizado puede reducir ese trabajo cuando su panel se conecta con:
- clave de API o propietario de la carga de trabajo;
- modelo y ruta;
- unidades de entrada, salida, caché o medios;
- estado de la solicitud;
- actividad de reintento y fallback;
- registro de saldo o recarga;
- coste para un período definido.
Si la calidad del panel es un criterio de compra importante, usa la guía de evaluación de panel unificado de facturación de IA para ejecutar una prueba de solicitud a factura.
Flatkey Pricing: ¿Qué plan se adapta a qué carga de trabajo?
Flatkey empaquetó el acceso gestionado a múltiples modelos en planes mensuales. La página de precios actual de Flatkey enumera las opciones Go, Pro, Max y Enterprise.
| Plan | Precio mensual público | Uso de modelos de texto incluido | Asignación de medios incluida | Idoneidad práctica |
|---|---|---|---|---|
| Go | $10/mes | Hasta $45 de uso de modelos por mes | 300 créditos de medios | Creadores individuales y uso diario ligero |
| Pro | $30/mes | Hasta $90 de uso de modelos por mes | 1.200 créditos de medios | Desarrollo diario y solicitudes de mayor frecuencia |
| Max | $100/mes | Hasta $300 de uso de modelos por mes | 5.000 créditos de medios | Cargas de trabajo de producción y uso de medios más intensivo |
| Enterprise | Personalizado | Volumen comprometido y términos personalizados | Personalizado | Uso mayor, compras, facturación, enrutamiento personalizado o controles de equipo |
Los planes de autoservicio también publican límites de uso a corto plazo. Revisa esos límites frente a tu patrón de picos, no solo tu estimación mensual. Un equipo con un total mensual predecible pero un pico concentrado en el día de lanzamiento puede necesitar un plan diferente al de un equipo con tráfico de fondo constante.
Elige Go cuando
- un desarrollador o un pequeño prototipo necesita acceso amplio a modelos;
- el uso es ligero y distribuido;
- el equipo quiere una sola clave sin abrir varias cuentas de proveedor;
- la generación de medios es ocasional.
Elige Pro cuando
- el tráfico de desarrollo se ejecuta todos los días;
- las pruebas de prompts o la automatización generan llamadas más frecuentes;
- el equipo necesita más margen para experimentos con imágenes o vídeo;
- los límites a corto plazo de Go son demasiado ajustados para el flujo de trabajo previsto.
Elige Max cuando
- la aplicación está pasando a producción;
- varias cargas de trabajo comparten el gateway;
- el uso de medios es significativo;
- el equipo quiere una asignación incluida mayor antes de hablar de condiciones personalizadas.
Elige Enterprise cuando
- el uso es lo bastante grande como para que la economía de volumen comprometido tenga sentido;
- compras necesita facturación o condiciones negociadas;
- el equipo necesita enrutamiento personalizado o controles organizativos;
- un acuerdo comercial firmado importa más que la simplicidad de autoservicio.
El modelo de Flatkey es más relevante para los compradores que prefieren acceso y facturación centralizados en lugar de mantener cuentas separadas de proveedores. Los equipos que ya tienen contratos negociados con proveedores deberían comparar esas tarifas directas más los costes del software de gateway frente a un plan de acceso gestionado.
Una tarjeta de evaluación para compradores de precios de AI Gateway
Usa esta tarjeta con la misma muestra de carga de trabajo para cada proveedor.
| Área de decisión | Evidencia a solicitar | Condición para aprobar |
|---|---|---|
| Coste del modelo | Tarifario y uso por solicitud | Las unidades de entrada, salida, caché y medios son visibles |
| Cargo del gateway | Suscripción, cuota de financiación, margen o calendario de excedentes | Cada cargo que no sea del modelo puede expresarse mensualmente |
| Uso incluido | Asignación, caducidad, límite y condiciones de excedente | La carga de trabajo esperada encaja tanto en los límites mensuales como en los de corto plazo |
| Economía de reintentos | Cadena de intentos y resultado final | Los costes de duplicados y respaldo pueden medirse |
| Cuotas | Controles de clave, equipo y entorno | Una carga de trabajo de prueba puede limitarse antes de gastar de más |
| Conciliación | Pruebas de panel, exportación, recarga y factura | Los totales de ingeniería y finanzas coinciden para un período |
| Portabilidad | URL base, compatibilidad del SDK y pasos de migración de claves | Un modelo o ruta puede cambiar sin reescribir la aplicación |
| Soporte | Ruta de incidentes y compromisos de servicio | Las expectativas de respuesta coinciden con el riesgo de producción |
Puntúa cada fila de 0 a 2:
- 0: no disponible o poco claro;
- 1: disponible con trabajo manual o restricciones del plan;
- 2: disponible, comprobable e incluido en el plan previsto.
No elijas un gateway solo porque gane en la fila de tarifa del modelo. Una decisión de compra sólida también debería superar las pruebas de reintentos, cuota, conciliación y portabilidad.
Ejecuta una prueba de precios de siete días antes de comprometerte
La comparación más limpia es una prueba breve usando tráfico representativo.
- Seleccione un flujo de trabajo de texto y un flujo de trabajo de medios si los medios son importantes.
- Envíe la misma distribución de tráfico a través de cada configuración preseleccionada.
- Registre los resultados aceptados, no solo las solicitudes.
- Mida las unidades de entrada, salida, caché, medios, reintento y fallback.
- Agregue todos los cargos de plataforma, financiación, suscripción y proveedor.
- Conciliar el total del panel con las exportaciones y los saldos.
- Compare el costo efectivo por tarea exitosa y el tiempo del operador.
Documente también qué cambiaría con 3× y 10× de volumen. Algunos modelos de precios resultan atractivos a escala de evaluación, pero generan una curva de costos diferente en producción.
Preguntas frecuentes
¿Un AI gateway es más caro que llamar directamente a los proveedores?
No necesariamente. Un gateway puede añadir una suscripción, una tarifa de financiación o un cargo de plataforma, pero también puede reducir la sobrecarga de cuentas de proveedor, el trabajo de integración, el uso no controlado y el costo de solicitudes fallidas. Compare el costo operativo total para los mismos resultados aceptados.
¿Cuál es la métrica de precios más importante de un AI gateway?
Use el costo efectivo por tarea exitosa. Combina el uso del modelo, los cargos del gateway, los reintentos, los fallback y la sobrecarga operativa en una unidad que el equipo de producto entiende.
¿Debería usar créditos prepago del gateway o traer mis propias claves de proveedor?
El acceso gestionado prepago es más sencillo cuando desea una única relación comercial y acceso amplio a modelos. Traer sus propias claves puede resultar atractivo cuando ya tiene condiciones negociadas con el proveedor, pero mantiene cuentas separadas, límites, facturas y gestión de claves.
¿Cómo debo comparar los costos de texto, imagen y video?
Mantenga las unidades de facturación nativas de cada carga de trabajo y luego normalice el resultado a un resultado comercial aceptado. El conteo de solicitudes por sí solo no es suficiente.
¿Por qué los controles de cuota forman parte de una comparación de precios?
Porque un sobrecoste evitable forma parte del costo total. Las cuotas, la separación de claves y la visibilidad del uso ayudan a contener experimentos, claves comprometidas, bucles inesperados y cambios repentinos en la mezcla de modelos.
Compare los planes de Flatkey con su carga de trabajo real
Comience con su uso esperado de texto, uso de medios, patrón de picos y necesidad de controles de aprovisionamiento. Luego revise precios de Flatkey para comparar Go, Pro, Max y Enterprise frente a esa carga de trabajo.
Si la prioridad es una clave API, una URL base compatible con OpenAI, acceso gestionado a modelos y controles de costos centralizados, Flatkey ofrece al equipo de compras una estructura de plan concreta para evaluar sin tener que crear primero cuentas separadas de proveedores.



