Iniciar sesiónContactoEmpieza gratis
Model and Modality Playbooks22 de junio de 2026Big Y

Acceso a la API de Qwen con una sola URL base compatible con OpenAI

Usa el acceso a la API de Qwen a través de Flatkey: compara los endpoints directos de DashScope, configura una sola URL base del router, elige un modelo y prueba registros, precios y reversión.

Acceso a la API de Qwen con una sola URL base compatible con OpenAI

El acceso a la API de Qwen tiene dos rutas prácticas para equipos que ya usan clientes con estilo OpenAI. Puedes llamar a Qwen directamente a través de la interfaz compatible con OpenAI de DashScope de Alibaba Cloud Model Studio, o puedes mantener una única URL base del router de Flatkey y usar Qwen junto con los otros modelos a los que ya enruta tu producto.

La ruta directa de Alibaba Cloud es específica de la región. La ruta de Flatkey utiliza https://router.flatkey.ai/v1, una clave de Flatkey y un ID de modelo Qwen seleccionado del catálogo actual de Flatkey antes de que pruebes los registros, las unidades de precio, la compatibilidad con funciones y la reversión.

Esta guía explica cómo usar el acceso a la API de Qwen a través de una única URL base compatible con OpenAI. Cubre lo que confirman los documentos oficiales de Alibaba Cloud, en qué cambia Flatkey el modelo operativo y qué verificar antes de mover tráfico de producción.

Respuesta rápida: acceso a la API de Qwen a través de una única URL base de router

Si tu app ya usa el SDK de OpenAI para Python o JavaScript, el acceso a la API de Qwen puede empezar como un cambio de configuración en lugar de una reescritura del SDK del proveedor.

Decisión Qwen directo en Model Studio Qwen a través de Flatkey
Clave de API Clave API de DashScope de Alibaba Cloud Model Studio Clave API de Flatkey
URL base URL compatible con OpenAI de DashScope específica de la región https://router.flatkey.ai/v1
Objetivo principal Llamar a Qwen directamente con sintaxis compatible con OpenAI Enrutar Qwen junto con otros proveedores detrás de una sola clave
Elección de modelo Modelo Qwen según la documentación de Alibaba Cloud y la región de la cuenta Modelo Qwen según los precios o el panel de Flatkey
Validación Respuesta, compatibilidad de funciones, facturación de Alibaba Cloud Respuesta, registro de uso de Flatkey, unidad de precio, cuota, reversión

Usa el endpoint directo de Model Studio cuando solo necesites el control de la cuenta de Alibaba Cloud para Qwen. Usa Flatkey cuando Qwen deba estar dentro del mismo flujo de trabajo de acceso, enrutamiento, cuota, registro de uso y facturación que GPT, Claude, Gemini, DeepSeek, Seedance, modelos de imagen y otras familias de modelos.

Lo que confirman las docs de Qwen de Alibaba Cloud

La documentación de Alibaba Cloud indica que los modelos Qwen en Model Studio admiten una interfaz compatible con OpenAI. La instrucción oficial de migración es directa: ajustar la clave de API, BASE_URL y el nombre del modelo. Ese es el mismo patrón de migración de tres partes que esperan la mayoría de los usuarios de SDK compatibles con OpenAI.

La documentación oficial enumera URLs base específicas por región para llamadas de SDK:

Región URL base compatible con OpenAI
Singapur https://dashscope-intl.aliyuncs.com/compatible-mode/v1
EE. UU. (Virginia) https://dashscope-us.aliyuncs.com/compatible-mode/v1
China (Pekín) https://dashscope.aliyuncs.com/compatible-mode/v1
Hong Kong (China) https://cn-hongkong.dashscope.aliyuncs.com/compatible-mode/v1

La referencia de OpenAI Chat también documenta el formato completo del endpoint de chat, como POST https://dashscope-us.aliyuncs.com/compatible-mode/v1/chat/completions para llamadas en EE. UU. La misma documentación incluye ejemplos de chat sin streaming, streaming, uso en el último fragmento del stream, llamada de herramientas, salida JSON, entrada de imágenes para modelos con capacidad de visión y opciones relacionadas con búsquedas.

Eso no significa que todos los modelos Qwen admitan todas las funciones. Significa que el acceso a la API de Qwen debe probarse función por función: primero chat básico, luego streaming, herramientas, JSON, visión, búsqueda o cualquier endpoint que tu aplicación realmente use.

Dónde Flatkey cambia la configuración de Qwen

Flatkey cambia la superficie operativa alrededor del acceso a la API de Qwen. En lugar de elegir directamente una URL base de región de DashScope en cada aplicación, apuntas tu cliente compatible con OpenAI a una sola URL base del router:

https://router.flatkey.ai/v1

Ese enrutamiento importa cuando Qwen no es el único modelo en tu stack. El texto público del producto de Flatkey posiciona la plataforma en torno a una sola clave API, precios claros, visibilidad del uso y un único panel para claves, uso y enrutamiento. La compatibilidad con Qwen para este artículo se verifica mediante la instantánea en vivo del catálogo de precios de Flatkey, no mediante una afirmación permanente de la página de inicio.

La instantánea de precios de Flatkey del día de publicación consultada para este artículo devolvió 638 filas totales de modelos y 63 filas con nombre Qwen. De esas filas de Qwen, 28 estaban marcadas como disponibles en la instantánea, y las filas de Qwen exponían openai como tipo de endpoint compatible. Toma esto como prueba fechada del 16 de junio de 2026, no como una garantía permanente de disponibilidad: confirma el ID actual del modelo Qwen en precios o en el panel antes del tráfico de producción.

Patrón de migración de la URL base

Mantenga el acceso a la API de Qwen en la configuración en lugar de codificar URLs de proveedores en toda su base de código.

FLATKEY_API_KEY="sk-fk-your-key"
OPENAI_BASE_URL="https://router.flatkey.ai/v1"
FLATKEY_QWEN_MODEL="replace-with-flatkey-qwen-model-id"

# Valores opcionales directos de Model Studio para comparación o reversión.
DASHSCOPE_API_KEY="sk-your-dashscope-key"
DASHSCOPE_BASE_URL="https://dashscope-us.aliyuncs.com/compatible-mode/v1"

La distinción importante es la propiedad de la ruta. Las pruebas directas de Qwen usan una clave de DashScope y una URL base regional de DashScope. Las pruebas de Flatkey usan una clave de Flatkey y la URL base del router de Flatkey. No mezcle claves, URLs base e IDs de modelo entre las dos rutas.

Plantilla de Python para Qwen a través de Flatkey

Solo plantilla: ejecuta esto con una clave Flatkey válida y un ID de modelo Flatkey Qwen confirmado antes de usarlo en producción.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["FLATKEY_API_KEY"],
    base_url=os.environ.get("OPENAI_BASE_URL", "https://router.flatkey.ai/v1"),
)

response = client.chat.completions.create(
    model=os.environ["FLATKEY_QWEN_MODEL"],
    messages=[
        {
            "role": "user",
            "content": "Responde con una sola frase confirmando que la ruta de Qwen está configurada.",
        }
    ],
)

print(response.choices[0].message.content)
print(response.usage)

La forma del código es intencionalmente la de un uso ordinario del SDK de OpenAI. El trabajo de producción consiste en elegir el ID de modelo correcto, probar tu conjunto de funciones y confirmar que la solicitud aparece en los registros de uso de Flatkey con el modelo, estado, uso de tokens y coste esperados.

Plantilla de JavaScript para Qwen a través de Flatkey

Solo plantilla: ejecútala con una clave válida de Flatkey y un ID de modelo confirmado del catálogo actual de Flatkey.

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.FLATKEY_API_KEY,
  baseURL: process.env.OPENAI_BASE_URL || "https://router.flatkey.ai/v1",
});

const response = await client.chat.completions.create({
  model: process.env.FLATKEY_QWEN_MODEL,
  messages: [
    {
      role: "user",
      content: "Responde con una sola frase confirmando que la ruta de Qwen está configurada.",
    },
  ],
});

console.log(response.choices[0].message.content);
console.log(response.usage);

Para equipos que ya usan clientes JavaScript compatibles con OpenAI, esto mantiene el acceso a la API de Qwen lo bastante pequeño como para revisarlo en un solo cambio de configuración. La ruta aún necesita una prueba de verificación antes del tráfico real.

Qwen directo versus Flatkey: qué probar

La escasez de artículos en los resultados de búsqueda actuales no es otra lista de modelos Qwen. La documentación oficial ya hace eso. La pieza que falta es una lista práctica de verificación del router para decidir cuándo Qwen directo es suficiente y cuándo una única URL base es la ruta operativa más limpia.

Necesidad del flujo de trabajo Verificación directa de Qwen Verificación del router Flatkey
Chat básico Usa la URL base regional correcta de DashScope y el modelo. Usa https://router.flatkey.ai/v1 y un ID de modelo Qwen de Flatkey.
Streaming Prueba stream: true y el manejo final del uso en DashScope. Prueba los fragmentos de stream, el comportamiento de timeout y el registro final de uso a través de Flatkey.
Herramientas/llamada de funciones Confirma que el modelo Qwen elegido admite el esquema de herramientas que envías. Confirma que el mismo esquema pasa a través de la ruta Qwen de Flatkey seleccionada.
Salida JSON Prueba tu patrón exacto de response_format. Verifica la compatibilidad del parser y el comportamiento ante errores a través del router.
Entrada de visión Selecciona un modelo de visión Qwen y prueba el formato de la carga útil de imagen. Confirma que el modelo de Flatkey acepta la misma forma de entrada de imagen.
Revisión de costes Consulta la facturación y la documentación de precios de Alibaba Cloud Model Studio. Consulta los precios de Flatkey y los registros reales de uso.
Enrutamiento multi-proveedor Requiere una configuración de proveedor separada para modelos que no sean Qwen. Mantén Qwen junto a otros proveedores detrás de una sola clave y un solo panel.

Manual de prueba de humo

Una prueba de humo de acceso a la API de Qwen debe demostrar tanto el comportamiento de la API como la visibilidad del enrutador.

  1. Elige un ID de modelo Qwen del precio actual de Flatkey o del panel.
  2. Crea o selecciona una clave de Flatkey de bajo riesgo para pruebas.
  3. Configura OPENAI_BASE_URL en https://router.flatkey.ai/v1.
  4. Ejecuta un prompt de chat simple sin streaming.
  5. Confirma que la forma de la respuesta funciona con el analizador de tu aplicación.
  6. Revisa los registros de uso de Flatkey para ver el modelo, el estado, el uso de tokens y el costo.
  7. Ejecuta una prueba de modelo incorrecto y registra la forma del error.
  8. Ejecuta streaming, herramientas, JSON, búsqueda o visión solo si tu aplicación los usa.
  9. Define una cuota pequeña antes de enviar tráfico real.
  10. Mantén la configuración directa de DashScope o del proveedor anterior como configuración de reversión hasta que la ruta sea estable.

El objetivo no es solo hacer que aparezca una respuesta de Qwen. El objetivo es saber a dónde fue la solicitud, cuánto costó, cómo se ven los fallos y con qué rapidez puedes restaurar la ruta anterior.

Errores comunes

  • Usar una clave API de DashScope con la URL base de Flatkey, o una clave de Flatkey con la URL base de DashScope.
  • Copiar un nombre de modelo Qwen de la documentación de Alibaba Cloud sin confirmar la cadena del catálogo de Flatkey.
  • Suponer que cada parámetro compatible con OpenAI se comporta igual en las rutas directas y en las rutas enrutadas.
  • Probar solo chat sin streaming cuando la producción usa streaming, herramientas, JSON, búsqueda o visión.
  • Omitir la revisión del registro de uso y precios de Flatkey después de una respuesta correcta.
  • Publicar fragmentos de código con claves que parezcan reales o ID de modelo de producción no probados.

Estos son detalles pequeños, pero ahí es donde fallan la mayoría de las migraciones de acceso a la API de Qwen. Un router facilita el acceso; no elimina la necesidad de probar la forma exacta de la solicitud.

Cómo encaja esto con las guías de migración existentes de Flatkey

Si esta es su primera migración de router, comience con la guía de migración de API compatible con OpenAI más amplia. Cubre el patrón de URL base, variables de entorno, pruebas de verificación, rollback y comprobaciones del panel que aplican a cualquier proveedor.

Luego use esta guía específica de Qwen para los detalles del proveedor: endpoints regionales de DashScope, selección de modelos Qwen, pruebas de streaming y de funciones, y la comprobación del catálogo de Flatkey. Para una ruta de proveedor similar, compare la guía del router compatible con OpenAI de la API de Gemini.

Preguntas frecuentes

¿Cómo obtengo acceso a la API de Qwen?

Puedes obtener acceso a la API de Qwen directamente a través de Alibaba Cloud Model Studio con una clave de API de DashScope, o enrutar Qwen a través de Flatkey con una clave de Flatkey y https://router.flatkey.ai/v1. La ruta directa usa URL base regionales de DashScope; la ruta de Flatkey mantiene Qwen en una única puerta de enlace multimodelo.

¿La API de Qwen es compatible con OpenAI?

Alibaba Cloud documenta una interfaz compatible con OpenAI para los modelos Qwen en Model Studio. La migración cambia la clave de API, la URL base y el nombre del modelo. Aún es necesario realizar pruebas a nivel de funcionalidad para streaming, herramientas, salida JSON, visión, búsqueda y cualquier parámetro avanzado.

¿Cuál es la URL base directa compatible con OpenAI para Qwen?

Depende de la región. Alibaba Cloud enumera URL base regionales, incluyendo https://dashscope-us.aliyuncs.com/compatible-mode/v1 para EE. UU. (Virginia), https://dashscope-intl.aliyuncs.com/compatible-mode/v1 para Singapur y https://dashscope.aliyuncs.com/compatible-mode/v1 para China (Pekín).

¿Qué URL base debo usar para Qwen a través de Flatkey?

Usa https://router.flatkey.ai/v1 para Qwen a través de Flatkey. Luego elige un ID de modelo Qwen actual desde los precios de Flatkey o desde el panel y prueba la solicitud antes del tráfico de producción.

¿Puedo usar el mismo ID de modelo de Qwen de la documentación de Alibaba Cloud en Flatkey?

No automáticamente. Las cadenas de modelo, los alias, la disponibilidad y el soporte del endpoint pueden variar según el catálogo y la ruta. Elige el ID de modelo en Flatkey el día que hagas la prueba y mantenlo en la configuración.

¿Compatible con OpenAI significa paridad total de funciones?

No. Normalmente, compatible con OpenAI significa que las formas comunes de solicitud y respuesta funcionan para los endpoints admitidos. No garantiza un comportamiento idéntico para cada modelo, parámetro, endpoint, región, modo de streaming, llamada a herramientas o carga multimodal.

¿Cómo debo presupuestar Qwen a través de un enrutador?

Usa la documentación de precios de Alibaba Cloud para el contexto directo de Model Studio y los precios de Flatkey para el uso enrutado. Luego verifica el coste real de la solicitud en los registros de Flatkey porque el modelo, la caché, el endpoint y las unidades de modalidad pueden diferir.

Consulte los precios antes de enrutar tráfico de producción

Acceso a la API de Qwen a través de un enrutador compatible con OpenAI es una vía práctica de migración cuando su aplicación ya usa llamadas SDK estilo OpenAI. Mantenga el cambio pequeño: actualice la URL base, use una clave de Flatkey, seleccione un modelo Qwen actual, ejecute las pruebas de verificación y confirme el uso y los precios antes del despliegue.

Consulte los precios para confirmar las opciones actuales de modelos Qwen de Flatkey y las unidades de coste antes de enviar tráfico de producción.