Skip to content

Endpoints

Tianshu ofrece dos rutas: solo tienes que elegir una según el tipo de solicitud.

Ruta estándar (predeterminada)

https://tian-shu.org

Adecuada para la gran mayoría de los endpoints: chat, texto, embeddings, rerank, etc. La salida de chat en streaming empieza a devolver tokens en cuanto se establece la conexión y no se ve afectada por los tiempos de espera del primer byte, por lo que esta ruta es la recomendada de forma predeterminada.

Ruta directa (solicitudes largas / generación de imágenes)

https://api.tian-shu.org

Adecuada para solicitudes de larga duración que devuelven todo de una vez, normalmente generación de imágenes (/v1/images/generations, etc.). Estas solicitudes solo devuelven su resultado después de que el servidor termina de calcular, lo que puede provocar fácilmente tiempos de espera de solicitud del CDN; la ruta directa omite el CDN y llega directamente al origen, evitando interrupciones por tiempo de espera.

Regla general: las solicitudes en streaming que siguen emitiendo tokens → ruta estándar; las solicitudes que calculan durante mucho tiempo y luego devuelven todo de una vez (generación de imágenes, etc.) → ruta directa.

Rutas de endpoints

Ambas rutas son compatibles con las rutas estilo OpenAI, por ejemplo:

UsoRuta
Chat completions/v1/chat/completions
Responses/v1/responses
Claude Messages/v1/messages
Embeddings/v1/embeddings
Rerank/v1/rerank
Generación de imágenes/v1/images/generations
Voz / transcripción/v1/audio/speech, /v1/audio/transcriptions

Qué endpoints admite un modelo específico se determina por lo que se indica en el Mercado de Modelos.