Endpoints
Tianshu ofrece dos rutas: solo tienes que elegir una según el tipo de solicitud.
Ruta estándar (predeterminada)
https://tian-shu.orgAdecuada para la gran mayoría de los endpoints: chat, texto, embeddings, rerank, etc. La salida de chat en streaming empieza a devolver tokens en cuanto se establece la conexión y no se ve afectada por los tiempos de espera del primer byte, por lo que esta ruta es la recomendada de forma predeterminada.
Ruta directa (solicitudes largas / generación de imágenes)
https://api.tian-shu.orgAdecuada para solicitudes de larga duración que devuelven todo de una vez, normalmente generación de imágenes (/v1/images/generations, etc.). Estas solicitudes solo devuelven su resultado después de que el servidor termina de calcular, lo que puede provocar fácilmente tiempos de espera de solicitud del CDN; la ruta directa omite el CDN y llega directamente al origen, evitando interrupciones por tiempo de espera.
Regla general: las solicitudes en streaming que siguen emitiendo tokens → ruta estándar; las solicitudes que calculan durante mucho tiempo y luego devuelven todo de una vez (generación de imágenes, etc.) → ruta directa.
Rutas de endpoints
Ambas rutas son compatibles con las rutas estilo OpenAI, por ejemplo:
| Uso | Ruta |
|---|---|
| Chat completions | /v1/chat/completions |
| Responses | /v1/responses |
| Claude Messages | /v1/messages |
| Embeddings | /v1/embeddings |
| Rerank | /v1/rerank |
| Generación de imágenes | /v1/images/generations |
| Voz / transcripción | /v1/audio/speech, /v1/audio/transcriptions |
Qué endpoints admite un modelo específico se determina por lo que se indica en el Mercado de Modelos.
