Endpoints
A Tianshu oferece duas rotas — basta escolher uma de acordo com o tipo de requisição.
Rota padrão (default)
https://tian-shu.orgAdequada para a grande maioria dos endpoints: chat, texto, embeddings, rerank e assim por diante. A saída de chat em streaming começa a retornar tokens assim que a conexão é estabelecida e não é afetada por timeouts de primeiro byte, por isso essa rota é recomendada por padrão.
Rota direta (requisições longas / geração de imagens)
https://api.tian-shu.orgAdequada para requisições de longa duração que retornam tudo de uma vez, normalmente geração de imagens (/v1/images/generations etc.). Essas requisições só retornam o resultado depois que o servidor termina o processamento, o que facilmente pode disparar timeouts de requisição no CDN; a rota direta contorna o CDN e alcança a origem diretamente, evitando interrupções por timeout.
Regra prática: requisições em streaming que continuam emitindo tokens → rota padrão; requisições que processam por muito tempo e depois retornam tudo de uma vez (geração de imagens, etc.) → rota direta.
Caminhos dos endpoints
Ambas as rotas são compatíveis com caminhos no estilo OpenAI, por exemplo:
| Uso | Caminho |
|---|---|
| Chat completions | /v1/chat/completions |
| Responses | /v1/responses |
| Claude Messages | /v1/messages |
| Embeddings | /v1/embeddings |
| Rerank | /v1/rerank |
| Geração de imagens | /v1/images/generations |
| Fala / transcrição | /v1/audio/speech, /v1/audio/transcriptions |
Quais endpoints um modelo específico suporta é determinado pelo que está indicado no Marketplace de Modelos.
