Modelo de Detecção de Intenção e Preenchimento de Slots para sistemas de diálogo que prevê conjuntamente intenções baseadas em API e parâmetros de slots em uma única saída. O modelo retorna resultados JSON padronizados com múltiplos comandos de API e slots preenchidos.
Provedor do service de Inferência
O Alibaba Cloud Model Studio fornece o service de inferência para tongyi-intent-detect-v3.
Capacidades do Modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de Entrada | Text | Modalidade de Saída | Text |
Experiência do Modelo | Unsupported | Function Calling | Unsupported |
Saídas Estruturadas | Unsupported | Pesquisa na Web | Unsupported |
Conclusão de Prefixo | Unsupported | Cache de Contexto | Unsupported |
Inferência em Lote | Unsupported | Fine-tuning | Unsupported |
Limites de Contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento Máximo de Entrada | 8192 | Comprimento Máximo de Saída | 4096 |
Janela de Contexto | 8192 |
Preços
Esta página exibe apenas os preços originais das chamadas de api do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- China (Beijing)
Item de Faturamento | Preço (USD) | Unidade |
Entrada | 0,058 | Por 1 milhão de tokens |
Saída | 0,144 | Por 1 milhão de tokens |
Limites de Taxa
- China (Beijing)
Parâmetro | Valor |
RPM (Requisições Por Minuto) | 1200 |
TPM (Tokens Por Minuto) | 1.000.000 |