Modelos de Linguagem Grandes (LLMs) não conseguem responder a perguntas sobre dados privados. A ferramenta de recuperação de conhecimento busca conteúdo em uma base de conhecimento e o fornece ao LLM, permitindo que o modelo gere respostas mais precisas e relevantes.
Pré-requisitos
- Obtain an API key e configure it as an environment variable.
-
Crie uma base de conhecimento e obtenha seu ID. Você pode criar uma base de conhecimento das seguintes formas:
- Pelo console: Crie uma base de conhecimento na página de bases de conhecimento no console do Model Studio. Para mais informações, consulte Create and use a knowledge base.
-
Via API: Use o kit de desenvolvimento de software (SDK) do Alibaba Cloud Model Studio para criar uma base de conhecimento. Para mais informações, consulte Knowledge Base API Guide.
Antes de criar uma base de conhecimento via API, obtenha o ID do workspace (
workspace_id) no console do Model Studio . Apenas dois tipos de bases de conhecimento são suportados: busca de documentos e consulta de dados. Esses tipos atendem a pares básicos de perguntas e respostas de documentos, mas não suportam respostas com rich text ou imagens.
Como usar
Para chamar o recurso de recuperação de conhecimento pela Responses API, adicione a ferramenta file_search ao parâmetro tools e especifique o ID da base de conhecimento no parâmetro vector_store_ids.
Antes de começar, create and use a knowledge base e obtenha seu ID. Atualmente, o parâmetro vector_store_ids aceita apenas um ID de base de conhecimento.
Modelos suportados
- Qwen-Max: séries Qwen3,8-Max e Qwen3,7-Max
- Qwen-Plus: séries Qwen3,7-Plus, Qwen3,6-Plus e Qwen3,5-Plus
- Qwen-Flash: séries Qwen3,7-Flash, Qwen3,6-Flash e Qwen3,5-Flash
- Série open-source Qwen3,8
- Série open-source Qwen3,6 (exceto qwen3.6-27b)
- Série open-source Qwen3,5
Primeiros passos
Execute o código a seguir para chamar a ferramenta de recuperação de conhecimento pela Responses API. A ferramenta recupera conteúdo relevante da base de conhecimento especificada para gerar uma resposta.
Substitua vector_store_ids no código de exemplo pelo ID da sua base de conhecimento.
Saída em streaming
A ferramenta de recuperação de conhecimento executa uma busca semântica na base de conhecimento, processo que pode levar algum tempo. Ative a saída em streaming para obter resultados intermediários em tempo real.
Parâmetros
A ferramenta file_search aceita os seguintes parâmetros:
| Parâmetro | Obrigatório | Descrição |
|---|---|---|
type | Sim | Defina como "file_search". |
vector_store_ids | Sim | Lista de IDs de bases de conhecimento. Atualmente, é possível informar apenas um ID de base de conhecimento. Obtenha o ID na página de detalhes da base de conhecimento no console do Model Studio ou ao criar uma base de conhecimento via API.Certifique-se de fornecer um ID de base de conhecimento válido. Se você passar um array vazio ou um ID inválido, a ferramenta de recuperação de conhecimento não funcionará. O modelo usará seu próprio conhecimento para gerar uma resposta e não retornará erro. |
Faturamento
O faturamento abrange os seguintes aspectos:
- Taxas de chamada do modelo: O conteúdo recuperado da base de conhecimento é adicionado ao prompt, aumentando o número de tokens de entrada do modelo. A cobrança segue o preço padrão do modelo. Para detalhes, consulte o console do Model Studio.
- Taxas de chamada de ferramenta: O recurso de base de conhecimento é atualmente gratuito.