Perguntas frequentes sobre cotas, compras, assinaturas e integração do Token Plan Personal Edition.
Cotas e limites
O que significa o limite de 7 dias?
O Token Plan Personal Edition utiliza um sistema de cota com janela fixa de 7 dias, medida em Credits. Quando o consumo acumulado atinge o limite, o service é pausado até o término da janela e a redefinição da cota. A cota não utilizada dentro de uma janela não é transferida para o próximo ciclo.
Exemplo: O plano Standard tem um limite de 7 dias de 10.000 Credits. Você faz sua primeira chamada em 20 de julho e o sistema inicia a janela (de 20 a 27 de julho). Você consome 4.000 Credits em 20 de julho e 6.000 Credits em 22 de julho, atingindo o limite de 10.000 Credits, então o service é pausado. Em 27 de julho, a janela termina, a cota é redefinida para 10.000 Credits e o service é retomado.
Os limites para cada nível são os seguintes:
Nível | Limite de 7 dias |
|---|---|
Plano Lite | 2.500 Credits |
Plano Essential | 5.625 Credits |
Plano Standard | 10.000 Credits |
Plano Pro | 40.000 Credits |
O limite de 7 dias é redefinido em uma data fixa?
Não. O limite de 7 dias usa um mecanismo de janela fixa. Um cronômetro de 7 dias começa a partir da sua primeira chamada, e a cota é redefinida quando ele expira. O horário de redefinição depende de quando você fez a primeira chamada, e não de uma data fixa no calendário (como toda segunda-feira).
O que acontece quando a cota se esgota?
Ao atingir o limite, as chamadas são bloqueadas e nenhuma cobrança de pagamento conforme o uso é aplicada. Para restaurar o acesso, você pode:
- Aguardar a redefinição da cota.
- Fazer upgrade do seu plano.
- Comprar um pacote de uso para obter Credits adicionais que não estão sujeitos aos limites de janela.
O que é um cartão de redefinição e como usá-lo?
Um cartão de redefinição é um direito único de redefinição de cota para assinantes do Token Plan Personal Edition. Na área de cota do plano da página de assinatura do Token Plan, clique em Reset limit para redefinir a cota do plano imediatamente. O botão mostra o número de usos disponíveis (por exemplo, 1 disponível), e o ícone de informações ao lado exibe a dica "Use a reset card to reset your plan quota immediately." Um cartão de redefinição é concedido uma única vez, e não de forma recorrente, e nenhuma notificação separada por e-mail é enviada quando ele é concedido.
Por que ainda vejo cobranças de pagamento conforme o uso após ativar o Token Plan?
Ver cobranças de pagamento conforme o uso após ativar o Token Plan geralmente ocorre devido a um dos seguintes motivos:
- Chamadas antes da ativação: Chamadas feitas antes de você ativar o Token Plan são faturadas independentemente e não podem ser compensadas pelo plano.
- Erros de configuração: Não usar a API Key e a Base URL dedicadas do Token Plan (por exemplo, usar incorretamente o endpoint geral do Model Studio dashscope.aliyuncs.com ou uma chave do Coding Plan) direciona as solicitações pelo canal de pagamento conforme o uso.
- Modelos não suportados: Você chamou um modelo fora da lista de permissões do Token Plan (como Qwen3-VL-Plus ou certas subvariantes).
Qual é a relação entre pacotes de uso e planos? Preciso assinar um plano primeiro?
Os pacotes de uso complementam um plano, fornecendo Credits adicionais que não estão sujeitos aos limites do plano. É necessário assinar um plano válido antes de comprar um pacote de uso, e você pode manter até 5 pacotes simultaneamente.
Os Credits dos pacotes de uso estão sujeitos a limites de janela?
Não. Os Credits dos pacotes de uso não estão sujeitos aos limites de janela de 7 dias do plano e podem ser usados imediatamente após a compra.
Qual é a validade de um pacote de uso?
Os pacotes de uso têm validade de 1 mês. Os Credits não utilizados expiram automaticamente quando o pacote expira e não são reembolsáveis.
Onde posso visualizar meu uso do Token Plan?
Na página Token Plan > My Subscriptions do console do Model Studio, visualize a cota de Credits e o consumo da sua assinatura atual.
Por que o consumo de Credits na minha fatura ou em um plug-in difere do esperado?
Uma diferença entre o consumo de Credits e o que a fatura ou um plug-in relata é comumente causada por:
- Acertos de cache de contexto: A taxa de dedução é menor em caso de acerto de cache e maior em caso de falha.
- Diferenças entre famílias de modelos: Modelos diferentes (como a série Qwen e a série GLM) possuem taxas de dedução de Credits distintas.
- Impacto do modo de recurso: Alternar frequentemente entre chamada de ferramentas ou modo de pensamento pode afetar o faturamento.
O Token Plan oferece cota de teste gratuita ou Tokens gratuitos?
O próprio Token Plan não oferece cota de teste ou Tokens gratuitos. O Model Studio fornece uma cota gratuita separada para alguns modelos; você pode verificar no console a lista de modelos com cota gratuita disponível.
Como reduzir o consumo de Credits do Token Plan?
- Compacte o histórico de mensagens ou inicie uma nova conversa para evitar o acúmulo de consumo proveniente de um contexto longo.
- Desative o Modo de Pensamento para reduzir a sobrecarga de raciocínio.
- Mude para um modelo mais leve (como qwen3,6-plus em vez de qwen3,7-max) para tarefas menos complexas.
- Aproveite o cache — tokens que atingem o cache são faturados a uma taxa menor do que os tokens de entrada regulares.
- Monitore os detalhes de consumo na página Usage Analysis e ajuste seu uso adequadamente.
Por que o uso de Tokens exibido por uma ferramenta de terceiros (como Claude Code) difere do console do Model Studio?
- Escopo de medição diferente: Ferramentas de terceiros mostram apenas tokens de entrada e saída no nível do modelo; o console do Model Studio conta o conjunto completo de itens de consumo.
- Itens de consumo ocultos: Prompts de sistema, definições de ferramentas (schemas), configurações do usuário, convenções de projeto, histórico acumulado de conversas em múltiplas turnos, parâmetros e resultados de chamadas de ferramentas, e conteúdo interno de raciocínio do modelo contam para o consumo de Credits, mas não são mostrados por ferramentas de terceiros.
- Impacto do preço unitário do modelo: O consumo de Credits depende da taxa de dedução do modelo — um modelo com preço mais alto (como qwen3,7-max) resulta em maior consumo de Credits para o mesmo número de tokens.
- Sugestões de otimização: Visualize as estatísticas oficiais na página Usage Analysis da página de assinatura do Token Plan no console do Model Studio. Use
/compactpara compactar o histórico de mensagens ou/clearpara iniciar uma nova conversa e reduzir o acúmulo de contexto.
Erros de integração
Erros comuns e soluções
Mensagem de erro | Possível causa | Solução |
|---|---|---|
401 InvalidApiKey: No API-key provided. | Nenhuma API Key incluída no cabeçalho da solicitação | Gere uma API Key e configure-a em sua ferramenta |
401 InvalidApiKey: Invalid API-key provided. | Uso incorreto de uma API Key de pagamento conforme o uso ou de uma chave do Coding Plan; assinatura expirada; API Key copiada incompletamente | Confirme se você está usando a API Key do Token Plan Personal Edition, completa e sem espaços extras |
404 model_not_found: Model not exist. | Nome do modelo digitado incorretamente ou não consta na lista de suportados | Confirme se o nome do modelo diferencia maiúsculas de minúsculas e corresponde a um ID de modelo suportado pelo seu plano. |
403 AccessDenied.Unpurchased: Access to model denied. | O modelo é suportado apenas pelo Token Plan Team Edition, não pelo Personal Edition | Mude para um modelo suportado pelo Personal Edition ou use o Token Plan Team Edition |
401 invalid access token or token expired | Uso incorreto de uma Base URL do Coding Plan ou de outro modo de faturamento | Use a Base URL do Token Plan Personal Edition |
401 Incorrect API key provided | Uso incorreto da Base URL geral do Model Studio (dashscope.aliyuncs.com) | Use a Base URL do Token Plan Personal Edition |
429 Requests rate limit exceeded | Muitas solicitações em um curto período | Aguarde um minuto antes de tentar novamente e reduza a frequência de solicitações |
429 insufficient_quota: Your token-plan 1-week quota has been exhausted. | Limite de 7 dias esgotado | Aguarde a liberação da cota pela janela |
400 invalid_parameter_error: Unexpected item type in content. | Conteúdo não textual, como uma imagem, foi passado para um modelo apenas de texto | Mude para um modelo que suporte a modalidade ou confirme se o conteúdo da solicitação corresponde às capacidades do modelo |
502 Bad Gateway | Erro intermitente no lado do servidor | Tente novamente mais tarde |
Meu uso do Token Plan mostra 0, ou as chamadas ainda são cobradas ou geram atrasos. O que devo fazer?
- Um uso igual a 0 geralmente significa que nenhum consumo ocorreu ainda ou que foi usada uma API Key diferente da chave dedicada do Token Plan.
- Chamadas que ainda deduzem saldo ou geram atrasos indicam que uma API Key regular foi configurada em vez da chave dedicada do plano.
Concorrência e desempenho
Quantos Agents simultâneos são suportados?
A concorrência depende do nível do seu plano:
Nível | Concorrência recomendada |
|---|---|
Plano Lite | Suporta 1-2 Agents simultâneos |
Plano Essential | Suporta 2-3 Agents simultâneos |
Plano Standard | Suporta 3-4 Agents simultâneos |
Plano Pro | Suporta 6-8 Agents simultâneos |
As respostas ficarão mais lentas durante os horários de pico?
Podem ocorrer filas durante os horários de pico. Para um throughput mais estável, faça upgrade para um nível superior ou use a Team Edition.
Qual é o limite de taxa do Token Plan (TPM/RPM)? Ele pode ser aumentado?
Os limites de taxa são ajustados dinamicamente com base na carga geral para manter o service estável. Os limites de taxa do plano não podem ser aumentados.
Sugestões de otimização: reduza seu contexto e diminua a complexidade da tarefa para baixar os tokens de entrada por chamada; se você for limitado pela taxa, aguarde cerca de 1 minuto antes de tentar novamente.
Regras de uso
O que exatamente significa "automação de API de produção é proibida"?
O Token Plan Personal Edition destina-se apenas ao desenvolvimento interativo individual por meio de ferramentas oficialmente designadas (como Cursor, Claude Code e Windsurf). Não é permitido usar a API Key para services automatizados de produção, scripts em lote, tarefas agendadas em segundo plano ou outros cenários não interativos.
Várias pessoas podem compartilhar uma conta?
Não. O Token Plan Personal Edition é limitado a um único usuário; não é permitido compartilhar a mesma conta ou API Key entre várias pessoas. Para colaboração multiusuário, use o Token Plan Team Edition.
Posso usar a mesma API Key em vários dispositivos?
Sim. Cada assinatura do Token Plan Personal Edition possui uma API Key dedicada; copie-a e salve-a com segurança assim que for gerada. Configure a mesma API Key em vários dispositivos (como seus computadores doméstico e de trabalho) sem precisar regenerá-la para cada dispositivo.
Compras e assinaturas
Usuários RAM podem usar o Token Plan?
Sim, mas a conta Alibaba Cloud deve concluir a seguinte autorização:
- No console do RAM, conceda ao usuário RAM a política de sistema
AliyunTokenPlanReadOnlyAccess(somente leitura) ouAliyunTokenPlanFullAccess(gerenciamento) e também conceda a política de sistemaAliyunBSSReadOnlyAccess. - Na página Account Management do console do Model Studio, atribua a permissão Administrator ou Subscribe Plan ao usuário RAM.
Posso fazer upgrade? Como a cota é calculada após um upgrade?
É suportado fazer upgrade de um nível inferior para um superior. Você paga a diferença de preço proporcional ao período restante e, após o upgrade, o limite é imediatamente elevado para a cota do novo nível.
Posso fazer downgrade?
Não há suporte para downgrade. Para mudar para um nível inferior, compre novamente após a expiração da assinatura atual.
Como cancelo a renovação automática?
Faça logon na página Token Plan do console do Model Studio e desative a renovação automática no gerenciamento de assinaturas.
Como verifico o horário de vigência e os dias restantes do meu Token Plan?
- Horário de vigência: Faça logon na página Token Plan do console do Model Studio para visualizar quando o plano entrou em vigor.
- Lógica de exibição dos dias restantes: Os dias restantes mostrados no console são arredondados para baixo para períodos completos de 24 horas; a validade real baseia-se no carimbo de data/hora exato de término (por exemplo, 22 dias e 20 horas restantes são mostrados como 22 dias). Este é o comportamento esperado.