Skip to main content
Começar

O que é o Alibaba Cloud Model Studio

O Alibaba Cloud Model Studio é uma plataforma completa para desenvolvimento e aplicação de LLMs. Disponibiliza toda a série Qwen e os principais LLMs de terceiros por meio das APIs oficiais do Qwen e de APIs compatíveis com OpenAI, com suporte multimodal para texto, imagem e áudio/vídeo. Fornece serviços de modelo em todo o ciclo de vida — desde chamadas de API até a criação visual de aplicações. Invoque modelos sob demanda, sem precisar gerenciar infraestrutura.

Gere conteúdo e resumos com poucas linhas de código.
O Model Studio é compatível com OpenAI. Atualize a chave de API, a URL base e o nome do modelo para migrar seu código OpenAI existente.
import os
from openai import OpenAI

# Note: The base_url varies by region. The following example uses the base_url for the Singapore region.
# - Singapore: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1. Replace {WorkspaceId} with your workspace ID.
# - China (Beijing): https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
# - China (Hong Kong): https://{WorkspaceId}.cn-hongkong.maas.aliyuncs.com/compatible-mode/v1
# - Japan (Tokyo): https://{WorkspaceId}.ap-northeast-1.maas.aliyuncs.com/compatible-mode/v1
# - Germany (Frankfurt): https://{WorkspaceId}.eu-central-1.maas.aliyuncs.com/compatible-mode/v1
# - US (Virginia): https://dashscope-us.aliyuncs.com/compatible-mode/v1
client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1"  # Replace {WorkspaceId} with your workspace ID
)
completion = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "Who are you?"}]
)
print(completion.choices[0].message.content)

service de modelos

O Model Studio oferece services de modelos prontos para uso, incluindo a série proprietária Qwen e modelos de terceiros como DeepSeek, Kimi e GLM. Consulte Recommended models.
  • Modelos principais do Qwen:
    • Qwen-Max: Modelo de maior desempenho da série Qwen, ideal para tarefas complexas e de múltiplas etapas.
      O mais recente qwen3.8-max traz melhorias significativas de raciocínio em relação ao seu antecessor. Recomendado.
    • Qwen-Plus: Equilibra desempenho, velocidade e custo — recomendado para a maioria dos cenários.
    • Qwen-Flash: Baixo custo e baixa latência — adequado para tarefas simples que exigem respostas rápidas.
  • Cobertura multimodal: Abrange geração de texto, compreensão visual, geração de imagens, geração de vídeo, reconhecimento e síntese de fala e embedding.
  • Modelos específicos de domínio: Modelos voltados para processamento de textos longos, tradução, mineração de dados, reconhecimento de intenção, interpretação de papéis e pesquisa profunda.

Faturamento

A ativação do Model Studio é gratuita. Os custos ocorrem apenas quando você invoca modelos. Consulte Billable items and pricing.
  • Inferência de modelos — Modelos como deepseek-v3.2-exp e outros grandes modelos de linguagem são faturados com base no número de tokens gerados. Use planos de economia para compensar o custo.
  • Base de Conhecimento (RAG) — A Base de Conhecimento é um recurso independente de geração aumentada por recuperação, faturado pela duração da especificação e pelas chamadas de modelo. Não aceita planos de economia nem planos de recursos.
A inferência de modelos e a Base de Conhecimento são recursos separados no Model Studio, com faturamento independente.

Cota gratuita para novos usuários

Novos usuários recebem uma cota gratuita na região Singapore para testar a invocação de modelos.
  • Usuários que não completaram seu perfil não podem continuar usando o service após o esgotamento da cota gratuita. Complete seu perfil para mudar para o faturamento de pagamento conforme o uso.
  • Usuários que completaram seu perfil migram automaticamente para o faturamento de pagamento conforme o uso após o esgotamento da cota gratuita. Para evitar cobranças inesperadas, ative o recurso Free quota only — o service será interrompido quando a cota se esgotar.
Para mais informações, consulte Free quota for new users.

Métodos de pagamento

As chamadas de modelo são faturadas por minuto. Para métodos de pagamento suportados, consulte Payment methods.

Visualizar faturas e uso

  • Detalhes de faturamento: Acesse as páginas Detalhes de Faturamento e Análise de Custos.
  • Estatísticas de chamadas: Cerca de uma hora após chamar um modelo, acesse o console do Model Studio, selecione sua região no canto superior direito, vá para a página Monitoramento, defina suas condições de consulta, clique em Monitor na coluna Actions do modelo desejado e visualize o volume de chamadas, consumo de tokens, taxa de sucesso e outras estatísticas. Consulte Model monitoring.
  • Uso do Coding Plan: Se você assina o Coding Plan, visualize o consumo da cota na página do Coding Plan. O Coding Plan utiliza uma taxa mensal fixa com uma cota mensal de solicitações para ferramentas de codificação com IA. Consulte Coding Plan overview.

Primeiros passos

Perguntas frequentes

R: A Alibaba Cloud protege a privacidade dos dados e nunca utilizará seus dados para treinamento de modelos. Todos os dados transmitidos durante a criação de aplicações ou o treinamento de modelos são criptografados. Consulte Security certifications and privacy.
R: O Model Studio está disponível nas seguintes regiões:China (Beijing),US (Virginia), Singapore, Japan (Tokyo),Germany (Frankfurt)** e China (Hong Kong)Selecione uma região próxima para reduzir a latência de rede. As regiões diferem em endpoints e URLs base, chaves de API (não intercambiáveis entre regiões), modelos suportados, recursos da plataforma e preços. Consulte a Model list.
R: O Model Studio utiliza faturamento de pagamento conforme o uso, sem dedução automática. Para evitar cobranças:
  • Exclua as chaves de API: Acesse o console do Model Studio, selecione sua região, vá para a página API Key e exclua todas as chaves de API.
  • Interrompa todas as chamadas de modelo em aplicações, agentes e fluxos de trabalho — incluindo tarefas agendadas e processos em segundo plano.
  • Ative a opçãoFree quota only(apenas novos usuários): Na página de detalhes do modelo, ative essa opção. O service será interrompido quando a cota se esgotar, evitando uso pago. Aplica-se apenas a modelos na região Singapore dentro do período de validade.
  • Configure monitoramento de custos e alertas: Visualize os Detalhes de Faturamento e o Monitoramento, e configure alertas de gastos elevados para detectar gastos anormais.
  • Coding Plan: Este plano oferece uma taxa mensal fixa e uma cota mensal de solicitações, substituindo as cobranças de pagamento conforme o uso. Utilize a URL base e a chave de API dedicadas ao Coding Plan ao fazer chamadas — caso contrário, as chamadas de modelo serão cobradas como pagamento conforme o uso. Consulte Coding Plan overview.
R:
  1. Teste online: Abra o console do Model Studio, selecione sua região, vá para a página Modelos e clique em um modelo. (O DeepSeek está disponível apenas na região China (Beijing).)
  2. Chame modelos via API: Consulte Make the first call to a Qwen API.
  3. Use ferramentas de desenvolvedor (como Claude Code): Consulte Connect to clients or developer tools.
Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento
Suporte