Skip to main content
Tutorial de integração de modelos de terceiros

MiniMax

Use os modelos MiniMax no Alibaba Cloud Model Studio.

Este documento aplica-se apenas à região da China continental. Para usar o modelo, obtenha uma chave de API na região da China continental.

Primeiros passos

Pré-requisitos: Crie uma chave de API e defina-a como variável de ambiente. Caso utilize um SDK para chamar o modelo, instale o SDK do OpenAI ou DashScope.
  • OpenAI compatible
  • DashScope
  • Python
  • Node.js
  • HTTP

Código de exemplo

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)

completion = client.chat.completions.create(
    model="MiniMax-M2.5",
    messages=[{"role": "user", "content": "Who are you?"}],
    stream=True,
)

reasoning_content = ""  # Full chain-of-thought
answer_content = ""     # Full response
is_answering = False    # Whether response has started

print("\n" + "=" * 20 + "Chain of thought" + "=" * 20 + "\n")

for chunk in completion:
    if chunk.choices:
        delta = chunk.choices[0].delta
        # Collect only chain-of-thought content
        if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
            if not is_answering:
                print(delta.reasoning_content, end="", flush=True)
            reasoning_content += delta.reasoning_content
        # Start response when content arrives
        if hasattr(delta, "content") and delta.content:
            if not is_answering:
                print("\n" + "=" * 20 + "Full response" + "=" * 20 + "\n")
                is_answering = True
            print(delta.content, end="", flush=True)
            answer_content += delta.content

Resposta

====================Chain of thought====================

The user asked "Who are you?".

I should reply and introduce myself as an AI assistant.
====================Full response====================

Hello! I am MiniMax-M2.5, an AI assistant. I can help you answer questions, provide information, hold conversations, and more. How can I help you?

Outros recursos

ModeloConversa em múltiplas rodadasPensamento profundoChamada de funçãoSaída estruturadaBusca na webModo parcialCache de contexto
MiniMax-M2.5SupportedSupportedSupportedNot supportedSupportedNot supportedSupported
Apenas cache implícito.

Valores padrão dos parâmetros

Modelo

temperature

top_p

presence_penalty

MiniMax-M2.5

1,0

0,95

0,0

Modelos e faturamento

O MiniMax-M2.5 destaca-se em programação, tarefas de escritório, resumo de texto e outras atividades, com alta velocidade de saída. Recomendamos este modelo. Para obter informações sobre a janela de contexto e os preços, consulte Modelos recomendados. O faturamento baseia-se na quantidade de tokens de entrada e saída.

Códigos de erro

Se a chamada do modelo falhar e retornar uma mensagem de erro, consulte as mensagens de erro para solucionar o problema.
Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento
Suporte