Skip to main content
Tutorial integrasi model pihak ketiga

DeepSeek

Topik ini menjelaskan cara memanggil model seri DeepSeek di Alibaba Cloud Model Studio menggunakan antarmuka yang kompatibel dengan OpenAI atau SDK DashScope.

Model deepseek-v3, deepseek-v3.1, deepseek-v3.2, deepseek-v3.2-exp, deepseek-r1, deepseek-r1-0528, dan deepseek-r1-distill-qwen-7b/14b/32b akan dihapus dari daftar pada 10 Oktober 2026. Kami menyarankan Anda menggunakan model berikut sebagai gantinya: qwen3.7-plus, qwen3.7-max, dan qwen3.6-flash.

Titik akhir layanan

Titik akhir layanan berbeda untuk setiap Wilayah. Konfigurasikan Base URL berdasarkan Wilayah yang Anda pilih (ganti {WorkspaceId} dengan Workspace ID aktual). Model yang tersedia dan batas laju juga bervariasi menurut Wilayah. Untuk informasi selengkapnya, lihat dokumen Pembatasan laju.
  • Kompatibel dengan OpenAI
  • Kompatibel dengan OpenAI - Responses API
  • DashScope
  • China (Beijing)
  • AS (Virginia)
  • Singapura
  • Jerman (Frankfurt)
  • Jepang (Tokyo)
base_url untuk konfigurasi pemanggilan SDK adalah https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1Alamat permintaan HTTP adalah POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions

Memulai

deepseek-v4-pro adalah model unggulan dalam seri DeepSeek dan unggul dalam pemrograman, matematika, dan tugas umum. deepseek-v4-flash-0731 adalah versi terbaru yang dirilis. Anda dapat menggunakan parameter enable_thinking untuk beralih antara mode berpikir dan non-berpikir. Contoh berikut menunjukkan cara memanggil model deepseek-v4-pro dalam mode berpikir. Anda harus mendapatkan Kunci API dan mengonfigurasikannya sebagai Variabel lingkungan. Jika Anda menggunakan SDK, Anda juga harus menginstal SDK OpenAI atau DashScope.
  • Kompatibel dengan OpenAI
  • DashScope
  • Kompatibel dengan Anthropic
Parameter enable_thinking bukanlah parameter standar OpenAI. SDK Python OpenAI meneruskannya melalui extra_body, sedangkan SDK Node.js meneruskannya sebagai parameter tingkat atas. Parameter reasoning_effort adalah parameter standar OpenAI dan dapat diteruskan langsung sebagai parameter tingkat atas.
  • Python
  • Node.js
  • HTTP

Kode contoh

from openai import OpenAI
import os

# Inisialisasi klien OpenAI
client = OpenAI(
    # Jika variabel lingkungan tidak dikonfigurasi, ganti dengan Kunci API Alibaba Cloud Model Studio Anda: api_key="sk-xxx"
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    # Wilayah Singapura. Ganti {WorkspaceId} dengan ID ruang kerja Bailian Anda. URL bervariasi menurut wilayah.
    base_url="https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1",
)

messages = [{"role": "user", "content": "Siapa kamu?"}]
completion = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=messages,
    # Gunakan extra_body untuk mengatur enable_thinking dan mengaktifkan mode berpikir
    extra_body={"enable_thinking": True},
    stream=True,
    stream_options={
        "include_usage": True
    },
)

reasoning_content = ""  # Proses berpikir lengkap
answer_content = ""  # Respons lengkap
is_answering = False  # Menunjukkan apakah fase respons telah dimulai
print("\n" + "=" * 20 + "Proses Berpikir" + "=" * 20 + "\n")

for chunk in completion:
    if not chunk.choices:
        print("\n" + "=" * 20 + "Penggunaan Token" + "=" * 20 + "\n")
        print(chunk.usage)
        print("ID Permintaan:", chunk.id)
        continue

    delta = chunk.choices[0].delta

    # Kumpulkan hanya konten berpikir
    if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
        if not is_answering:
            print(delta.reasoning_content, end="", flush=True)
        reasoning_content += delta.reasoning_content

    # Setelah menerima konten, mulai menghasilkan respons
    if hasattr(delta, "content") and delta.content:
        if not is_answering:
            print("\n" + "=" * 20 + "Respons Lengkap" + "=" * 20 + "\n")
            is_answering = True
        print(delta.content, end="", flush=True)
        answer_content += delta.content

Respons

====================Proses Berpikir====================
Oke, pengguna mengajukan pertanyaan perkenalan diri yang sangat sederhana: "Siapa kamu?".
Saya perlu menjelaskan identitas saya, memperkenalkan diri sebagai DeepSeek dengan cara yang ringkas dan ramah, menyebutkan pencipta saya, fitur dasar, dan bantuan yang dapat saya berikan.
Saya dapat mengatur jawaban seperti ini: pertama, nyatakan identitas saya secara langsung, sebutkan saya dibuat oleh perusahaan DeepSeek, lalu cantumkan beberapa fitur utama (gratis, konteks panjang, unggah file, dll.), dan akhiri dengan undangan ramah, menanyakan apakah saya bisa membantu.
====================Respons Lengkap====================
Halo! Saya DeepSeek, asisten AI yang dibuat oleh perusahaan DeepSeek.
Saya dapat membantu Anda menjawab berbagai pertanyaan, membuat teks, menganalisis dokumen, membantu pemrograman, dan lainnya. Fitur utama saya adalah **gratis digunakan**, memiliki **konteks super panjang** (saya dapat memproses seluruh trilogi 'The Three-Body Problem' sekaligus), dan mendukung **unggahan file** serta **pencarian web** (harus diaktifkan secara manual).
Ada yang bisa saya bantu? Baik untuk belajar, bekerja, atau sekadar mengobrol santai, saya senang berbicara dengan Anda!
====================Penggunaan Token====================
CompletionUsage(completion_tokens=238, prompt_tokens=5, total_tokens=243, completion_tokens_details=CompletionTokensDetails(accepted_prediction_tokens=None, audio_tokens=None, reasoning_tokens=93, rejected_prediction_tokens=None), prompt_tokens_details=None)
Request ID: chatcmpl-a1b2c3d4-e5f6-7890-abcd-ef1234567890

Kekuatan inferensi (reasoning_effort)

Model deepseek-v4-pro, deepseek-v4-flash, dan deepseek-v4-flash-0731 memiliki mode berpikir yang diaktifkan secara default. Anda dapat menyesuaikan kekuatan inferensi menggunakan parameter reasoning_effort. Nilai yang valid adalah low, medium, high, xhigh, dan max. Nilai default adalah high.
low dan medium menghasilkan perilaku yang sama dengan high. xhigh menghasilkan perilaku yang sama dengan max.
  • Kompatibel dengan OpenAI
  • DashScope
Python
from openai import OpenAI
import os
client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    # Wilayah China (Beijing). Ganti {WorkspaceId} dengan ID ruang kerja Bailian Anda. URL bervariasi menurut wilayah.
    base_url="https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[{"role": "user", "content": "Manakah yang lebih besar, 9.9 atau 9.11?"}],
    reasoning_effort="high",
)
print(completion.choices[0].message.content)

Responses API

deepseek-v4-flash, deepseek-v4-flash-0731, dan deepseek-v4-pro mendukung panggilan melalui Responses API yang kompatibel dengan OpenAI. Hanya Wilayah China (Beijing) dan Singapura yang didukung. Untuk titik akhir, lihat Titik akhir layanan. Saat memanggil Responses API, Anda dapat menambahkan alat web_search (Pencarian web), web_extractor (Web extractor), dan code_interpreter (Code Interpreter) ke parameter tools.
Python
from openai import OpenAI
import os

client = OpenAI(
    # Jika variabel lingkungan tidak dikonfigurasi, ganti baris berikut dengan Kunci API Studio Model Anda: api_key="sk-xxx"
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    # URL berikut untuk wilayah Singapura. Untuk wilayah lain, gunakan https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
    base_url="https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1",
)

response = client.responses.create(
    model="deepseek-v4-flash",
    input="Halo! Perkenalkan dirimu dalam satu kalimat.",
    # Opsional: aktifkan alat pencarian web, web extractor, dan code interpreter
    tools=[
        {"type": "web_search"},
        {"type": "web_extractor"},
        {"type": "code_interpreter"},
    ],
)

# Dapatkan respons model
print(response.output_text)

Fitur lainnya

ModelPercakapan multi-putaranFunction CallingCache konteksOutput terstrukturPenyelesaian Awalan
deepseek-v4-proDidukungDidukungDidukungDidukungTidak didukung
deepseek-v4-pro-usDidukungDidukungDidukungDidukungTidak didukung
deepseek-v4-flash-0731DidukungDidukungDidukungDidukungTidak didukung
deepseek-v4-flashDidukungDidukungDidukungDidukungTidak didukung
deepseek-v4-flash-usDidukungDidukungDidukungDidukungTidak didukung
deepseek-v3.2DidukungDidukungDidukungTidak didukungTidak didukung
deepseek-v3.2-expDidukungDidukung
Hanya mode non-berpikir yang didukung.
Tidak didukungTidak didukungTidak didukung
deepseek-v3.1DidukungDidukung
Hanya mode non-berpikir yang didukung.
DidukungTidak didukungTidak didukung
deepseek-r1DidukungDidukungDidukungTidak didukungTidak didukung
deepseek-r1-0528DidukungDidukungTidak didukungTidak didukungTidak didukung
deepseek-v3DidukungDidukungDidukungTidak didukungTidak didukung
Model distilasiDidukungTidak didukungTidak didukungTidak didukungTidak didukung

Nilai parameter default

Model

suhu

top_p

repetition_penalty

presence_penalty

max_tokens

thinking_budget

deepseek-v4-pro

1,0

1,0

-

-

393.216 secara total

deepseek-v4-pro-us

1,0

1,0

-

-

393.216 secara total

deepseek-v4-flash-0731

1,0

1,0

-

-

393.216 secara total

deepseek-v4-flash

1,0

1,0

-

-

393.216 secara total

deepseek-v4-flash

1,0

1,0

-

-

393.216 secara total

deepseek-v3.2

1,0

0,95

-

-

65.536

32.768

deepseek-v3.2-exp

0,6

0,95

1,0

-

65.536

32.768

deepseek-v3.1

0,6

0,95

1,0

-

65.536

32.768

deepseek-r1

0,6

0,95

-

1

16.384

32.768

deepseek-r1-0528

0,6

0,95

-

1

16.384

32.768

Versi distilasi

0,6

0,95

-

1

16.384

16.384

deepseek-v3

0,7

0,6

-

-

16.384

-

  • Tanda hubung (-) menunjukkan bahwa parameter tersebut tidak memiliki nilai default dan tidak dapat diatur.
  • Model deepseek-r1, deepseek-r1-0528, dan model distilasi tidak mendukung pengaturan nilai parameter ini.
  • Untuk definisi parameter, lihat Kompatibel dengan OpenAI - Chat.

Model dan penagihan

  • Model berpikir hibrid (gunakan parameter enable_thinking untuk mengontrol mode berpikir): deepseek-v4-pro, deepseek-v4-flash, deepseek-v4-flash-0731, deepseek-v3.2, deepseek-v3.2-exp, dan deepseek-v3.1
  • Model hanya-berpikir (selalu berpikir sebelum merespons): deepseek-r1 dan deepseek-r1-0528
  • Model non-berpikir: deepseek-v3
deepseek-v4-pro unggul dalam pemrograman, matematika, dan tugas umum. deepseek-v4-flash-0731 cepat dan hemat biaya. Kami menyarankan Anda memprioritaskan penggunaan deepseek-v4-pro. Untuk informasi tentang panjang konteks model dan harga, lihat Konsol Studio Model. Penagihan didasarkan pada jumlah token input dan output.
Dalam mode berpikir, rantai-pikiran ditagih sebagai token output.

FAQ

Bisakah saya mengunggah gambar atau dokumen untuk mengajukan pertanyaan?

Model DeepSeek hanya mendukung input teks, bukan input gambar atau dokumen. Untuk input gambar, gunakan model Qwen-VL. Untuk input dokumen, gunakan model Qwen-Long.

Bagaimana cara melihat penggunaan token dan jumlah panggilan?

Satu jam setelah panggilan model selesai, Anda dapat membuka halaman Pemantauan Model dan mengatur kondisi kueri, seperti rentang waktu dan ruang kerja. Kemudian, di area Models, temukan model target dan klik Monitor di kolom Actions untuk melihat statistik panggilan untuk model tersebut. Untuk informasi selengkapnya, lihat dokumen Pemantauan model.
Data diperbarui setiap jam. Selama jam sibuk, pembaruan data mungkin tertunda hingga satu jam.

Kode error

Jika terjadi error selama eksekusi, lihat Kode error untuk solusinya.
Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan
DeepSeek - Alibaba Cloud Model Studio