PDF理解功能使模型能夠解析並理解PDF文檔,提取文檔中的文字與圖片內容進行分析。您可以通過 OpenAI 相容的 Chat Completions 介面或 DashScope 介面,以 URL 或 Base 64 編碼方式傳入 PDF 檔案。
當前 PDF 理解功能僅支援華北2(北京)地區調用,且暫不支援通過 Responses API 呼叫。使用 Responses API傳入 PDF 時,請求會返回 HTTP 200,但檔案不會傳遞給模型。
支援的模型
qwen3.8-max、qwen3.8-flash、qwen3.8-27b
快速開始
運行以下代碼,向模型傳入PDF檔案。
需要已擷取與配置 API Key並配置API Key到環境變數。
- OpenAI 相容
- DashScope
- Python
- Node.js
- HTTP
範例程式碼
使用Base64輸入
如果無法提供檔案的URL地址,也可以將PDF檔案以Base64編碼字串的形式傳入。使用 file_data 時,filename 欄位為必填項。
Base 64 編碼會使資料體積增大約 1/3,例如 150MB 的檔案編碼後約 200MB,會超出請求體大小上限。大檔案請改用 URL 方式傳入。
請求參數
檔案輸入通過content數組中的元素指定,OpenAI相容協議使用 type: "file" 類型,DashScope協議使用包含 file_url/file_data 的元素。
協議中 URL 部分僅支援字串輸入,不支援 list(數組)形式。
參數 | 類型 | 是否必填 | 說明 |
|---|---|---|---|
file_url | string | 二選一必填 | 指定PDF檔案的下載地址,和 |
file_data | string | Base64格式的PDF檔案輸入,格式為 | |
filename | string | 條件必填 | 檔案名稱,使用 |
file_format | string | 否 | 檔案格式,選擇性參數,當前僅支援 |
限制說明
專案 | 限制 |
|---|---|
單檔案大小限制 | 150MB |
單文檔頁數限制 | 500頁 |
PDF解析可能比普通文本請求耗時更長,首包逾時時間最長為300秒,建議使用流式輸出方式即時擷取結果,避免長時間等待。
計費說明
計費涉及以下方面:
- 模型調用費用:PDF檔案解析出的文字與圖片會計入模型的輸入Token,按照模型的標準輸入價格計費。
- 文檔解析費用:按PDF文檔解析的頁數計費(地區支援範圍見頁首說明),$0.00275/頁。