圖搜圖工具使模型能夠根據輸入圖片從互連網搜尋視覺相似的圖片,並基於搜尋結果進行分析和推理,適用於以圖找同款、視覺內容溯源等情境。
使用方式
圖搜圖功能通過 Responses API 呼叫。您需要在 tools 參數中添加 image_search 工具,並在 input 中以多模態格式傳入圖片。
input中必須包含圖片內容,通過input_image類型傳入圖片 URL。可同時傳入input_text類型的文本,為搜尋提供補充說明。
支援的模型
推薦模型
為獲得最佳工具調用效果,推薦使用以下模型:
千問Plus:Qwen3.7-Plus系列、Qwen3.6-Plus系列、Qwen3.5-Plus系列
千問Max:Qwen3.8-Max系列、qwen3.7-max-2026-06-08
qwen3.8-27b
其他模型
以下模型也支援此工具調用,但效果不如推薦模型。
- 千問Flash:Qwen3.7-Flash系列、Qwen3.6-Flash系列、Qwen3.5-Flash系列
快速開始
運行以下代碼,通過 Responses API 呼叫圖搜圖工具,根據輸入的圖片搜尋相似或相關圖片。
需要已擷取與配置 API Key並配置API Key到環境變數。
請將範例程式碼中的 image_url 替換為可公網訪問的圖片 URL。
流式輸出
運行圖搜圖工具需要較長處理時間,建議啟用流式輸出,即時擷取中間過程輸出結果。
計費說明
計費涉及以下方面:
- 模型調用費用:圖片搜尋的結果資訊會拼接到提示詞中,增加模型的輸入 Token,按照模型的標準價格計費。價格詳情請參考百鍊控制台。
- 工具調用費用:每1000次調用收費:新加坡地區為$8,華北2(北京)地區為$6.881。
常見問題
Q:支援的圖片格式有哪些?支援哪些圖片傳入方式?
A:請參見:映像與視頻理解與檔案傳入方式。
OpenAI SDK 不支援本地路徑傳入。
Q:支援傳入幾張圖片?
A:圖片數量受模型最大輸入長度限制:圖片和文本的總 Token 數需小於模型支援的最大值。模型每次僅搜尋一張圖片,但可多次調用以處理多張。
搜尋圖片的數量由模型決策。