跳到正文
@deepseek_ai· @deepseek_ai · X·· 2026-08-21AI 评分62
AI 导读

DeepSeek 在 API 中新增多模态支持,开发者可将 model 设为 deepseek-v4-flash-vision-exp 调用图像输入。图像按 token 计费,每张最多 384 token,沿用 V4-Flash 定价,并支持 Chat Completions、Messages 和 Responses 接口。图像可通过 base64、外部 URL 或 Files API 传入,同时支持文本与图像混合输入。

正文

Multimodal API support 🔌

🔹 Set model='deepseek-v4-flash-vision-exp'
🔹 Images are tokenized for billing: up to 384 tokens each, at V4-Flash pricing
🔹 Supports Chat Completions, Messages & Responses
🔹 Supports mixed text + image input; images can be provided via base64, external URLs, or the Files API.

Docs: https://t.co/USZ5gZ3wWB

3/n

来源:@deepseek_ai · x.com