deepseek-v4-flash-vision-exp

deepseek-v4-flash-vision-exp

DeepSeek全新一代轻量级、高吞吐视觉大模型
2026-08-21
语言大模型
Model capability: thinkingModel capability: function_call
缓存读取:
$0.007/1M tokens
输入:
$0.22/1M tokens
输出:
$0.66/1M tokens
大额采购联系客户经理享专属优惠

API介绍

DeepSeek-V4-Flash-Vision-Exp 是DeepSeek 全新一代轻量级、高吞吐视觉大模型。作为 V4 视觉底座的 Flash 级演进版本,模型针对图像-文本联合注意力机制与端侧推理引擎进行了极致剪枝与算子优化。模型在保持极强图表结构化提炼、高密 UI 元素定位、复杂学术公式 OCR 解析及多帧视频感知的能力下,将首字延迟与生成生成吞吐量提升至全新的工业级标杆,是低成本批量处理多模态资产与实时视觉 Agent 的性价比之王。

───────────────────────────────────────────────────────────────────

核心能力

Flash 级极速响应与超高吞吐: 采用混合专家(MoE)精简架构与轻量级 Vision Tower,推理速度相比标准版提升 3 倍以上,极大降低了高并发视觉请求时的卡顿与等待耗时。

高密文本与图表精准 OCR: 继承了 DeepSeek 强悍的字符识别底座,能够精准解析高密度报表、扫描版 PDF 论文、复杂 LaTeX 算式以及微小 UI 界面元素,并能高保真直接输出结构化 JSON。

多帧视频与高分辨率感知: 支持自适应分辨率切片与多图像/连续视频帧输入。无论是一整张超宽全景图,还是多帧连续监控/动作视频,均能准确捕捉关键事件与空间关系。

极致的 API 调用性价比: 相比市场上同类型美系及国产多模态旗舰模型,V4-Flash-Vision-Exp 将输入与输出成本压缩至冰点,是企业规模化落地视觉流水线的最佳选择。

Playground

登录后,探索更多精彩功能! 点击登录

API统计

API列表 (3)

API描述接口地址请求方法稳定性参数说明
Chat(深度求索)
POST
稳定
查看详情
Chat(深度求索)
POST
稳定
查看详情
Messages(Claude Code专用)
POST
稳定
查看详情

API价格表

$
模型说明上下文官网原价302.AI价格官网价差

deepseek-chat

闲时价格
1000000

输入$0.22 / 1M tokens
输出$0.66 / 1M tokens

缓存读取$0.007 / 1M tokens
输入$0.22 / 1M tokens
输出$0.66 / 1M tokens

原价

deepseek-chat

高峰期价格 (北京时间:09:00‑12:00,14:00‑18:00)
1000000

输入$0.44 / 1M tokens
输出$1.32 / 1M tokens

缓存读取$0.014 / 1M tokens
输入$0.44 / 1M tokens
输出$1.32 / 1M tokens

原价