塔斯娱乐资讯网

「DeepSeek 开源 V4 系列首个实验多模态模型 DeepSeek‑V4‑Flash‑Vision‑Exp」 DeepSeek 近日正式在 Hugging Face 开源DeepSeek‑V4‑Flash‑Vision‑Exp,这是 V4 系列首款实验性多模态模型,该模型此前已于 8 月 21 日上线 API 平台对外提供调用服务。模型基于 V4‑Flash 底层架构新增视觉模块, ​

「DeepSeek 开源 V4 系列首个实验多模态模型 DeepSeek‑V4‑Flash‑Vision‑Exp」

DeepSeek 近日正式在 Hugging Face 开源DeepSeek‑V4‑Flash‑Vision‑Exp,这是 V4 系列首款实验性多模态模型,该模型此前已于 8 月 21 日上线 API 平台对外提供调用服务。模型基于 V4‑Flash 底层架构新增视觉模块,完整保留原有文本、Agent 推理能力,没有出现文本性能降级,新增图片解析、图表识别、截图 OCR 等视觉理解能力,适配多模态智能体工作流。

-上下文窗口 1M Token,最大输出 384K Token;单张图片最高折算 384 Token,计费标准与 V4‑Flash 保持一致,无视觉额外加价。

-基准测试显示,多模态 Agent 能力大幅提升,综合水平接近 Opus‑4.8;开源采用 MIT 协议,公开模型权重、推理代码、Tokenizer 等全套开发物料。

官方标注该版本为Exp 实验版本,产品能力、后续迭代节奏仍存在变数,暂未公布正式版多模态模型上线时间表。