塔斯娱乐资讯网

#DeepSeekV4视觉模型上线# 一路看着DeepSeek在文本、代码、Agent赛道不停往前冲,总觉得还差一双“眼睛”,今天这一块拼图终于补上了。 过去很多时候,我们要把截图、图表、报错界面,一点点转成文字再喂给大模型,中间耗费大量手工整理。如今V4视觉能力正式上线,不用再做繁琐的转译,直接把图片丢过 ​

DeepSeekV4视觉模型上线一路看着DeepSeek在文本、代码、Agent赛道不停往前冲,总觉得还差一双“眼睛”,今天这一块拼图终于补上了。

过去很多时候,我们要把截图、图表、报错界面,一点点转成文字再喂给大模型,中间耗费大量手工整理。如今V4视觉能力正式上线,不用再做繁琐的转译,直接把图片丢过去,看懂图表、解析代码截图、读懂界面布局,AI可以把图像也纳入完整的Agent工作流里。

更难得的是,这次没有为了视觉牺牲原本强悍的文本推理,性能基本保持原有水准,定价也延续原来Flash版本,对开发者十分友好。虽然目前还属于实验版本,仍有继续打磨的空间,但意义不言而喻:从只会读文字,到真正看得见画面,国产Agent又向前踏出关键一步。

AI的进化就像慢慢补齐感官,有了视觉,模型才算真正开始看懂真实世界。期待后续迭代,看见更多国产大模型的可能性✨。