据PANews 8月31日报道,DeepSeek已通过Hugging Face提供DeepSeek-V4-Flash-Vision-Exp的模型权重。该多模态模型(可处理文本和图像的AI模型)基于V4-Flash架构,新增了图像理解能力,包括解读屏幕截图和图表。它还可以调用工具执行智能体任务。在Terminal Bench等纯文本智能体基准测试中,其表现与V4-Flash大致相当。此前,该模型系列仅通过应用程序接口 (API)提供,但开发者现在可以下载权重进行本地部署,并通过Transformers、vLLM或SGLang进行集成。