PANewsの8月31日付の報道によると、DeepSeekはDeepSeek-V4-Flash-Vision-Expの重みをHugging Faceを通じて公開した。テキストと画像を扱うマルチモーダルモデルである同モデルは、V4-Flashのアーキテクチャを基盤に画像理解機能を追加しており、スクリーンショットやチャートを解釈できる。ツールを使ってエージェントタスクを実行することも可能である。Terminal Benchなどのテキストのみを扱うエージェントベンチマークでは、性能はV4-Flashとおおむね同等だった。同モデルシリーズはこれまでAPI(Application Programming Interface)経由でのみ利用できたが、開発者は現在、重みをダウンロードしてローカルで展開し、Transformers、vLLM、SGLangを通じて統合できる。