DeepSeek、V4-Flashビジョンモデルの重みを公開しローカル展開に対応

  • DeepSeekはDeepSeek-V4-Flash-Vision-Expの重みをHugging Faceを通じて公開した。
  • 同モデルはV4-Flashのアーキテクチャにスクリーンショットとチャートの認識機能を追加した。
  • 開発者はTransformers、vLLM、SGLangを使って重みをローカルで展開できる。

PANewsの8月31日付の報道によると、DeepSeekはDeepSeek-V4-Flash-Vision-Expの重みをHugging Faceを通じて公開した。テキストと画像を扱うマルチモーダルモデルである同モデルは、V4-Flashのアーキテクチャを基盤に画像理解機能を追加しており、スクリーンショットやチャートを解釈できる。ツールを使ってエージェントタスクを実行することも可能である。Terminal Benchなどのテキストのみを扱うエージェントベンチマークでは、性能はV4-Flashとおおむね同等だった。同モデルシリーズはこれまでAPI(Application Programming Interface)経由でのみ利用できたが、開発者は現在、重みをダウンロードしてローカルで展開し、Transformers、vLLM、SGLangを通じて統合できる。

当サイトの情報はAIを用いて生成されており、正確性を保証するものではありません。 参考情報としてご活用ください。