DeepSeek Harness、第1弾製品をV4公開と同時投入の可能性

DeepSeek V4は7月中旬の目標から遅れたものの、7月下旬の公開予定を維持しており、推論、速度、エージェント機能に重点を置いたProおよびFlash版の限定的なグレーテストが進行中である。

要約

DeepSeek V4は、従来の7月中旬目標を逃した後も、7月末までの公開が引き続き見込まれており、DeepSeek-V4-ProとDeepSeek-V4-Flashの限定的なグレーテストが始まっている。今回の更新は、推論効率の向上、応答速度の高速化、エージェント機能の強化に重点を置く。これまでの報道では、DeepSeek-V4はAnthropic Opus 4.8を基準にベンチマークされ、コード生成ではOpenAI GPT-5.6 Solに匹敵するとされる一方、3Dモデリング、SVG画像生成、ミニゲーム開発でも性能を高めているとされた。DeepSeekはまた、より幅広い国内AIチップをサポートするため、V4向けにCUDA不要の適応を完了しており、プラットフォームはピーク時間帯とオフピーク時間帯で異なるAPI課金を導入し、ピーク時の料金はオフピーク時の2倍になる見通しである。別のこれまでの報道では、HarnessチームがV4公開と同時に初の製品を投入する可能性があり、コーディングエージェントが社内でClaude Codeとの比較検証を受けていたとされた。

用語解説
  • 推論効率: AIモデルが、時間や計算資源を効率的に使いながら、多段階の問題解決をどれだけ効果的に処理できるかを示す指標。
  • CUDA不要の適応: NvidiaのCUDA計算基盤に依存せずに動作するよう設計されたソフトウェア版。
  • ピーク時間帯・オフピーク時間帯のAPI課金: 利用する時間帯に応じて異なるAPI料金を課す料金体系。