xAIのGrok 4.5、VulcanBenchで91.3%の最高スコア

同モデルは5つのプログラミング言語にまたがる23件のマルチファイル型コーディング課題のうち21件を解き、新ベンチマークでAnthropicのClaude Fable 5とOpenAIのGPT-5.6 Solを上回った。

要約

信頼性検証中

用語解説

このトピックには専門用語がありません。