Kimi K3位列AA-Briefcase基准第二,评分达1543 Elo

Artificial Analysis表示,该模型以1574分落后于Claude Fable 5,但以1501分领先GPT-5.6 Sol,并且在使用更多tokens的情况下,56.4分钟内每项任务平均成本为$10.57。

摘要

正在验证可靠性

术语与概念

此主题没有可用的专业术语。