阿里云在Qwen3.8-Flash发布一天后下调其API价格,将中国区每百万Token的输入和输出价格分别降至0.8元和2.7元,较最初的1元和3元分别下降20%和10%。新标价在输入价格上与GLM-5.3-Flash持平,输出价格则较该模型0.8元和2.8元的标价低0.1元。不过,GLM-5.3-Flash目前仍提供为期两周的发布优惠,输入和输出价格分别为0.4元和1.4元,相当于五折。另一方面,B.AI于8月27日宣布,面向编程辅助、智能体工作流和文档分析,免费开放这款开源多模态混合专家模型的官方API完整访问权限。Qwen3.8-Flash拥有1250亿总参数、510亿N-gram嵌入参数,以及每个Token激活的60亿参数;该模型首次融合GDN与QSA混合注意力机制,默认上下文长度为262,144个Token,并可通过YaRN扩展至100万个Token;其定位是Qwen4架构的开源预览版。