百科大全

阿里千问正式发布Qwen3.8-Flash,推理成本大幅下降

来源:时代财经 时间:2026-08-26 22:28:56


(相关资料图)

本文来源:时代财经

8月26日晚,阿里巴巴发布并同步开源千问最新模型 Qwen3.8-Flash。据介绍,这是一个多模态MoE模型,主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数。它原生支持262,144token上下文,并可通过YaRN扩展至1M token。

相比于Qwen3.7-Plus,Qwen3.8-Flash显著降低了训练与推理成本,训练成本较前者下降近90%,推理成本每百万Tokens输入1元,输出3元,价格最低至DeepSeek-V4-Flash的1/3。今晚,Qwen3.8-Flash将首发上线“千问办公”。

最新资讯
热门推荐

Copyright@  2015-2022 百科大全版权所有  备案号:豫ICP备2021032478号-16   联系邮箱:363 5250 558@qq.com