(相关资料图)
本文来源:时代财经
8月26日晚,阿里巴巴发布并同步开源千问最新模型 Qwen3.8-Flash。据介绍,这是一个多模态MoE模型,主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数。它原生支持262,144token上下文,并可通过YaRN扩展至1M token。
相比于Qwen3.7-Plus,Qwen3.8-Flash显著降低了训练与推理成本,训练成本较前者下降近90%,推理成本每百万Tokens输入1元,输出3元,价格最低至DeepSeek-V4-Flash的1/3。今晚,Qwen3.8-Flash将首发上线“千问办公”。
Copyright@ 2015-2022 百科大全版权所有 备案号:豫ICP备2021032478号-16 联系邮箱:363 5250 558@qq.com