2026年8月12日深夜,阿里云Qwen团队通过ModelScope社区公众号宣布开源Qwen3.8-2.4T-A95B模型权重。该模型为Qwen-Max级别,总参数2.4万亿,每Token激活950亿参数,原生支持262144 Token上下文,可扩展至超百万。采用混合专家架构(512专家/层,每Token路由10个+1共享专家),并引入多步多Token预测(MTP)训练。重点优化编程、办公、科研及长周期Agent任务能力。官方云端版Qwen3.8-Max基于此权重构建,已通过PaperBench、IFBench等基准测试验证性能。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。

扫一扫关注微信