近期,通义千问正式发布了 Qwen3.8-Max:总参数 2.4 万亿的稀疏 MoE,每次推理激活 950 亿参数,百万级上下文——这是一个只有云端巨量算力数据中心才供养得起的庞然大物。8 月 12 日,Qwen3.8-Max(Qwen3.8-2.4T-A95B)的权重在 Hugging Face 与魔搭社区双平台正式开放,这是 Qwen 历史上首次将 Max 级别的旗舰权重对外开放。
但真正的变革,发生在 8 月 14 日。
这一天,Qwen 团队端出了 Qwen3.8-27B——一个 270 亿参数的稠密模型。关键词是"稠密"。与抢占头条的巨型 Qwen3.8-Max 不同,Qwen3.8-27B 是为个人真正拥有的硬件而设计的。
270 亿参数如何撬动旗舰级能力
Qwen3.8-27B 用 270 亿参数,在编码、专业工作、研究和长程智能体任务上带来全面大幅提升,整体水平优于 Qwen3.7-Plus,在多项核心基准上甚至超越了参数量级远超自身的 MoE 旗舰 Qwen3.7-Plus 和 Claude Opus 4.6 Max。它采用 Qwen3.5 架构基础上的混合注意力:64 层 Transformer,以 3:1 的比例交替排布 Gated DeltaNet 线性注意力与全注意力层,原生支持 MTP多 Token 预测投机推理,配合 W8A8 量化后模型体积压缩至约 17GB,可在消费级硬件上流畅运行。
架构创新,弥补了参数差距。
这不再是“小模型凑合用”——而是前沿模型能力真正下沉到每一张办公桌。
信创场景的答案:同泰怡华为鲲鹏全系列工作站
当数据不能出内网,当合规是底线,当"自主可控"不是口号而是验收条款——鲲鹏 + 昇腾工作站,就是 Qwen3.8-27B 在信创环境下的最佳归宿。同泰怡全系列华为鲲鹏工作站已经完成对 Qwen3.8-27B 的全面适配,通过 vLLM-Ascend 推理引擎深度优化,充分释放昇腾 NPU 的算力。鲲鹏处理器的多核并行与昇腾 NPU 的 AI 算力完美互补,全系列配置灵活覆盖不同场景需求:
双卡配置:高效运行 27B 模型,满足个人开发者与中小企业需求;四卡配置:为 70B 级模型预留充足扩展空间;
液冷方案:人位噪音低至 45dB,可直接部署于办公桌面。从个人开发者、中小企业,到大型企业、政务核心部门,均可按需选配,真正实现软硬协同、开箱即用,让 AI 应用落地更实用、更高效。
Qwen3.8-27B + 同泰怡鲲鹏工作站——前沿模型 + 国产算力,让每一张办公桌都拥有一流 AI 能力。
更多产品详情,点击链接获取:产品中心
欢迎咨询,即刻体验。