阿里 Qwen 团队开放 Qwen3.8-2.4T-A95B 模型权重,该模型采用 MoE 架构,总参数规模为 2.4T,每个 Token 激活 95B 参数,并支持超长上下文。对于企业而言,这类高规格模型开放权重,值得从软件开发、企业数字化、Agent 应用和合规治理等角度持续关注。
今日技术观察 IT之家 8 月 13 日消息,阿里云“魔搭 ModelScope 社区”公众号昨天(12 日)深夜宣布,阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重。此次是 Qwen-Max 级别的模型首次开源权重:模型总参数为 2.4T,每个 Token 激活 95B 参数,原生支持 262,144 Token 上下文,并可扩展至 1,010,000 Token。Qwen3.8 延续 Qwen3.5 的混合架构,重点提 01 背景速览 阿里 Qwen 团队近日开放 Qwen3.8-2.4T-A95B 模型权重。根据公开信息,该模型属于 Qwen-Max 级别开放权重模型,总参数为 2.4T,每个 Token 激活 95B 参数,原生支持 262,144 Token 上下文,并可进一步扩展至更长上下文。模型延续混合架构设计,面向编程、办公、科研和长周期 Agent 等场景提升端到端任务完成能力。 02 趋势影响 从行业趋势看,高参数规模 MoE 模型与长上下文能力的结合,正在推动大模型从“单轮问答工具”向“复杂任务执行系统”演进。尤其是在编程 Agent、通用 Agent、专业办公和长文档处理等方向,模型不只是生成文本,还需要理解多文件、多目录、多任务环境,并在较长周期内保持任务连续性。这对软件开发流程、知识管理和企业协作工具都会产生影响。 03 企业应用启发 对企业应用而言,此类模型开放权重提供了更多技术评估空间。企业可以关注其在代码理解、研发辅助、合同或报告分析、企业知识库问答、跨文档检索与自动化办公中的适配潜力。但是否真正适合生产环境,还需要结合推理成本、部署条件、数据安全要求、业务流程复杂度以及现有系统集成能力进行验证,不能仅凭模型规模或评测结果直接下结论。 04 合规观察 在网络安全与合规层面,开放权重并不等于可以无约束使用。企业在测试或部署类似模型时,应重点关注数据输入边界、敏感信息脱敏、模型输出审查、权限控制、日志留存和第三方组件合规。长上下文能力虽然有助于处理大规模资料,但也意味着一次输入可能包含更多商业秘密、个人信息或内部文档,相关治理机制需要同步升级。 05 开放讨论 值得讨论的是:企业是否应该优先评估开放权重模型,还是继续使用云端托管模型?在开发、办公和 Agent 场景中,哪些任务最适合先做试点?长上下文能力在企业知识管理中能带来多大实际价值?当模型具备更强的跨文件、跨任务处理能力时,企业应如何重新设计权限、审计和安全策略? 公开来源参考 阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文