短剧《青梅曾驯龙》剧情说明
2026-08-18 3452841
2026-08-18 0
近日,开源生态迎来关键突破,阿里Qwen团队正式面向全球开发者与研究者全面开放Qwen3.8-2.4T-A95B模型权重——这也是Qwen-Max级别旗舰模型首次实现开源。
作为本次开源的焦点,该模型总参数规模达2.4万亿,采用MoE稀疏架构设计,每个Token仅动态激活950亿参数;原生上下文窗口为262,144 Token(即256K),经技术增强后可扩展至1,010,000 Token。其底层延续Qwen3.5混合架构,并在编程开发、办公自动化、科研分析及长周期Agent任务等场景中完成端到端能力强化。

在多项专业基准评测中,该模型展现出强劲竞争力:在论文复现专项测试PaperBench中取得93.0分,在OSWorld-Verified(操作系统级操作能力评估)中以86.1分领跑参测模型;在参数化CAD基准中亦斩获91.5分,超越Fable 5、GPT-5.6 Sol等国际主流模型。尤为突出的是其长周期自主执行能力——可脱离人工干预,独立规划并完成跨天乃至跨周的复杂任务,如全流程代码生成与调试、科研文献理解与复现优化等。
当前,Qwen3.8-2.4T-A95B已兼容SGLang、vLLM及TokenSpeed等主流推理引擎,部署需配合各框架最新适配Recipe,并依据权重精度、GPU型号与数量灵活配置并行策略。与此同时,Unsloth AI团队通过动态1-bit分层选择性量化技术,将原始体积约4.9TB的模型压缩至397GB,存储缩减率达91%,使得设备显存+内存总量达410GB以上即可本地运行。
此次Qwen-Max级模型的开源,不仅赋予开发者模型复现、结构解析、性能调优及业务定制化微调的充分自由,更标志着中国大模型技术正深度融入全球开源AI协作体系。