阿里巴巴于2026年8月3日推出新一代基础大模型Qwen3.8-Max。该模型参数总量达2.4万亿,采用稀疏混合专家架构,单次推理激活参数约950亿,支持最长100万Token的上下文长度,并原生集成多模态视觉理解能力。官方表示,其在编程开发、办公协同、科研分析及长周期复杂任务等场景中的综合性能已跻身全球领先行列。
Qwen3.8-Max的模型权重将于近期正式开源,这是Max级别旗舰模型首次面向公众开放源代码。此前,该系列模型仅以闭源形式提供API服务。此次调整,反映出国内开源模型在技术成熟度与市场验证方面取得实质性突破,尤其以DeepSeek为代表的一批国产开源方案,已成功开辟出兼顾性能、成本与生态适应性的独立发展路径。开源有助于显著降低技术使用门槛,拓展国际应用范围,并提升在多云环境及多样化硬件平台上的部署灵活性;而真正决定其可持续落地的关键,在于能否有效控制推理阶段的计算开销。
目前,Qwen3.8-Max每百万输出Token的推理成本约为6美元,显著低于行业主流标杆模型的50美元水平。为实现这一优化,团队在架构层面采用稀疏混合专家结构与混合注意力机制,并依托自研AI芯片与通用处理器等硬件资源,构建起覆盖芯片、软件与系统级的协同算力体系。业内普遍认为,Qwen3.8-Max的发布,与DeepSeek等国产开源力量共同推动中国大模型在推理效率与系统架构创新方面持续领跑,正加速引导全球中小型企业在人工智能基础设施建设中向开源技术生态迁移。

评论
更多评论