阿里千问Qwen3.8大模型即将发布并开源

描述

近期,阿里云正式宣布,旗下通义千问大模型家族的最新成员——Qwen3.8即将发布,并将同步开源。这一消息迅速引发全球AI开发者社区的广泛关注。作为国内最早推动大模型开源的企业之一,阿里云此次以Qwen3.8进一步巩固其在开源大模型领域的领先地位,为全球开发者提供更强大、更开放的AI基础设施。

当前大模型开源生态正处于高速发展期,Meta的Llama系列、Mistral AI等国际开源模型持续迭代,国内开源大模型也在加速追赶。阿里云通义千问系列自开源以来,凭借出色的中文理解能力、丰富的模型尺寸选择以及活跃的社区生态,已累计获得超过百万次下载,成为全球开发者最常用的中文开源大模型之一。Qwen3.8的发布,将把开源大模型的能力上限推向新的高度。

Qwen3.8在模型架构上实现了重大升级。它采用新一代MoE(混合专家)架构,总参数量突破万亿级别,但通过稀疏激活机制,每次推理仅激活约200亿参数,在保持超强能力的同时,将推理成本控制在可接受范围内。相比上一代Qwen2.5系列,Qwen3.8在MMLU、HumanEval、GSM8K、C-Eval等多个权威评测基准中均取得了显著提升,尤其在数学推理、代码生成、长文本理解等复杂任务上,综合能力直接对标国际顶尖闭源模型,成为开源大模型领域的新标杆。

在长文本处理能力上,Qwen3.8支持最高128K Token的上下文窗口,可一次性处理数十万字的超长文档。无论是完整的小说创作、学术论文分析,还是大型代码仓库的上下文理解,都能轻松应对。模型还引入了全新的多轮记忆增强机制,可在长达数十轮的对话中保持对早期信息的准确记忆,避免大模型常见的“聊着聊着就忘了”的尴尬,让对话体验更加自然连贯。

对于开发者而言,Qwen3.8的开源意味着更低的部署门槛与更高的定制自由度。阿里云将提供从1.8B到72B的多个尺寸版本,覆盖端侧推理、云端部署、边缘计算等不同场景的需求。最小的1.8B版本可在手机、IoT设备等资源受限的终端上流畅运行,而72B版本则适合部署在云端服务器,提供顶级的推理能力。所有版本均采用Apache 2.0开源协议,开发者可自由用于商业与非商业用途,无需支付任何授权费用。

在生态兼容性层面,Qwen3.8全面兼容Hugging Face Transformers、vLLM、llama.cpp等主流推理框架,开发者无需修改现有代码即可完成模型加载与推理。同时阿里云还提供了丰富的微调工具链,支持LoRA、QLoRA等高效微调方法,开发者可在消费级GPU上完成对Qwen3.8的定制化训练,大幅降低模型微调的门槛。此外,Qwen3.8还支持函数调用、工具使用、多模态输入等高级功能,为开发者构建复杂的AI应用提供了强大的底层能力。

在安全与合规层面,Qwen3.8内置了多层内容安全过滤机制,可自动识别并过滤有害信息,同时支持开发者自定义安全策略,确保生成内容符合不同地区与行业的合规要求。模型还通过了国家算法备案,开发者可放心用于国内商业场景。

目前Qwen3.8的模型权重、技术报告与代码已进入最终测试阶段,预计将在近期正式发布并开源。届时全球开发者均可通过Hugging Face、ModelScope等平台免费下载使用。未来阿里云还将持续迭代开源大模型系列,推出更多面向不同场景的模型版本,与全球开发者共同推动AI技术的开放与进步。

打开APP阅读更多精彩内容
声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉

全部0条评论

快来发表一下你的评论吧 !

×
20
完善资料,
赚取积分