Qwen3.8-27B开源即用!昇腾0Day适配:270亿参数推理效率拉满
最新8月15日消息,阿里巴巴旗下千问大模型团队于8月14日晚间正式开源Qwen3.8-27B模型。昇腾在模型开源后同步完成0Day适配,通过vLLM-Ascend开源推理引擎实现Qwen3.8-27B在Atlas 800 A3、Atlas 850E超节点上的高效推理部署。
Qwen3.8-27B是一款原生多模态稠密(Dense)模型,参数量270亿。模型原生支持262K tokens上下文长度,通过YaRN技术可外推至1M tokens。
在架构上,Qwen3.8-27B采用混合线性注意力设计,64层中48层为Gated DeltaNet线性注意力、16层为Full Attention。这种设计打破了长序列下O(n²)的计算复杂度,兼顾了长序列处理效率与上下文建模能力。
在性能表现上,Qwen3.8-27B在编程和办公场景中显著超越前代Qwen3.6-27B,整体水平优于Qwen3.7-Plus。
该模型在Agentic terminal coding测试中得分73.0(前代63.4),在SWE-bench Pro测试中得分61.7(前代53.5)。模型新增了reasoning_effort功能,可根据任务难度动态调节思考深度以节省计算资源。
针对Qwen3.8-27B的结构特点,昇腾采用多项关键技术进行优化。在Prefill阶段采用GDN融合算子,以Chunk方式高效处理长序列,减少中间数据搬运和算子调度开销。
vLLM-Ascend支持W8A8量化部署,将权重与激活值从BF16量化至8-bit,充分发挥昇腾NPU的INT8/MXFP8算力。
同时利用Qwen3.8的MTP投机推理能力,通过MTP模块预测后续Token、主模型并行校验,减少主模型调用次数。Decode阶段支持将计算捕获为设备侧执行图(ACLGraph),消除重复调度开销。
目前Qwen3.8-27B已在Hugging Face和魔搭社区(ModelScope)同步上线。昇腾已提供基于该模型的部署指导,用户可通过vLLM-Ascend开源推理引擎快速完成推理部署。

《Qwen3.8-27B开源即用!昇腾0Day适配:270亿参数推理效率拉满》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
全球NAND市场洗牌!长江存储首次冲上第三:但挣钱却只排第五
快科技8月13日消息,市场调研机构Counterpoint Research公布了2026年第二季度全球NAND市场数据。三星以25%的出货容量份额稳居第一,但较2024年同期的32%明显下滑,SK海力士集团以22%排名第二,... -
净利同比暴涨34倍!群联CEO:NAND还会更紧缺、更贵
快科技8月14日消息,群联电子8月13日公布2026年第二季度财报,营收和获利双双创下历史单季新高,Q2合并营收达678.88亿新台币,环比增长65.7%,同比暴涨279.5%。毛利率攀升至65.3%,同比大增36... -
SK海力士SSD发生故障 网友吐槽:故障产品不予换新 仅原价退款
快科技8月16日消息,据媒体报道,近日有Reddit用户反映,其使用的SK海力士SSD出现故障,遂向厂商申请保修换新。然而,SK海力士回应称,该型号已无库存可供更换,仅同意按用户当初的购买价格进... -
44.3万块硬盘12年追踪:四大品牌故障率出炉!最可靠品牌已成绝唱
快科技8月16日消息,埃塞克斯大学Christoph Siemroth和成均馆大学Yeomyungung Park在IEEE发表了一篇同行评审论文,重新分析了Backblaze公开的12年硬盘运行数据。研究覆盖443156块硬盘,累计运... -
全球存储芯片供应趋紧:内存长协议逐步向二三线厂商扩散
快科技8月12日消息,全球存储芯片供应紧张态势持续升级,长期供应协议(LTA)的覆盖范围已从三星、SK海力士与美光三大原厂,快速延展至闪迪及中国长鑫存储。据Digital Daily此前报道,苹果公司...












