阿里开源Qwen3.8-27B:270亿参数原生多模态模型,家用显卡可跑,部分任务超越Claude Opus 4.6 Max

阿里千问通过Qwen3.8-27B的开源,将Agent、多模态和长上下文能力压缩至270亿参数稠密模型,标志着前沿Agent能力正从超大模型下沉至可本地部署的轻量化规模,为开发者和企业提供低成本、高灵活性的AI应用基础。
270亿
参数规模
Dense架构 · 本地可部署
262K→100万
上下文长度
YaRN扩展 · 长文档/多模态
Apache 2.0
开源协议
免费商用 · 开发者友好
技术特性:多模态与Agent能力的融合
网络结构
64层 · 隐藏维度5120
Gated DeltaNet与Gated Attention混合结构,训练多步Multi-Token Prediction
视觉编码器
原生多模态
可处理STEM图表、文档、真实世界图像及小时级长视频
思考模式
默认开启 · reasoning_effort可调
可关闭思考模式,通过preserve_thinking保留推理上下文,实现细粒度成本控制
部署生态
兼容HF Transformers / vLLM / SGLang / TokenSpeed
降低开发者集成门槛
模型延续Qwen3.8技术路线,采用Gated DeltaNet与Gated Attention混合结构,训练多步Multi-Token Prediction能力,原生支持图像和视频理解,强化Agent执行能力,包括自主规划、环境反馈处理及端到端任务执行。
性能对比:以小博大,部分任务超越闭源旗舰
各基准测试中Qwen3.8-27B与对比模型得分(数值越高越好)
SWE-bench Pro
Qwen3.8-27B
61.7
61.7
Qwen3.6-27B
53.5
53.5
Qwen3.7-Plus
57.6
57.6
Claude Opus 4.6 Max
53.4
53.4
QwenSWEBench(自建)
Qwen3.8-27B
79.0
79.0
Qwen3.7-Plus
59.2
59.2
Claude Opus 4.6 Max
63.8
63.8
CoWorkBench(长周期办公)
Qwen3.8-27B
70.7
70.7
Qwen3.7-Plus
65.1
65.1
Claude Opus 4.6 Max
68.2
68.2
OSWorld-Verified
Qwen3.8-27B
84.3
84.3
Qwen3.6-27B
63.9
63.9
Qwen3.7-Plus
73.3
73.3
Claude Opus 4.6 Max
72.7
72.7
AndroidWorld
Qwen3.8-27B
81.9
81.9
Qwen3.6-27B
70.3
70.3
Qwen3.7-Plus
81.0
81.0
Claude Opus 4.6 Max
62.0
62.0
SWE-MM(多模态软件工程)
Qwen3.8-27B
38.6
38.6
Qwen3.7-Plus
30.0
30.0
Claude Opus 4.6 Max
27.1
27.1
LiveCodeBench v6(竞技编程)
Qwen3.8-27B
90.3
90.3
Claude Opus 4.6 Max
88.8
88.8
落后领域:Terminal Bench 2.1: 73.0 vs 78.2  ·  GPQA Diamond: 89.2 vs 91.3  ·  HLE: 30.8 vs 40.0  (与Claude Opus 4.6 Max相比)
在科学推理和高难综合推理测试中仍与Claude Opus 4.6 Max存在差距
海外知名AI博主 · AI社区观察者
"Qwen3.8-27B是一次'显著跃升',过去主要出现在前沿大模型上的Agent能力,正在进入参数更小、成本更低、可以自行部署的开放模型。"
海外网友 · 开发者社区评论
"Qwen3.8-27B目前的表现'令人印象深刻',尤其是在仅有270亿参数的情况下,部分任务表现已经超过Claude Opus 4.6 Max。"
定位与影响:Agent能力下沉至轻量级部署
Qwen3.8-27B的发布标志着Agent能力正从超大参数模型向可本地部署的轻量化模型下沉,为开发者提供成本可控、部署灵活的AI方案,同时补全了从旗舰级到轻量级的开源模型矩阵。
千问开源累计 超过460个模型 · 全球下载量超30亿次 · 衍生模型超30万个
体现开源生态的广泛影响力
Qwen3.8-27B(Dense稠密)
架构 Dense(稠密)
参数规模 270亿
部署门槛 家用显卡可跑(量化后)
目标场景 本地部署 · 轻量化应用 · Agent场景
Qwen3.8-2.4T-A95B(MoE混合专家)
架构 MoE(混合专家)
参数规模 2.4万亿总参数,950亿激活
部署门槛 需要高端服务器级硬件
目标场景 云端高性能推理
后续计划: Qwen3.8-27B将上线官方API版本,默认提供100万Tokens上下文及内置工具,兼顾自部署和云服务两种使用方式。