开云体育(中国)官方网站还能凯旋看图片、读PDF文档、相识图表-开yun云体育入口(官方)网站/网页版登录入口/手机版最新下载

狂喜~建设者苦等已久的Qwen3.8-27B终于开!源!了!
270亿的总参数目,在官方Benchmark多项软件工程和Agent评测中的泄露吧,几许又有点让Claude《危》了——
Agent编程评测SWE-bench Pro上,27B以8.3分的上风卷超Claude Opus 4.6 Max。
到了更磨练真确软件工程技艺的QwenSWEBench,以致起始幅度进一步扩大到15.2分:

尺寸虽小,参数设立和模子泄露配的可不孬——
原生多模态、262K原生险阻文、最高100万Token扩张,重心强化的Coding、专科职责和长程Agent技艺,也一项没落下。
好东西全球当然齐想尝鲜一番!!
这不嘛,还是有一大波网友驱动大roll特roll了。
底下这老哥用3.8-27B和3.6-27B分离作念了个像素风浮屠成果,3.8-27B在色调细节和主体结构昭彰更next level~

还有网友用Qwen3.8-27B作念的俄罗斯方块——
以致连空格键掉落时的屏幕抖动、摈斥行时出现的奖励倍增器成果也齐是模子我方添加的:
以致还有网友说:好啊好啊,那这情理是,差未几咱以后可以在腹地跑「Opus级」模子了!?
Qwen这模子,几许照旧有点说法的。。。
270亿参数,代码和Agent多项榜单卓越Opus 4.6 Max
Qwen3.8这一代,说真话最近上新速率属实有点快。。。
况且这只27B,建设者友友们其实还是蹲挺深切。
厚爱开源之前社区里的《催更》就没若何停过,也有不少东说念主凯旋把它列进这一轮Qwen3.8里最值得等的开源版块。
全球之是以这样操心,一个零散履行的原因即是——这回,自家电脑真有契机带得动了。(doge)
毕竟——总参数目就「270亿」。
换句话说,经过量化之后24GB显存的RTX 3090、4090这类显卡,齐有契机把模子整卡装下~
尺寸下来了,险阻文长度倒是少许没随着缩水,原生守旧262K Token险阻文,还可以赓续扩张到100万Token。
具体到干活场景,这一代27B重心强化的标的也很明确:
编程、专科职责、究诘以及长程Agent任务,基本齐是当今建设者最常拿模子狠狠干活的处所。
但!这里我零散想单独拎出来说一个技艺——
「原生多模态」。
需要给友友们划个重心,Qwen3.8-27B自身就带视觉相识妥协析技艺。
情理即是,它除了读笔墨、啃代码,还能凯旋看图片、读PDF文档、相识图表,以致处理视频!!!(欣慰.jpg)
尺寸够小,能往腹地塞,险阻文够长,能吃大工程,多模态和Agent技艺又齐保留了。
至于这些模范到底练到什么进度,官方榜单还是给出了一波谜底。
我们先从最稳妥拿来干活的两项看——代码和Agent。
在编程评测SWE-bench Pro里,Qwen3.8-27B比Claude Opus 4.6 Max进步8.3分;到了软件工程评测 QwenSWEBench,起始幅度进一步拉到15.2分。
Agent评测中面向计较机、金融、法律、医疗等专科长任务的CoWorkBench达到70.7分,也卓越Opus 4.6 Max的68.2的得益——
再看多模态技艺这边,模子技艺进步泄露以致更齐集。
在电脑操作评测OSWorld-Verified中,Qwen3.8-27B拿到84.3分,Opus 4.6 Max是72.7。(给到Claude一个拉!)
手机操作评测AndroidWorld中,Qwen3.8-27B达到81.9分,Opus 4.6 Max是62.0,浏览器操作WebArena-Verified,则从上一代的48.8进步到了64.8——
通用多模态智能这边,也有几项维度我们可以一齐看一下。
在视觉数常识题处分技艺上,开启CI后,Qwen3.8-27B拿到94.6分,是图里这一行可见模子中的最高得益,这类任务不仅仅识别图片里的字,还得把图形、公式、空间相干一齐相识。
在通用视觉推理方面,Qwen3.8-27B开启CI后作念到85.6分,比较不开CI时的65.7进步相当昭彰,它更偏向考模子濒临粗轻茂觉场景时,能弗成从「看见东西」进一步走到「知心趣关、作念判断」。
这得益也阐明这代27B模子在看图、读文档和视觉推理这些任务上,模子障翳的场景和性能泄露更多更强~
好东西全球当然要一试,这不嘛,各方网友大神还是驱动集体究诘「这小27B模子到底该若何跑」了。(doge)
比如底下这位友友用Qwen3.8-27B作念了一个馋嘴蛇游戏后,直言嗅觉像领有了一个Opus级别的Agent——
还有网友凯旋把Qwen3.8-27B-FP8放到一张NVIDIA GH200上实测,同期跑10个真确申请,每个最高输出16K Token、险阻文拉到262K。
鸿沟首批流式Token基本齐在10ms内复返,10个申请也全部闲居完成,高并发和长险阻文下的运行安祥性照实夯:
还有网友直言模子的多模态相识技艺也相当可以。
一次性丢给它一部1935年的11分钟电影,让模子识别其中96个带时辰戳的事件并逐字援用画面笔墨。
最终157秒完成,时辰点对应到具体画面时,整部片子的误差简略唯有2秒,况且是在单张GPU上跑完:
只可说,照旧阿谁Qwen,照旧不负众望啊。。。
从Thinking推理档位到险阻文相识,27B还有这些功能除了前边这些榜单泄露,Qwen3.8-27B此次还有一个很实用的变化。
那即是模子到底要「想多久」,我们当今可以我方手动调了,因为27B里内置了个「推理档位」——
模子默许开启Thinking格式,同期守旧reasoning_effort调遣推理深度,一共分红xhigh、medium和low三档。
复杂代码、长程Agent这类任务可以把档位拉高;节略问答、摘抄、轻量任务则可以降下来,优先换速率和老本。
此外Thinking自身也能凯旋关闭,让模子跳过推理进程凯旋复兴,真diy私东说念主定制了。
此外皮长任务这件事上,还有一个挺实用的功能——Qwen3.8-27B默许开启了preserve_thinking。
节略说,即是Agent前几轮「若何想的」可以赓续留在后头的险阻文里。
比如Coding Agent连气儿改十几个文献,作念到后头时还能沿着前边的方案赓续走,少少许每轮从头捋想路的类似劳动,同期也能更好应用KV Cache。
小小的体态,想把长任务稳稳扛住,底层架构也得下点功夫。
具体来说Qwen3.8-27B一共64层,其中48层袭取Gated DeltaNet线性贯注力,16层保留齐全Attention,基本按照「三层线性贯注力+一层齐全Attention」的节律轮回。
线性贯注力负责缩小长序列下的计较暖热存压力,齐全Attention则隔几层作念一次更充分的信辩别互。
这样带来的最大公正即是——Qwen3.8-27B原生险阻文能作念到262K Token,还可以赓续扩张到100万Token!!!
终末说一下全球一样比较关怀的问题——若何把模子跑起来。
其实,相当之节略。
官方还是给模子接上了Transformers、vLLM、SGLang和TokenSpeed。
若是是分娩环境或者需要高浑沌,Qwen更推选SGLang、vLLM这类专诚的Serving引擎。
虽然,腹地玩家则可以更省事少许儿。
Hugging Face也提供量化版块进口了,全球可以凯旋通过全球老练的器用链部署。
换句话说,手里有一张高端破费级显卡或者大内存Mac,基本还是可以驱动折腾这只27B了。(doge)
官方开源连结放底下了,感兴味的友友可以凯旋上手搓搓~
参考连结:
[1]https://mp.weixin.qq.com/s/Ttv5cMD5p6DkUQWyoOsqCA
[2]https://huggingface.co/Qwen/Qwen3.8-27B
[3]https://www.modelscope.cn/collections/Qwen/Qwen38
