![]()
智東西
作者|江宇
編輯|心緣
智東西8月14日?qǐng)?bào)道,剛剛,阿里千問(wèn)正式開源Qwen3.8-27B模型權(quán)重。
Qwen3.8-27B是一款270億參數(shù)的原生多模態(tài)稠密模型,支持圖像、視頻理解,原生上下文長(zhǎng)度達(dá)到262K,并可通過(guò)YaRN擴(kuò)展至100萬(wàn)Tokens。
相比超大規(guī)模MoE模型,27B的Dense架構(gòu)部署門檻更低,量化后家用級(jí)顯卡即可運(yùn)行,更適合本地部署和輕量化應(yīng)用開發(fā)。模型采用Apache 2.0協(xié)議開放,開發(fā)者、科研機(jī)構(gòu)和企業(yè)均可免費(fèi)下載、部署及商用。
![]()
▲Qwen3.8-27B開源主頁(yè)(圖源:Hugging Face)
這是Qwen3.8系列最新開放的模型。此前,千問(wèn)已經(jīng)開放Qwen3.8-2.4T-A95B模型權(quán)重,該模型也是8月3日發(fā)布的Qwen3.8-Max所基于的Max級(jí)別底座。相比2.4萬(wàn)億總參數(shù)、950億激活參數(shù)的旗艦版本,此次開放的Qwen3.8-27B進(jìn)一步把Qwen3.8的Agent、多模態(tài)和長(zhǎng)上下文能力壓縮進(jìn)270億參數(shù)的Dense模型中,更側(cè)重本地及輕量化部署。
根據(jù)測(cè)試結(jié)果,Qwen3.8-27B在編程、長(zhǎng)周期辦公、Computer Use等任務(wù)上相比上一代Qwen3.6-27B均有明顯提升,多項(xiàng)成績(jī)超過(guò)參數(shù)規(guī)模更大的Qwen3.7-Plus;在SWE-bench Pro、OSWorld-Verified等部分基準(zhǔn)上,其成績(jī)還超過(guò)了Claude Opus 4.6 Max。
模型開源后也很快引發(fā)海外開發(fā)者關(guān)注。有網(wǎng)友評(píng)價(jià)稱,Qwen3.8-27B目前的表現(xiàn)“令人印象深刻”,尤其是在僅有270億參數(shù)的情況下,部分任務(wù)表現(xiàn)已經(jīng)超過(guò)Claude Opus 4.6 Max。
![]()
一位海外知名AI博主則將Qwen3.8-27B稱為一次“顯著躍升”。他認(rèn)為,一個(gè)值得關(guān)注的趨勢(shì)是,過(guò)去主要出現(xiàn)在前沿大模型上的Agent能力,正在進(jìn)入?yún)?shù)更小、成本更低、可以自行部署的開放模型。同時(shí)他也提醒,目前公布的Benchmark成績(jī)主要來(lái)自千問(wèn)官方測(cè)試,仍有待更多第三方獨(dú)立驗(yàn)證。
![]()
開源地址:
Hugging Face:https://huggingface.co/collections/Qwen/qwen38
魔搭社區(qū):https://www.modelscope.cn/collections/Qwen/Qwen38
千問(wèn)同時(shí)透露,Qwen3.8-27B后續(xù)還將上線官方API版本,默認(rèn)提供100萬(wàn)Tokens上下文以及官方內(nèi)置工具等生產(chǎn)級(jí)功能。
截至目前,千問(wèn)累計(jì)開源模型已超過(guò)460個(gè),Qwen系列全球下載量超過(guò)30億次,衍生模型數(shù)量超過(guò)30萬(wàn)個(gè)。
一、270億參數(shù)塞進(jìn)多模態(tài)和Agent能力,原生上下文達(dá)到262K
Qwen3.8-27B延續(xù)Qwen3.8的技術(shù)路線,是一款帶視覺編碼器的原生多模態(tài)Dense模型。模型參數(shù)量為270億,包含64層網(wǎng)絡(luò),隱藏維度為5120,并采用Gated DeltaNet與Gated Attention組合的混合結(jié)構(gòu),同時(shí)訓(xùn)練了多步Multi-Token Prediction(MTP)能力。
相比傳統(tǒng)僅處理文本的27B模型,Qwen3.8-27B原生支持圖像和視頻理解,可以處理STEM圖表、文檔、真實(shí)世界圖像以及小時(shí)級(jí)長(zhǎng)視頻等內(nèi)容。
上下文方面,模型原生支持262144 Tokens,通過(guò)YaRN技術(shù)可以進(jìn)一步擴(kuò)展至100萬(wàn)Tokens。這也意味著,27B這一相對(duì)容易部署的參數(shù)規(guī)模已經(jīng)可以同時(shí)覆蓋長(zhǎng)文檔、多模態(tài)理解以及長(zhǎng)周期Agent任務(wù)。
此次千問(wèn)還強(qiáng)化了模型的Agent執(zhí)行能力,包括自主規(guī)劃、環(huán)境反饋處理以及復(fù)雜任務(wù)的端到端執(zhí)行。
Qwen3.8-27B默認(rèn)開啟思考模式,同時(shí)加入reasoning_effort功能,可以根據(jù)任務(wù)復(fù)雜度調(diào)節(jié)推理深度。開發(fā)者也可以針對(duì)單次請(qǐng)求關(guān)閉思考模式,并通過(guò)preserve_thinking保留歷史消息中的推理上下文,在效果和推理成本之間進(jìn)行更細(xì)粒度的控制。
在部署生態(tài)上,Qwen3.8-27B已經(jīng)兼容Hugging Face Transformers、vLLM、SGLang、TokenSpeed等主流框架。
二、編程和辦公能力大漲,部分成績(jī)超過(guò)Claude Opus 4.6 Max
此次Qwen3.8-27B一個(gè)比較突出的變化,是270億參數(shù)模型的Agent能力繼續(xù)向更大模型靠近。
在SWE-bench Pro測(cè)試中,Qwen3.8-27B取得61.7分,高于Qwen3.6-27B的53.5分和Qwen3.7-Plus的57.6分,同時(shí)超過(guò)Claude Opus 4.6 Max官方成績(jī)53.4分。
在千問(wèn)自建的兩項(xiàng)評(píng)測(cè)中,Qwen3.8-27B同樣取得較明顯的領(lǐng)先優(yōu)勢(shì)。
- 軟件工程基準(zhǔn)QwenSWEBench上,Qwen3.8-27B達(dá)到79.0分,Qwen3.7-Plus為59.2分,Claude Opus 4.6 Max為63.8分。
- 面向長(zhǎng)周期辦公任務(wù)的CoWorkBench中,Qwen3.8-27B獲得70.7分,超過(guò)Qwen3.7-Plus的65.1分以及Claude Opus 4.6 Max的68.2分。
![]()
Qwen3.8-27B在Computer Use上的提升同樣明顯。
- OSWorld-Verified測(cè)試中,其成績(jī)達(dá)到84.3分,Qwen3.6-27B、Qwen3.7-Plus和Claude Opus 4.6 Max分別為63.9分、73.3分和72.7分。
- AndroidWorld手機(jī)操作測(cè)試中,Qwen3.8-27B達(dá)到81.9分,高于Qwen3.6-27B的70.3分和Claude Opus 4.6 Max的62.0分,與Qwen3.7-Plus的81.0分相比也有小幅提升。
![]()
多模態(tài)軟件工程SWE-MM測(cè)試中,Qwen3.8-27B獲得38.6分,Qwen3.7-Plus為30.0分,Claude Opus 4.6 Max為27.1分。此外,Qwen3.8-27B在競(jìng)技編程基準(zhǔn)LiveCodeBench v6上拿到90.3分,也高于Claude Opus 4.6 Max的88.8分。
不過(guò),Qwen3.8-27B并非在所有測(cè)試中都領(lǐng)先大模型。
例如Terminal Bench 2.1中,Qwen3.8-27B為73.0分,低于Claude Opus 4.6 Max的78.2分;GPQA Diamond中為89.2分,Claude Opus 4.6 Max為91.3分;HLE測(cè)試中兩者分別為30.8分和40.0分。
因此更準(zhǔn)確地說(shuō),Qwen3.8-27B已經(jīng)在軟件工程、Computer Use、長(zhǎng)周期辦公等部分Agent任務(wù)上達(dá)到甚至超過(guò)部分前沿閉源模型成績(jī),但在科學(xué)推理和高難綜合推理等測(cè)試中仍存在差距。
27B也是目前開源社區(qū)關(guān)注度較高的模型尺寸之一。相比此前開放的Qwen3.8-2.4T-A95B,Qwen3.8-27B采用Dense架構(gòu),參數(shù)規(guī)模大幅降低,部署門檻也更低。千問(wèn)將其定位為面向開發(fā)者的高效率模型,希望覆蓋本地應(yīng)用以及對(duì)推理成本、部署靈活性要求更高的Agent場(chǎng)景。
結(jié)語(yǔ):270億參數(shù),也在卷Agent了
Qwen3.8-27B比較值得關(guān)注的一點(diǎn),是Agent能力正在進(jìn)一步下沉到更容易部署的參數(shù)規(guī)模。
在270億參數(shù)下,它已經(jīng)把原生多模態(tài)、262K長(zhǎng)上下文、可控推理以及Computer Use、軟件工程、長(zhǎng)周期辦公等能力組合到同一個(gè)模型中,并在部分測(cè)試?yán)镒飞仙踔脸^(guò)更大的閉源模型。
此前Qwen3.8-2.4T-A95B開放權(quán)重,把Max級(jí)模型能力帶進(jìn)開源;如今27B版本補(bǔ)上更偏實(shí)際部署的一檔。
接下來(lái)值得期待的是,這款27B的模型進(jìn)入本地環(huán)境后,能否真正跑出足夠穩(wěn)定、足夠低成本的應(yīng)用。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.