国产精品色在线_精品久久久久久最新网址_亚洲综合另类小说_一区二区欧美日韩视频

 

千問智譜連夜開源,都比DeepSeek便宜,國產大模型價格猛卷-當前熱議

發布時間:2026-08-27 14:26:36  |  來源:智東西  

智東西編譯 程茜編輯 云鵬

智東西8月27日報道,昨晚,阿里千問大模型團隊開源多模態MoE模型Qwen3.8-Flash-Next,該模型是基于下一代Qwen4架構構建的先導預覽版。

Qwen3.8-Flash-Next主模型參數量為125B,額外配備51B的N-gram Embedding,每token激活6B參數,原生支持262144 token上下文,并可通過YaRN擴展至1百萬token。


【資料圖】

相比于Qwen3.7-Plus,Qwen3.8-Flash-Next降低了訓練與推理成本,訓練開銷僅約為前者的1/9,但在編程和辦公任務上性能更強,且該模型在千問團隊放出的基準測試中絕大多數都超過DeepSeek-V4-Flash正式版。

在價格方面,Qwen3.8-Flash即將上線千問AI平臺,對外提供API服務,每百萬Tokens輸入1元,輸出3元,相比空閑時段的DeepSeek-V4-Flash輸入價格低33.33%,輸出價格低33.33%。

昨晚,智譜也開源了GLM-5系列首個原生多模態模型GLM-5.3-Flash(320B-A18B),這也是此前在網上爆火的匿名模型Ox-Alpha(“牛來”模型),同樣將價格打了下來。其新模型總參數320B,在智譜自研Z.ai Code Bench體感評估中編程表現與Claude Opus 4.8相當,價格更是降到了GLM-5.3的1/10,限時折扣內為GLM-5.3的1/20,為Opus 4.8的1/40。

▲Qwen3.8-Flash-Next與DeepSeek-V4系列模型價格對比(智東西制圖)

Qwen3.8-Flash將首發上線“千問辦公”,API即將上線。

在千問AI平臺上,該模型以qwen3.8-flash的名稱提供服務,千問AI平臺支持行業標準協議,包括兼容OpenAI的Chat Completions和Responses API,以及兼容Anthropic的接口,同時Qwen API支持Anthropic API、OpenAI Responses協議,可直接配合Claude Code、Codex使用。

其博客提到,千問提前釋出結構上的改動,是為了在發布Qwen4完整模型家族之前,先讓社區對其進行檢驗。

在千問的推特評論區下方,不少海外開發者已經迫不及待想要體驗下千問的新模型了,還有網友只是一味夸贊稱“這太強了”、“我們不需要OpenAI”、“Qwen未來有可能超越Opus”。

目前,Qwen3.8-Flash-Next的模型權重在Hugging Face與ModelScope發布,默認1百萬上下文并內置官方工具的生產版本。

技術報告:https://github.com/QwenLM/Qwen3.8-Flash-Next/blob/main/tech_report.pdf

Hugging Face開源地址:https://huggingface.co/Qwen/Qwen3.8-Flash-Next

一、十余項測試超過DeepSeek?V4?Flash、Claude?Opus?4.6

Qwen3.8-Flash-Next圍繞Attention、Residual、Embedding 和 Optimization四個方面對模型進行了系統升級,在提升模型能力的同時,進一步優化了計算效率、模型容量和訓練穩定性。

▲Qwen3.8-Flash-Next模型架構

千問大模型團隊放出的基準測試結果顯示,Qwen3.8-Flash-Next在智能體、編程、通用能力以及多模態等方面絕大多數都超越了Qwen3.8?27B、Qwen3.7?Plus、DeepSeek?V4?Flash?0731、Claude?Opus?4.6(Max),拿下第一。

具體來看在純文本能力方面,Qwen3.8-Flash-Next在10項任務拿下第一,超過Qwen3.8?27B、Qwen3.7?Plus、DeepSeek?V4?Flash?0731、Claude?Opus?4.6(Max)。

其中編程能力上,Qwen3.8-Flash-Next在智能體編程DeepSWE1.1、SWE?bench Pro多語言軟件工程上拿下第一,僅在倉庫級代碼生成Repo?level code generation測試中略遜于DeepSeek。

智能體上,千問新模型在長周期辦公任務、專業工作任務、前沿智能體任務的加權部分得分、真實工具調用測試機中均拿下第一,在前沿智能體任務的一次性完全通關率上得分低于DeepSeek?V4?Flash。

通用能力上,Qwen3.8-Flash-Next在指令遵循、科學推理、競賽代碼上拿下第一,僅在多學科綜合推理能力上略弱于Claude?Opus?4.6。

多模態能力方面,該模型13項任務均超過其他三個模型拿下第一。

多模態智能體能力中,主要考驗模型是否能看懂截圖,操作手機、電腦,復現APP、網頁開發、多模態工具調用。Qwen3.8-Flash-Next在這一部分中均拿下第一。

通用多模態能力主要考察模型的看圖理解、長視頻、圖表、數學能力,Qwen3.8-Flash-Next在絕大多數測試中均超過其他三個模型,僅在不給特殊推理提示的科研圖標分析測試中,分數低于DeepSeek。

千問還放出了Qwen3.8-Flash-Next-Base在6B激活參數的情況下,與Qwen3.8-27B及Qwen3.7-Plus的base模型比較結果,其在14個benchmark中的8個上取得最優結果,其中51B的N-gram embedding參數是確定性尋址的,不進入每token的矩陣乘預算。

當前基礎模型所需的參數量不斷增加,上下文窗口長度不斷增加,核心問題已不再是究竟能把規模做到多大,而是實現規模化的效率有多高。基于此阿里千問大模型團隊進行了架構上的創新,其開源的Qwen3.8-Flash-Next,正是阿里朝這一目標邁進的階段性關鍵成果。

該模型是其基于Qwen4架構打造的實驗預覽版模型,核心是重新深度思考現代大語言模型的核心組件在大規模運行場景下如何協同工作。

二、四大架構創新,讓新模型更強更穩更劃算

Qwen3.8-Flash-Next主要包含四大創新點:

1、GDN與QSA(通義稀疏注意力)結合,實現高效記憶和精準檢索

傳統全局注意力可以直接訪問所有歷史token,但上下文越長,計算和KV Cache訪存成本越高。

其延續Qwen3.5的架構設計采用GDN+Attention的Hybrid架構:每四層中三層使用Gated DeltaNet(GDN),將歷史信息持續壓縮到固定大小的狀態中;另一層保留全局Attention,負責精確檢索全局信息。

研究人員對全局Attention進一步引入Qwen Sparse Attention(QSA),通過只關注重要上下文來減少長序列下的計算。QSA通過壓縮式輕量Indexer在micro-block(微塊)粒度上篩選重要上下文,降低長序列 Attention 開銷。這樣不僅減少了實際Attention的計算量,也降低了“尋找重要上下文”本身的上下文索引成本。

可以理解為GDN負責高效“記住”,QSA負責精準“查找”。

在1M token上,QSA的Attention Kernel在Prefill和Decode階段分別實現最高7.6倍和4.9倍的加速。在貼近線上高緩存復用場景的實驗設定下(Prefix Cache命中率為90%),Qwen3.8-Flash-Next在1M上下文下的Prefill吞吐達到Qwen3.7-Plus的8.6倍。

2、引入Gated Residual(GR,門控殘差),給信息更多傳遞路徑

傳統Transformer架構中,各層持續在同一條Residual Stream上讀寫信息,隨著網絡加深,早期特征不斷與后續信息混合,重要信息更容易被逐漸稀釋。

GR可以看作兩種思路的結合:一方面延續Hyper-Connection(超連接)將residual stream(殘差流)擴展為多分支的設計,另一方面將GatedNorm的逐元素動態門控融入residual read(殘差讀)。最終原本單一的residual stream被擴展成4條并行分支,模型可以根據當前內容動態決定從不同分支讀取多少信息,以及向不同分支寫入多少信息。

這可以把它理解為把一條信息通道擴展成多條車道:有些分支負責局部信息傳遞,有些則可以把早期信息直接保留到很深的網絡層。研究人員實際分析中也觀察到,其中一條branch(殘差分支)會自然形成連接第一層Attention和大部分中后層的長距離通道。

GR 還進一步簡化了Hyper-Connection:當read/write足夠靈活后,額外的branch mixing(分支混合)已經沒有明顯收益,因此可以直接去掉,減少訪存開銷和不穩定因素。歸一化后的Gate同時能夠有效抑制activation outlier(激活異常值)、提升訓練穩定性;Residual State(殘差狀態)支持使用FP8存儲,進一步降低訪存開銷。

3、引入N-gram Embedding,低成本擴展模型容量

研究人員受到Gemma 3n中Per-Layer Embedding(逐層嵌入)和DeepSeek Engram等工作的啟發,進一步引入N-gram Embedding,從Transformer參數之外的維度擴展模型容量。

普通Embedding根據單個token查表;N-gram Embedding則結合當前token與前幾個token組成的局部上下文進行查表,為常見短語和局部模式提供額外表示。其核心優勢是可以增加大量參數,同時幾乎不增加每個token的計算量。

Qwen3.8-Flash-Next額外引入了51B N-gram Embedding參數。由于查詢位置可以提前確定,這些參數可以存放在Host Memory中,通過異步Prefetch與模型計算重疊,無需長期占用GPU顯存。最終,模型只在前部使用一層N-gram Embedding,以較低的額外成本增加了一個大規模的“局部模式記憶庫”。

4、Optimization:優化Muon在大模型訓練中的使用方式

Qwen3.8-Flash-Next使用Muon Optimizer訓練,并圍繞三個關鍵問題進一步優化Muon在大模型訓練中的使用方式:正交化精度、Muon與AdamW的參數分工,以及融合參數矩陣的拆分。

對于真正作為二維線性映射的參數,例如Attention、GDN和MoE Expert中的主要權重,研究人員使用Muon;Embedding、MoE Router、GR低秩參數等則繼續使用AdamW。

對于工程實現中融合存儲的QKV、SwiGLU和GDN Projection,先按照實際對應的獨立線性變換進行拆分,再分別執行正交化。

針對新的模型結構和Optimizer,研究人員重新擬合了Scaling Law,結果顯示模型可以穩定使用更大的Learning Rate(學習率)和Batch Size(批次大小),進一步提升收斂效率和大規模并行訓練吞吐。

其實驗還發現,過去大模型訓練中常見的Batch Size Warmup(批次大小預熱)已經不再必要,從小Batch逐漸增加到目標Batch并沒有改善最終效果,反而需要額外執行18.8%的優化器步數。因此,在最終訓練配置中,研究人員直接從目標Batch Size開始訓練。

三、其余架構優化,繼承自Qwen3?Next的成熟架構組件

其余的架構優化沿用Qwen3-Next所確立、并在Qwen3.5–Qwen3.8系列中不斷打磨的設計:

極致稀疏MoE:在全局負載均衡下,固定激活專家數量而持續增加專家總參數量,可穩定降低訓練loss,因此Qwen3.8-Flash-Next采用較大的專家池,每token只路由少量專家,并配合一個共享專家。

Multi-Token Prediction:MTP模塊以多步方式訓練,保持訓練與推理之間的一致性,從而提升實用場景下speculative decoding(推測解碼)的接受率,同時也提升主干本身的性能,其中的全注意力層同樣被替換為QSA。

訓練穩定性:保留Zero-Centered RMSNorm并對norm weight施加weight decay、注意力輸出門控機制,以及MoE路由參數初始化的歸一化,這些設計使小規模消融結果更可靠,也有助于大規模訓練平穩進行。

結語:率先放出新架構預覽模型,千問要依托社區能力完成版本打磨

隨著企業側長文檔處理、私有化部署、Agent智能體等高價值場景規模化落地,行業對大模型的評價標準,更看重其冷輸入成本、推理帶寬開銷、硬件適配能力、訓練可復現性等工程化指標。

Qwen3.8?Flash?Next這套綜合架構改進,也證明總參數量已經不再是衡量模型能力的第一指標,激活參數量、冷prefill開銷、硬件適配能力的權重持續提升。

此外,千問率先放出下一代架構的預覽版本,真實社區的復現、二次預訓練、FP8部署、長上下文壓測,可以暴露出內部實驗難以覆蓋的問題,以便在正式版本發布時進行進一步調優。

關鍵詞: 模態 殘差 編程 大模型 智能體 千問智

 

關于我們 - 聯系我們 - 版權聲明 - 招聘信息 - 友鏈交換

2014-2020  電腦商網 版權所有. All Rights Reserved.

備案號:京ICP備2022022245號-1 未經過本站允許,請勿將本站內容傳播或復制.

聯系我們:256 8607 385@qq.com

主站蜘蛛池模板: 欧美精品久久久久久久免费| 国产精品综合网站| 国产精品一 二 三| 欧美亚洲色图视频| 日韩五码在线观看| 真实国产乱子伦对白视频| 久久综合中文色婷婷| 国产日韩精品在线| 久久精品视频在线观看| 国产日韩欧美在线观看| 欧美一区二区中文字幕| 91精品国产高清久久久久久91| 91国产美女视频| 少妇av一区二区三区无码| 国产精品日韩高清| 日韩久久在线| 欧美专区在线视频| 日韩一区二区三区高清| 69精品小视频| 91精品视频观看| 久久久欧美一区二区| 日韩av第一页| 日韩国产欧美亚洲| 日韩欧美精品久久| 激情综合在线观看| 久久精品视频中文字幕| 欧美大片va欧美在线播放| 深夜福利一区二区| 91精品国产综合久久久久久蜜臀| 国产精品视频自拍| 国产精品免费久久久久久| 国产熟女高潮视频| 久久精品视频网站| 久久精品国亚洲| 久久99精品久久久水蜜桃| 精品亚洲第一| 国产精品日韩二区| 99久久久精品视频| 亚洲永久激情精品| 日韩在线视频观看| 欧美亚洲伦理www|