布:2.4 萬(wàn)億參數(shù)的國(guó)產(chǎn)旗艦,Arena 榜單僅次于 Claude)
8月3日阿里巴巴正式發(fā)布新一代基座大模型Qwen3.8總參數(shù)量2.4萬(wàn)億在編程Coding和專業(yè)辦公Cowork方面能力大幅提升。發(fā)布當(dāng)天放榜的權(quán)威三方榜單Arena中阿里Qwen模型僅次于Anthropic的Claude系列整體性能處于全球大模型第一梯隊(duì)。這是繼Kimi K3之后國(guó)產(chǎn)大模型兩萬(wàn)億俱樂(lè)部迎來(lái)的又一位成員。港股阿里巴巴早盤(pán)股價(jià)持續(xù)拉升截至發(fā)稿漲近6%。資本市場(chǎng)的反應(yīng)比任何評(píng)測(cè)榜單都來(lái)得更誠(chéng)實(shí)。這篇文章按時(shí)間線拆解這場(chǎng)發(fā)布看看2.4萬(wàn)億參數(shù)背后阿里到底在下一盤(pán)什么棋。7月19日的預(yù)告半個(gè)月前就埋下的伏筆這場(chǎng)發(fā)布并不是突然發(fā)生的。7月19日下午阿里千問(wèn)大模型官方賬號(hào)發(fā)文預(yù)告Qwen3.8-Max預(yù)覽版模型首發(fā)上線阿里Token Plan、Qoder及QoderWork三個(gè)產(chǎn)品。預(yù)告里寫(xiě)得很直白Qwen3.8很快將發(fā)布并開(kāi)源新模型參數(shù)達(dá)到2.4T??赡苁浅薋able 5外最強(qiáng)大的模型。這句話在開(kāi)源社區(qū)里被反復(fù)引用因?yàn)樗苯咏o新模型定了位瞄準(zhǔn)的是全球最強(qiáng)閉源模型的席位。半個(gè)月后的8月3日正式版如約而至。從預(yù)覽版到正式版的節(jié)奏掐得比很多人的預(yù)期更緊。預(yù)覽版先給三個(gè)產(chǎn)品線用等于提前在真實(shí)流量里做了壓測(cè)。Token Plan是阿里面向API重度用戶的訂閱計(jì)劃Qoder是編程助手QoderWork是面向工作場(chǎng)景的智能體產(chǎn)品。三個(gè)產(chǎn)品覆蓋了消費(fèi)側(cè)、開(kāi)發(fā)側(cè)、辦公側(cè)三種完全不同的負(fù)載形態(tài)。用真實(shí)產(chǎn)品驗(yàn)證模型再用正式版承接全部流量這套打法在商業(yè)上相當(dāng)穩(wěn)健。2.4T參數(shù)與95B激活稀疏MoE的又一次躍遷Qwen3.8-Max是千問(wèn)系列中尺寸最大、性能最強(qiáng)的旗艦?zāi)P汀T谀P图軜?gòu)上Qwen3.8通過(guò)稀疏MoE架構(gòu)與混合注意力機(jī)制的聯(lián)合優(yōu)化首次將千問(wèn)大模型的總參數(shù)量拓展到2.4T??倕?shù)2.4T激活參數(shù)只有95B。這個(gè)數(shù)字組合意味著什么參數(shù)總量決定了模型的知識(shí)容量上限激活參數(shù)決定了單次推理的實(shí)際計(jì)算量。把2.4T參數(shù)塞進(jìn)95B的激活預(yù)算里靠的是MoE把模型拆成無(wú)數(shù)個(gè)專家子網(wǎng)絡(luò)每次推理只喚醒最相關(guān)的那一小部分。稀疏激活的本質(zhì)是用更少的計(jì)算量換取更大的知識(shí)容量?;旌献⒁饬C(jī)制的加入則讓模型在處理長(zhǎng)上下文時(shí)不再被全量注意力計(jì)算拖垮。這兩個(gè)設(shè)計(jì)的直接結(jié)果是更高的推理效率更快的推理速度以及整體性能的新突破。Qwen3.8支持視覺(jué)理解上下文長(zhǎng)度達(dá)到1M Tokens。一百萬(wàn)Token的上下文意味著模型可以一次性吞下整本技術(shù)手冊(cè)、整份代碼倉(cāng)庫(kù)的說(shuō)明文檔再開(kāi)始工作。長(zhǎng)上下文與視覺(jué)理解的組合是Agent類應(yīng)用最需要的底座能力。從架構(gòu)選擇上可以清楚看到Qwen3.8不是為聊天設(shè)計(jì)的是為執(zhí)行設(shè)計(jì)的。MoE與混合注意力的組合在業(yè)界并不新鮮但把總參數(shù)推到2.4T同時(shí)保持95B的激活量需要的工程積累遠(yuǎn)超一般團(tuán)隊(duì)的能力范圍。專家路由的負(fù)載均衡、長(zhǎng)上下文下的注意力稀疏化、多模態(tài)輸入與文本輸入的共享專家分配每一環(huán)都是硬骨頭。千問(wèn)團(tuán)隊(duì)敢把這三個(gè)難題一起做進(jìn)旗艦?zāi)P驼f(shuō)明這套架構(gòu)已經(jīng)在內(nèi)部驗(yàn)證了足夠長(zhǎng)的時(shí)間。Arena榜單僅次于Claude的國(guó)產(chǎn)旗艦發(fā)布當(dāng)天放榜的權(quán)威第三方榜單Arena中阿里Qwen模型僅次于Anthropic的Claude系列。整體性能處于全球大模型第一梯隊(duì)這個(gè)表述第一次和國(guó)產(chǎn)開(kāi)源模型放在一起顯得如此順理成章。在權(quán)威Vision Arena榜單中Qwen3.8-Max排名全球第二。視覺(jué)榜單的含金量不亞于文本榜單因?yàn)槎嗄B(tài)能力正在成為旗艦?zāi)P偷臉?biāo)配戰(zhàn)場(chǎng)。文本與視覺(jué)雙線并進(jìn)說(shuō)明這次發(fā)布不是單項(xiàng)補(bǔ)強(qiáng)而是整體換代。Arena榜單的排名來(lái)自全球用戶的匿名盲測(cè)投票不是實(shí)驗(yàn)室自報(bào)分?jǐn)?shù)。這意味著Qwen3.8在真實(shí)使用體驗(yàn)層面已經(jīng)追上了過(guò)去兩年被認(rèn)為不可逾越的差距。盲測(cè)投票的樣本來(lái)自全球開(kāi)發(fā)者、研究人員和普通用戶他們?cè)诓恢滥P蜕矸莸那闆r下對(duì)比回答質(zhì)量。這種評(píng)測(cè)方式最貼近真實(shí)使用感受也最難被刷分操縱。僅次于Claude系列這個(gè)結(jié)果等于全球用戶用腳投票投出來(lái)的結(jié)論。一串可以核對(duì)的分?jǐn)?shù)Qwen3.8在指令遵循IF Bench評(píng)測(cè)中斬獲82.8分。科學(xué)推理GPQA Diamond取得92.6分。在視覺(jué)推理BabyVision評(píng)測(cè)中Qwen3.8-Max在無(wú)工具條件下取得82.0分超出部分主流模型近兩倍。在評(píng)估智能體電腦操作能力的OSWorld-Verified評(píng)測(cè)中Qwen3.8-Max以86.1分位居主流模型首位。把這幾組數(shù)字放在一起看會(huì)更清楚Qwen3.8的側(cè)重在哪里評(píng)測(cè)項(xiàng)分?jǐn)?shù)位置IF Bench 指令遵循82.8全球前列GPQA Diamond 科學(xué)推理92.6全球前列BabyVision 視覺(jué)推理無(wú)工具82.0超出部分主流模型近兩倍OSWorld-Verified 電腦操作86.1主流模型首位Vision Arena 視覺(jué)榜單—全球第二CodeArena 編程榜單—全球第四指令遵循、科學(xué)推理、視覺(jué)推理、電腦操作、編程五個(gè)維度全部進(jìn)入全球前列。這不是單項(xiàng)冠軍而是六邊形戰(zhàn)士。尤其值得注意的是OSWorld-Verified的86.1分。這個(gè)基準(zhǔn)模擬的是模型像人一樣操作電腦的完整流程看屏幕、點(diǎn)按鈕、填表單、讀反饋。它是Agent能力最直接的度量衡之一也是從會(huì)聊天到會(huì)干活的分界線。模型在OSWorld上的分?jǐn)?shù)直接決定了它能不能勝任自動(dòng)化辦公、自動(dòng)化運(yùn)維這類高價(jià)值任務(wù)。86.1分位居首位意味著至少在電腦操作這個(gè)維度上Qwen3.8已經(jīng)是最能干的模型。如果說(shuō)兩年前的大模型比賽比的是誰(shuí)更會(huì)說(shuō)話那么現(xiàn)在比的是誰(shuí)更會(huì)辦事。OSWorld這類基準(zhǔn)的出現(xiàn)本身就是行業(yè)風(fēng)向轉(zhuǎn)變的標(biāo)志評(píng)測(cè)標(biāo)準(zhǔn)在從對(duì)話能力向執(zhí)行能力遷移。Coding從寫(xiě)好函數(shù)到交付項(xiàng)目編程能力是前沿大模型的核心能力之一Qwen3.8實(shí)現(xiàn)了自主編程的新突破。在權(quán)威CodeArena榜中Qwen3.8位居全球第四。兩年前的前沿模型能寫(xiě)好函數(shù)、補(bǔ)全代碼成為程序員的有力幫手。而如今的Qwen3.8可以從一個(gè)空文件夾出發(fā)自主完成一個(gè)十?dāng)?shù)天的真實(shí)項(xiàng)目交付全程無(wú)需人干預(yù)。注意這句話的每一個(gè)限定詞空文件夾真實(shí)項(xiàng)目十?dāng)?shù)天全程無(wú)需人干預(yù)。這不是demo級(jí)的代碼生成而是把軟件工程里的需求拆解、架構(gòu)設(shè)計(jì)、編碼實(shí)現(xiàn)、測(cè)試修復(fù)、文檔編寫(xiě)全部打包進(jìn)了一次自主執(zhí)行。編程能力的評(píng)價(jià)標(biāo)準(zhǔn)已經(jīng)變了從能不能生成代碼變成能不能把項(xiàng)目跑起來(lái)。對(duì)開(kāi)發(fā)者來(lái)說(shuō)這意味著人機(jī)協(xié)作的粒度可以進(jìn)一步下探人類負(fù)責(zé)定義目標(biāo)模型負(fù)責(zé)執(zhí)行過(guò)程。十?dāng)?shù)天的項(xiàng)目周期對(duì)應(yīng)的是真實(shí)業(yè)務(wù)系統(tǒng)的開(kāi)發(fā)量級(jí)不是玩具項(xiàng)目。從函數(shù)補(bǔ)全到項(xiàng)目交付中間跨越的是工程能力的整條鏈路。這條鏈路里最難的環(huán)節(jié)不是寫(xiě)代碼而是保持目標(biāo)一致十幾天的時(shí)間里模型需要記得最初的需求抵抗中途的各種干擾持續(xù)向最終目標(biāo)推進(jìn)。這也是為什么自主編程比代碼生成難出一個(gè)量級(jí)生成只需要局部正確交付要求全局一致。RecreationBench從零復(fù)刻一個(gè)應(yīng)用千問(wèn)團(tuán)隊(duì)構(gòu)建了一個(gè)名為RecreationBench的應(yīng)用復(fù)刻基準(zhǔn)用來(lái)測(cè)試長(zhǎng)程任務(wù)能力。在這個(gè)基準(zhǔn)里模型沒(méi)有源代碼也無(wú)法聯(lián)網(wǎng)只通過(guò)交互與反饋去理解一個(gè)應(yīng)用。結(jié)果Qwen3.8從零復(fù)刻出了整個(gè)應(yīng)用。這意味著模型已經(jīng)展現(xiàn)出前沿水準(zhǔn)的混合多模態(tài)智能體能力。它通過(guò)迭代編程—交互反饋的反復(fù)循環(huán)把視覺(jué)編程Visual Coding推向新的高度。模型先看界面再猜邏輯再動(dòng)手寫(xiě)再看反饋再改。這已經(jīng)不是一個(gè)生成器而是一個(gè)工程師。從零復(fù)刻應(yīng)用與普通代碼補(bǔ)全之間隔著整個(gè)軟件工程方法論的距離。這類長(zhǎng)程任務(wù)考驗(yàn)的是模型的記憶保持、錯(cuò)誤修正和目標(biāo)管理能力任何一環(huán)斷裂都會(huì)導(dǎo)致任務(wù)失敗。Qwen3.8能完成從零復(fù)刻說(shuō)明它的Agent能力已經(jīng)通過(guò)了最嚴(yán)格的壓力測(cè)試。這個(gè)能力放到真實(shí)世界里就是你給我描述一個(gè)系統(tǒng)我還你一個(gè)能跑的實(shí)現(xiàn)。對(duì)企業(yè)來(lái)說(shuō)這意味著很多重復(fù)性的開(kāi)發(fā)需求可以完全交給模型人力只負(fù)責(zé)驗(yàn)收和迭代。Cowork真實(shí)環(huán)境與算力聯(lián)合強(qiáng)化學(xué)習(xí)除了CodingQwen3.8的另一條主線是Cowork專業(yè)辦公能力。面對(duì)完全不同的專業(yè)任務(wù)、評(píng)判標(biāo)準(zhǔn)和計(jì)算需求Qwen3.8通過(guò)真實(shí)環(huán)境和算力的聯(lián)合強(qiáng)化學(xué)習(xí)RL擴(kuò)展實(shí)現(xiàn)了數(shù)百種高價(jià)值、高頻專業(yè)任務(wù)的真實(shí)表現(xiàn)提升。普通模型的RL訓(xùn)練是在模擬環(huán)境里打游戲Qwen3.8的RL是在真實(shí)的工作流里干活。在主流的智能體框架中Qwen3.8都可以穩(wěn)定可靠地交付生產(chǎn)級(jí)成果。這背后的訓(xùn)練成本極高但效果也極其直接模型不是在考試卷上刷分而是在工位上干活。數(shù)百種專業(yè)任務(wù)的覆蓋面意味著它不再是某一個(gè)垂直場(chǎng)景的專用模型而是可以橫跨多種工作類型的通用執(zhí)行體。聯(lián)合RL的關(guān)鍵詞是聯(lián)合環(huán)境是真實(shí)的算力是真實(shí)的反饋也是真實(shí)的。這樣的訓(xùn)練信號(hào)密度遠(yuǎn)高于任何人工標(biāo)注的合成數(shù)據(jù)。從效果上看Cowork能力決定了模型在Agent產(chǎn)品里能不能真正頂上去干活而不是只當(dāng)個(gè)問(wèn)答機(jī)器人。RL擴(kuò)展的真正價(jià)值在于把知道怎么做變成真的會(huì)做。這也是為什么阿里要把訓(xùn)練放到真實(shí)環(huán)境和算力里合成的訓(xùn)練數(shù)據(jù)可以教模型回答問(wèn)題但教不會(huì)模型處理真實(shí)世界的噪聲和不確定性。千問(wèn)辦公Agent產(chǎn)品與模型同步落地阿里今日同步推出了Agent產(chǎn)品千問(wèn)辦公Qwen3.8已經(jīng)接入其中。模型發(fā)布當(dāng)天就有配套的Agent產(chǎn)品落地這個(gè)節(jié)奏值得注意。過(guò)去的一年里各家廠商的路徑分化得很明顯有的先發(fā)模型再找場(chǎng)景有的先做產(chǎn)品再等模型。阿里選擇了第三條路模型和Agent產(chǎn)品同一天發(fā)布從第一天起就讓模型在真實(shí)辦公場(chǎng)景里跑。這符合Agent時(shí)代的競(jìng)爭(zhēng)邏輯模型能力只是起點(diǎn)誰(shuí)能更快地把能力封裝進(jìn)可用的產(chǎn)品誰(shuí)就掌握了分發(fā)入口。千問(wèn)辦公的定位是把專業(yè)辦公任務(wù)從人操作軟件變成模型操作軟件人審核結(jié)果。辦公場(chǎng)景是最適合Agent落地的戰(zhàn)場(chǎng)流程標(biāo)準(zhǔn)、反饋明確、價(jià)值可量化。模型接進(jìn)辦公產(chǎn)品意味著從第一天就有真實(shí)用戶在真實(shí)任務(wù)上打磨它。這種發(fā)布即使用的節(jié)奏和傳統(tǒng)大模型發(fā)布后等生態(tài)的模式形成了鮮明對(duì)比。阿里云生態(tài)里沉淀了海量的企業(yè)級(jí)應(yīng)用場(chǎng)景財(cái)務(wù)、人力、法務(wù)、供應(yīng)鏈、客服每個(gè)場(chǎng)景都是一座金礦。千問(wèn)辦公把這些場(chǎng)景串起來(lái)等于把Qwen3.8直接送到了最能產(chǎn)生價(jià)值的地方。這也是大模型競(jìng)爭(zhēng)從模型軍備競(jìng)賽走向場(chǎng)景落地競(jìng)賽的縮影。價(jià)格每百萬(wàn)Token輸入12元、輸出36元今日起全球開(kāi)發(fā)者都可以通過(guò)千問(wèn)AI平臺(tái)獲得Qwen3.8的API服務(wù)。國(guó)內(nèi)定價(jià)每百萬(wàn)Tokens輸入12元、輸出36元隱式緩存命中僅1.5元。國(guó)際定價(jià)同樣激進(jìn)輸入與輸出的國(guó)際價(jià)格僅為Opus5的40%與24%。把價(jià)格換算成百分比看起來(lái)會(huì)更直觀計(jì)費(fèi)項(xiàng)國(guó)內(nèi)價(jià)格每百萬(wàn)Token相對(duì)Opus5輸入12元40%輸出36元24%隱式緩存命中1.5元—相近的智能更低的成本這是開(kāi)源生態(tài)最熟悉的進(jìn)攻方式。對(duì)開(kāi)發(fā)者來(lái)說(shuō)這意味著用Opus5一個(gè)零頭的成本就能跑起一個(gè)同檔次的模型。隱式緩存命中1.5元的價(jià)格更是為Agent循環(huán)這類高重復(fù)度的調(diào)用場(chǎng)景量身定做。Agent任務(wù)里系統(tǒng)提示詞、工具定義、上下文窗口往往反復(fù)命中緩存緩存價(jià)格直接決定單次任務(wù)的總成本。把緩存打到1.5元等于給Agent開(kāi)發(fā)者發(fā)了一張長(zhǎng)期折扣券。價(jià)格戰(zhàn)的本質(zhì)是成本結(jié)構(gòu)戰(zhàn)誰(shuí)的單位算力成本更低誰(shuí)就能把價(jià)格壓得更久。阿里敢定這個(gè)價(jià)說(shuō)明它在推理側(cè)的規(guī)模效應(yīng)已經(jīng)跑通了。對(duì)獨(dú)立開(kāi)發(fā)者來(lái)說(shuō)這個(gè)價(jià)格直接改變了Agent應(yīng)用的商業(yè)模式以前跑一個(gè)復(fù)雜的Agent任務(wù)token成本可能吃掉全部利潤(rùn)現(xiàn)在可以放心地讓模型多思考、多調(diào)用工具。成本下降解放的是使用習(xí)慣而使用習(xí)慣決定生態(tài)的繁榮程度。真武M890超節(jié)點(diǎn)1.5倍的Agentic推理提升阿里真武M890超節(jié)點(diǎn)也已成功適配Qwen3.8。通過(guò)芯片、云平臺(tái)與千問(wèn)大模型的全鏈路優(yōu)化顯著提升推理效率、降低推理成本。在Agentic推理場(chǎng)景中最多可實(shí)現(xiàn)1.5倍性能提升。注意這個(gè)數(shù)字背后的含義Agent推理和普通對(duì)話推理的負(fù)載特征完全不同。Agent需要頻繁的工具調(diào)用、長(zhǎng)上下文維持、多輪狀態(tài)管理對(duì)推理系統(tǒng)的要求苛刻得多。真武M890針對(duì)這類場(chǎng)景做全鏈路優(yōu)化說(shuō)明阿里已經(jīng)預(yù)見(jiàn)到Agent將是旗艦?zāi)P偷闹鲬?zhàn)場(chǎng)。軟硬件協(xié)同優(yōu)化正在成為大模型競(jìng)爭(zhēng)的下一個(gè)分水嶺。同樣的模型在不同推理系統(tǒng)上的成本和延遲可以相差一倍以上。把芯片、云平臺(tái)和模型放在一起調(diào)優(yōu)正是阿里云相對(duì)獨(dú)立芯片廠商的獨(dú)特優(yōu)勢(shì)。芯片廠商只能優(yōu)化通用的推理路徑而阿里云可以針對(duì)Qwen3.8的MoE路由、注意力機(jī)制和工具調(diào)用模式做定制優(yōu)化。這種模型定義芯片優(yōu)化方向的做法正在成為大廠的新壁壘。對(duì)使用云服務(wù)的開(kāi)發(fā)者來(lái)說(shuō)1.5倍的性能提升意味著同樣的預(yù)算可以支撐更多的并發(fā)請(qǐng)求或者把響應(yīng)時(shí)間壓到更短。下周開(kāi)源Max與27B的雙重布局Qwen3.8-Max預(yù)計(jì)下周開(kāi)源同時(shí)還將開(kāi)源Qwen3.8-27B。一個(gè)2.4T參數(shù)的旗艦?zāi)P瓦x擇開(kāi)源這在全球范圍內(nèi)都是極具沖擊力的決定。開(kāi)源意味著任何人都可以下載權(quán)重、本地部署、微調(diào)定制。27B的小尺寸版本則覆蓋了另一類需求資源受限的邊緣場(chǎng)景、私有化部署、以及希望深度定制的中小團(tuán)隊(duì)。大模型開(kāi)源這條路從Qwen系列的第一代走到今天一直是阿里最堅(jiān)定的戰(zhàn)略。每一次發(fā)布都在把開(kāi)源模型的性能上限往上推一截。而這次上限被推到了僅次于Claude的位置。開(kāi)源與閉源的雙軌競(jìng)爭(zhēng)正在進(jìn)入白熱化階段。2.4T旗艦開(kāi)源還有一層生態(tài)意義給整個(gè)開(kāi)源社區(qū)提供了一等公民級(jí)別的底座。社區(qū)可以在它上面做微調(diào)、做蒸餾、做垂直模型整個(gè)開(kāi)源生態(tài)的起點(diǎn)都會(huì)被抬高。這也是為什么開(kāi)源圈把這次發(fā)布稱為分水嶺時(shí)刻。不過(guò)也要提醒一句2.4T的權(quán)重下載和部署門檻不低需要多卡集群才能跑起來(lái)普通開(kāi)發(fā)者更現(xiàn)實(shí)的路徑是用API或者等27B版本。阿里同時(shí)開(kāi)源兩個(gè)尺寸正是為了讓不同資源條件的開(kāi)發(fā)者都能上車。開(kāi)發(fā)者的第一行代碼對(duì)開(kāi)發(fā)者來(lái)說(shuō)Qwen3.8接入應(yīng)用的方式和OpenAI兼容接口保持一致。如果你已經(jīng)在用OpenAI的SDK那么切換到Qwen3.8只需要改兩個(gè)參數(shù)。下面是調(diào)用Qwen3.8 API的真實(shí)示例可以直接運(yùn)行from openai import OpenAI client OpenAI( api_key你的千問(wèn)API密鑰, base_urlhttps://dashscope.aliyuncs.com/compatible-mode/v1, ) response client.chat.completions.create( modelqwen3.8-max, messages[ {role: system, content: 你是一名資深后端工程師。}, {role: user, content: 設(shè)計(jì)一個(gè)訂單系統(tǒng)的冪等接口說(shuō)明關(guān)鍵設(shè)計(jì)點(diǎn)。}, ], max_tokens2048, temperature0.7, ) print(response.choices[0].message.content)這段代碼里base_url指向阿里云DashScope的OpenAI兼容模式model參數(shù)填qwen3.8-max。其余的部分和調(diào)用任何OpenAI兼容接口沒(méi)有任何區(qū)別。Agent場(chǎng)景下的調(diào)用方式也很直接工具調(diào)用function calling沿用OpenAI的格式。模型返回tool_calls字段你的Agent循環(huán)解析后執(zhí)行工具再把結(jié)果傳回給模型。從對(duì)話到工具調(diào)用從單輪到多輪遷移成本被壓到了最低。這正是開(kāi)源旗艦?zāi)P蜕鷳B(tài)的威力接口標(biāo)準(zhǔn)統(tǒng)一切換成本趨近于零。對(duì)于已經(jīng)在生產(chǎn)環(huán)境跑著Agent服務(wù)的團(tuán)隊(duì)這意味著一次改配置就能完成模型升級(jí)。唯一需要評(píng)估的是數(shù)據(jù)合規(guī)和網(wǎng)絡(luò)鏈路其余全部無(wú)縫銜接。對(duì)于已經(jīng)有OpenAI遷移經(jīng)驗(yàn)的團(tuán)隊(duì)這個(gè)過(guò)程可能只需要一個(gè)下午。遷移成本越低新模型被采用的速度就越快這是大模型市場(chǎng)最樸素的規(guī)律。兩萬(wàn)億俱樂(lè)部的攻守轉(zhuǎn)換Qwen3.8的發(fā)布把國(guó)產(chǎn)大模型的競(jìng)爭(zhēng)帶進(jìn)了新階段。Kimi K3的2.8萬(wàn)億參數(shù)、Qwen3.8的2.4萬(wàn)億參數(shù)兩萬(wàn)億俱樂(lè)部里已經(jīng)站著兩家。更重要的是這兩家的路線形成了有趣的對(duì)照一家在閉源與開(kāi)源的邊界上游走一家把旗艦?zāi)P蛷氐组_(kāi)源。開(kāi)源模型的性能天花板每被抬高一寸閉源廠商的定價(jià)權(quán)就被削弱一分。阿里選擇在這個(gè)時(shí)間點(diǎn)把2.4T參數(shù)的旗艦開(kāi)源等于在告訴市場(chǎng)最強(qiáng)的模型不一定要藏起來(lái)賣。從行業(yè)格局看這次發(fā)布有三個(gè)層面的影響。第一層是價(jià)格錨點(diǎn)12元輸入、36元輸出、1.5元緩存的定價(jià)會(huì)把同檔模型的全球定價(jià)再往下拉一截。第二層是開(kāi)源天花板2.4T旗艦開(kāi)源后閉源模型的差異化空間被進(jìn)一步壓縮競(jìng)爭(zhēng)焦點(diǎn)被迫轉(zhuǎn)向產(chǎn)品、服務(wù)和生態(tài)。第三層是Agent賽道千問(wèn)辦公同步落地OSWorld 86.1分意味著Agent應(yīng)用有了更便宜的國(guó)產(chǎn)底座。對(duì)開(kāi)發(fā)者來(lái)說(shuō)這是最好的時(shí)代全球第二梯隊(duì)的性能開(kāi)源權(quán)重1.5元的緩存命中價(jià)格下周就能拿到手。剩下的問(wèn)題只有一個(gè)你打算拿它做什么。