截至2026年3月,我國(guó)日均詞元調(diào)用量超過(guò)140萬(wàn)億,較2024年初增長(zhǎng)超千倍。2026年5月,國(guó)家數(shù)據(jù)局明確將詞元經(jīng)濟(jì)發(fā)展納入工作體系;6月,國(guó)家數(shù)據(jù)局印發(fā)《關(guān)于推進(jìn)行業(yè)高質(zhì)量數(shù)據(jù)集建設(shè)行動(dòng)的實(shí)施方案》,這是我國(guó)首個(gè)系統(tǒng)性部署行業(yè)高質(zhì)量數(shù)據(jù)集建設(shè)的頂層行動(dòng)綱領(lǐng),為詞元產(chǎn)業(yè)發(fā)展提供政策支撐,以詞元為核心的萬(wàn)億級(jí)智能經(jīng)濟(jì)新形態(tài)正加速孕育。

詞元經(jīng)濟(jì)的崛起,正在從根本上重構(gòu)AI算力的競(jìng)爭(zhēng)邏輯。過(guò)去兩年,行業(yè)深陷算力芯片軍備競(jìng)賽,誰(shuí)囤卡多、集群大,誰(shuí)就占先機(jī)。而詞元計(jì)費(fèi)模式使得堆硬件的邊際收益遞減,效率由此成為新戰(zhàn)場(chǎng)。這一變化,恰好釋放了國(guó)產(chǎn)AI算力生態(tài)中被長(zhǎng)期低估的差異化空間。

當(dāng)前,國(guó)內(nèi)AI算力產(chǎn)業(yè)已告別單一架構(gòu)依賴(lài),呈現(xiàn)出TPU、GPU、ASIC等多條技術(shù)路線(xiàn)并行繁榮的局面。其中,TPU憑借在張量計(jì)算密集場(chǎng)景下的能效優(yōu)勢(shì),尤其適合大規(guī)模推理與高并發(fā)詞元生成類(lèi)任務(wù),正逐步成為大模型規(guī);涞仉A段的關(guān)鍵算力選項(xiàng)。

芯片邏輯轉(zhuǎn)向:以詞元效率重構(gòu)算力標(biāo)尺

詞元經(jīng)濟(jì)的本質(zhì),是將算力消耗轉(zhuǎn)化為可計(jì)量的商業(yè)產(chǎn)出。芯片的價(jià)值不再由單卡峰值算力單一決定,而是由“單位算力能生產(chǎn)多少有效詞元”綜合衡量。中昊芯英新一代產(chǎn)品“須臾”芯片的架構(gòu)設(shè)計(jì),便是這一邏輯的直接體現(xiàn)。

2026世界人工智能大會(huì)(WAIC)期間,中昊芯英首次實(shí)物展出新一代TPU架構(gòu)AI專(zhuān)用芯片“須臾”及泰則2.0人工智能服務(wù)器。“須臾”單芯片混合精度浮點(diǎn)算力達(dá)896TFLOPS,是第一代芯片“剎那”的3倍,8-bit推理算力高達(dá)1792TOPS;單芯片額定功耗僅600W,相較于算力性能持平的傳統(tǒng)芯片功耗降低50%,搭載“須臾”的泰則2.0整機(jī)能耗僅為傳統(tǒng)GPU服務(wù)器的80%。這一能效優(yōu)勢(shì)在詞元經(jīng)濟(jì)語(yǔ)境下具有直接的商業(yè)價(jià)值:低功耗意味著更低的運(yùn)營(yíng)電費(fèi)與碳排放,直接壓低單Token的生產(chǎn)成本。

在架構(gòu)層面,“須臾”深度優(yōu)化了大模型專(zhuān)屬?gòu)埩坑?jì)算邏輯,擴(kuò)容寄存器與大容量片上緩存,針對(duì)性解決了超長(zhǎng)上下文、海量詞元交互場(chǎng)景下傳統(tǒng)算力存在的訪(fǎng)存延遲與并行效率不足等痛點(diǎn)。通過(guò)多維張量計(jì)算單元與數(shù)據(jù)復(fù)用優(yōu)化設(shè)計(jì),有效緩解了存儲(chǔ)墻難題,執(zhí)行同等AI任務(wù)時(shí)綜合計(jì)算效能可達(dá)傳統(tǒng)GPU架構(gòu)數(shù)倍。中昊芯英CEO楊龔軼凡透露,“須臾”設(shè)計(jì)目標(biāo)是大幅壓低單位Token成本,從一代到二代直接減半,后續(xù)迭代有望降到原有的1/10。

生態(tài)協(xié)同提速:從集群部署到產(chǎn)業(yè)聯(lián)通

詞元經(jīng)濟(jì)的落地,不僅需要單芯片的能效突破,更需要集群部署與產(chǎn)業(yè)協(xié)同的全鏈條支撐。

2026世界人工智能大會(huì)(WAIC)期間,中昊芯英聯(lián)合杭州電信、中興通訊官宣華東地區(qū)(杭州)首個(gè)國(guó)產(chǎn)TPU智算千卡集群(一期)項(xiàng)目落成,共部署1024片“剎那”芯片,算力規(guī)模達(dá)400P。作為中國(guó)電信體系內(nèi)首個(gè)大規(guī)模部署國(guó)產(chǎn)TPU架構(gòu)的智算集群,三方各司其職:中昊芯英提供芯片到集群的核心算力支撐;中興通訊提供全棧通信方案;杭州電信“息壤”算力平臺(tái)將集群資源利用率從30%提升至60%以上。據(jù)悉,項(xiàng)目正規(guī)劃二期擴(kuò)容至10000P,將采用新一代“須臾”芯片進(jìn)一步擴(kuò)大算力規(guī)模。

大模型訓(xùn)推是詞元生成的主要場(chǎng)景,集群資源利用率直接決定單位時(shí)間內(nèi)的有效詞元產(chǎn)出量——利用率從30%提升到60%以上,意味著不增加硬件投入的情況下,可交付的詞元數(shù)量接近翻倍,單Token綜合成本顯著下降。國(guó)產(chǎn)TPU集群在運(yùn)營(yíng)商場(chǎng)景中跑通的,正是詞元經(jīng)濟(jì)最核心的效率命題。

千卡集群落成解決了“有沒(méi)有算力”的問(wèn)題,而算力要真正轉(zhuǎn)化為詞元產(chǎn)能,還需要產(chǎn)業(yè)角色的接入與協(xié)同。在專(zhuān)題論壇上,中昊芯英完成了兩輪簽約:面向商用落地的啟航合作,與杭州電信、深圳聯(lián)通、第五要素等伙伴推進(jìn)國(guó)產(chǎn)TPU在通信、金融、互聯(lián)網(wǎng)等行業(yè)的商業(yè)化交付;聚焦生態(tài)共建的全域合作,攜手聯(lián)想、中興通訊、上海閔行聯(lián)合發(fā)展、成都工智院等力量,貫通算力基建、軟件適配到方案研發(fā)的全鏈條。

兩輪簽約指向同一個(gè)方向——讓國(guó)產(chǎn)TPU算力真正被用起來(lái),在更大規(guī)模上參與詞元的生產(chǎn)與交付。朋友圈越大,芯片越能與更多行業(yè)場(chǎng)景產(chǎn)生交集,MaaS平臺(tái)的算力供給越豐富。當(dāng)硬件底座就緒、產(chǎn)業(yè)朋友圈成形,國(guó)產(chǎn)TPU在詞元經(jīng)濟(jì)中的價(jià)值閉環(huán)才真正跑通。

結(jié)語(yǔ)

詞元計(jì)費(fèi)模式的普及,讓算力規(guī)則從“賣(mài)硬件”變?yōu)椤百u(mài)Token”,核心考核指標(biāo)變成單Token交付成本、有效產(chǎn)出效率與服務(wù)穩(wěn)定性。針對(duì)這一變化,國(guó)產(chǎn)專(zhuān)用算力正在一條不同于通用芯片的道路上加速奔跑——不是比拼單卡峰值參數(shù)的“紙面算力”,而是圍繞詞元生產(chǎn)效率構(gòu)建端到端的綜合競(jìng)爭(zhēng)力。以TPU為代表的專(zhuān)用芯片路線(xiàn),正在詞元經(jīng)濟(jì)時(shí)代迎來(lái)真正的價(jià)值驗(yàn)證周期。

編輯:郭彥偉
更多精彩資訊請(qǐng)?jiān)趹?yīng)用市場(chǎng)下載“央廣網(wǎng)”客戶(hù)端。歡迎提供新聞線(xiàn)索,24小時(shí)報(bào)料熱線(xiàn)400-800-0088;消費(fèi)者也可通過(guò)央廣網(wǎng)“啄木鳥(niǎo)消費(fèi)者投訴平臺(tái)”線(xiàn)上投訴。版權(quán)聲明:本文章版權(quán)歸屬央廣網(wǎng)所有,未經(jīng)授權(quán)不得轉(zhuǎn)載。轉(zhuǎn)載請(qǐng)聯(lián)系:cnrbanquan@cnr.cn,不尊重原創(chuàng)的行為我們將追究責(zé)任。
長(zhǎng)按二維碼
關(guān)注精彩內(nèi)容