截至2026年3月,我國日均詞元調(diào)用量超過140萬億,較2024年初增長超千倍。同年5月,國家數(shù)據(jù)局將詞元經(jīng)濟(jì)發(fā)展納入工作體系,并于6月印發(fā)《關(guān)于推進(jìn)行業(yè)高質(zhì)量數(shù)據(jù)集建設(shè)行動的實(shí)施方案》,這是我國首個系統(tǒng)性部署行業(yè)高質(zhì)量數(shù)據(jù)集建設(shè)的頂層行動綱領(lǐng),為詞元產(chǎn)業(yè)發(fā)展提供政策支撐。以詞元為核心的萬億級智能經(jīng)濟(jì)新形態(tài)正在加速形成。

詞元經(jīng)濟(jì)的崛起重構(gòu)了AI算力的競爭邏輯。過去兩年,行業(yè)深陷算力芯片軍備競賽,誰囤卡多、集群大,誰就占先機(jī)。而詞元計(jì)費(fèi)模式使得堆硬件的邊際收益遞減,效率成為新的競爭點(diǎn)。這一變化釋放了國產(chǎn)AI算力生態(tài)中被長期低估的差異化空間。
當(dāng)前,國內(nèi)AI算力產(chǎn)業(yè)已告別單一架構(gòu)依賴,呈現(xiàn)出TPU、GPU、ASIC等多條技術(shù)路線并行繁榮的局面。其中,TPU在張量計(jì)算密集場景下具有能效優(yōu)勢,尤其適合大規(guī)模推理與高并發(fā)詞元生成類任務(wù),正逐步成為大模型規(guī)模化落地階段的關(guān)鍵算力選項(xiàng)。
詞元經(jīng)濟(jì)的本質(zhì)是將算力消耗轉(zhuǎn)化為可計(jì)量的商業(yè)產(chǎn)出。芯片的價值不再由單卡峰值算力決定,而是由“單位算力能生產(chǎn)多少有效詞元”綜合衡量。中昊芯英的新一代產(chǎn)品“須臾”芯片的架構(gòu)設(shè)計(jì)體現(xiàn)了這一邏輯。在2026世界人工智能大會(WAIC)期間,中昊芯英首次實(shí)物展出新一代TPU架構(gòu)AI專用芯片“須臾”及泰則2.0人工智能服務(wù)器。“須臾”單芯片混合精度浮點(diǎn)算力達(dá)896TFLOPS,8-bit推理算力高達(dá)1792TOPS;單芯片額定功耗僅600W,相較于算力性能持平的傳統(tǒng)芯片功耗降低50%。搭載“須臾”的泰則2.0整機(jī)能耗僅為傳統(tǒng)GPU服務(wù)器的80%,這一能效優(yōu)勢直接降低了單Token的生產(chǎn)成本。




