昨晚,谷歌股價(jià)下跌了4.4%。原因在于Gemini旗艦?zāi)P瓦t遲未發(fā)布,而Kimi K3則直接以2.8萬億參數(shù)的規(guī)模亮相,至少?gòu)墓_表現(xiàn)來看,它已經(jīng)接近開源大模型的第一梯隊(duì)。

這一變化揭示了一個(gè)事實(shí):曾經(jīng)被神化的“秘密”開始褪色。過去人們認(rèn)為美國(guó)的大模型勝在方法論、論文和先發(fā)優(yōu)勢(shì),但現(xiàn)在中國(guó)公司也掌握了如何開發(fā)旗艦?zāi)P偷姆椒ǎA(yù)訓(xùn)練、后訓(xùn)練、優(yōu)化和系統(tǒng)編排等,這條路不再神秘,只剩下工程問題。

幾年前,情況完全不同。那時(shí)中國(guó)團(tuán)隊(duì)主要是在追趕,追求API、榜單和大廠的先發(fā)優(yōu)勢(shì)。谷歌、OpenAI、Anthropic這些名字像是高處的坐標(biāo),雖然知道方向但未必摸得到工藝。那個(gè)階段,模型像一臺(tái)巨大的黑箱機(jī)器,外面能看到效果,內(nèi)部卻看不到配方,大家都在嘗試。
隨后,競(jìng)爭(zhēng)的重點(diǎn)從誰先發(fā)表論文轉(zhuǎn)變?yōu)檎l能將模型產(chǎn)品化。這一步更為殘酷,預(yù)訓(xùn)練只是起點(diǎn),后訓(xùn)練才是關(guān)鍵。優(yōu)化器、對(duì)齊、工具調(diào)用、長(zhǎng)上下文、推理編排等每一項(xiàng)都至關(guān)重要,任何一個(gè)環(huán)節(jié)出現(xiàn)問題都會(huì)影響整體性能。GLM 5.2曾被認(rèn)為是中國(guó)最強(qiáng)大的模型,因?yàn)樗趯?shí)際任務(wù)中表現(xiàn)出色。Kimi K3的出現(xiàn)表明,國(guó)內(nèi)公司不僅滿足于模型能運(yùn)行,還追求其穩(wěn)定性和長(zhǎng)期性。
如今,大模型的競(jìng)爭(zhēng)已從技術(shù)路線轉(zhuǎn)向單體經(jīng)濟(jì)模型。誰能將訓(xùn)練成本、推理成本、吞吐效率和客單價(jià)控制在健康的范圍內(nèi),誰就能繼續(xù)發(fā)展旗艦?zāi)P汀K懔Α⑷蝿?wù)拆解能力、數(shù)據(jù)管線持續(xù)供血等是決定生死的關(guān)鍵因素。模型越大,越像一座重工業(yè)工廠,紙面參數(shù)只是招牌,真正決定利潤(rùn)的是良率、調(diào)度和產(chǎn)能利用率。




