久操免费资源,久久伦理一区,国产又黄又爽视频,情草av网,日本久久久在线免费,精品人妻互换一区三区,熟妇女一区二区三区,亚洲AV三区视频免费,老司机在线精品

智譜正三線布局全自主國產(chǎn)AI算力體系,加速去英偉達化,應(yīng)對算力壓力,獨立大模型企業(yè)已開始向產(chǎn)業(yè)鏈上游延伸。 ## 1. 智譜三線布局全自主國產(chǎn)AI算力體系 - 底層物理算力:完成1GW級國產(chǎn)芯片數(shù)據(jù)中心建設(shè)并部分投運,躋身國內(nèi)獨立模型企業(yè)最大型算力基礎(chǔ)設(shè)施之列,可提供大規(guī)模穩(wěn)定長期算力資源池,目前智譜還運營多個萬顆芯片級計算集群。 - 中間算力軟件:斥資數(shù)億元收購源自中科院計算所的中科加禾,其核心能力覆蓋編譯器、推理引擎等,可降低大模型在不同國產(chǎn)芯片間遷移調(diào)優(yōu)成本,轉(zhuǎn)化有效算力,其SigInfer推理引擎測試中最高可降推理時延74倍。 - 上游芯片設(shè)計:正與國內(nèi)芯片設(shè)計公司接觸,評估合作開發(fā)適配GLM模型的定制AI芯片,項目處于早期階段,目標(biāo)是針對性優(yōu)化長期推理成本。 ## 2. 算力承壓倒逼上游布局 - 大模型業(yè)務(wù)增長快速推高算力需求:GLM-5的Coding Agent日調(diào)用量達數(shù)億次,GLM-5.2上線首周日均Token使用量增長27倍,同類大模型Kimi、通義千問也遭遇用戶請求量逼近集群承載極限的問題。 - 高負載直接影響用戶體驗:高并發(fā)場景下,推理系統(tǒng)的緩存、調(diào)度微小問題就會引發(fā)模型輸出異常,模型體驗不只取決于參數(shù)規(guī)模,也依賴推理系統(tǒng)性能。 ## 3. 上游布局是商業(yè)模式的必然選擇 - 大模型邊際成本隨調(diào)用量同步增長:智譜2025年收入同比增長131.9%至7.24億元,云端部署收入增長292.6%,但銷售成本同比增長213.3%至4.28億元,全年凈虧損47.18億元,成本增速明顯快于收入,計算服務(wù)費是成本增長核心原因。 - 長期依賴外部算力會制約業(yè)務(wù)擴張,自建算力可在供應(yīng)確定性、軟硬件協(xié)同、成本間獲得更優(yōu)平衡,匹配大規(guī)模調(diào)用需求。 ## 4. 產(chǎn)業(yè)與政策形成雙向推動 - 除智譜外,DeepSeek等獨立大模型企業(yè)也在布局自建算力中心、自研推理芯片,獨立模型企業(yè)正從算力購買者轉(zhuǎn)變?yōu)樗懔\營者、改造者,逐步參與定義下一代算力。 - 政策支持明確:未來五年約2萬億元的全國AI算力基礎(chǔ)設(shè)施方案有望落地,全國一體化算力網(wǎng)被列為“十五五”國家級重大工程,新建獲國家資金支持的數(shù)據(jù)中心要求僅使用國產(chǎn)AI芯片,國產(chǎn)芯片將進入成規(guī)模長期采購體系。
智譜的算力野望浮出水面,自建1GW機房、數(shù)億收購中科系Infra企業(yè)、布局自研芯片,加速去“英偉達化”
2026-07-21 12:42

智譜的算力野望浮出水面,自建1GW機房、數(shù)億收購中科系Infra企業(yè)、布局自研芯片,加速去“英偉達化”

本文來自微信公眾號: AI前線 ,作者:四月,原文標(biāo)題:《智譜的算力野望浮出水面!自建1GW機房、數(shù)億收購中科系Infra企業(yè)、布局自研芯片,加速去“英偉達化”》


被美國限制高端GPU算力多年,快速迭代的國產(chǎn)模型究竟在靠什么持續(xù)訓(xùn)練?


彭博社最新披露,智譜已經(jīng)完成一座1GW級別的數(shù)據(jù)中心建設(shè),并開始部分投入運營。該中心全部采用國產(chǎn)AI芯片,主要用于GLM系列模型研發(fā)。智譜目前還運營著多個萬卡計算集群,單個集群搭載的芯片均超過1萬顆。


1GW的供電規(guī)模,大致可以同時滿足75萬戶家庭的用電需求。以此計算,這座數(shù)據(jù)中心已經(jīng)躋身中國AI實驗室/獨立模型企業(yè)建設(shè)的最大型算力基礎(chǔ)設(shè)施之列。該消息來自一名匿名知情人士,具體芯片型號、供應(yīng)商和設(shè)備總量暫未披露,智譜方面暫未對此置評。


近期,智譜在算力上下游布局頻頻。


據(jù)多家媒體報道,智譜已斥資數(shù)億元收購國產(chǎn)異構(gòu)算力軟件公司“中科加禾”。后者源自中科院計算所編譯實驗室,核心能力覆蓋編譯器、虛擬指令集、Runtime和推理引擎。據(jù)悉,智譜已經(jīng)完成這筆收購,但截至目前,交易雙方尚未發(fā)布正式公告。



更早前,The Information披露,智譜正在與國內(nèi)芯片設(shè)計公司接觸,評估合作開發(fā)定制AI芯片的可能性。該項目仍處于早期討論階段。


結(jié)合上述消息觀察,智譜正試圖構(gòu)建一套**完全脫離英偉達體系的算力基礎(chǔ)設(shè)施:**自建1GW國產(chǎn)數(shù)據(jù)中心,解決的是穩(wěn)定的算力資源從哪里來;收購中科加禾,解決的是不同國產(chǎn)芯片如何更高效地運行GLM;自研定制AI芯片,則進一步指向按照自身模型負載,來優(yōu)化長期推理成本。


與此同時,DeepSeek也在推進類似布局,包括組建算力運營團隊支持烏蘭察布自建的算力中心,增設(shè)芯片設(shè)計人員,布局面向推理場景的自有AI芯片。


可以看到,獨立模型企業(yè)正在從算力的購買者,逐步變成算力的運營者、改造者,并試圖參與定義下一代算力。


三線并進


智譜此次曝光的三個動作,分別落在算力產(chǎn)業(yè)鏈的不同位置。


最底層是物理算力供給。


過去,獨立模型公司主要通過云廠商、運營商或第三方算力服務(wù)商獲得GPU資源。好處是前期投入較輕,可以根據(jù)模型訓(xùn)練和推理需求靈活采購;問題則是芯片供應(yīng)、集群排期、服務(wù)價格和擴容速度,始終掌握在外部平臺手中。


1GW國產(chǎn)數(shù)據(jù)中心開始部分投運,意味著智譜正在獲得更大規(guī)模、更穩(wěn)定的長期資源池。相比一次性租用幾千張卡,它更接近一套能夠持續(xù)服務(wù)模型預(yù)訓(xùn)練、后訓(xùn)練和大規(guī)模推理的基礎(chǔ)設(shè)施。


第二層是算力軟件。


國產(chǎn)芯片不是簡單地插進服務(wù)器,就能直接承接原本運行在英偉達平臺上的模型。不同廠商的芯片架構(gòu)、編程環(huán)境、算子庫、內(nèi)存管理和通信機制并不相同,同一款模型遷移到不同硬件上,往往需要重新適配和調(diào)優(yōu)。


中科加禾的核心價值,恰好位于模型和芯片之間。


公開資料顯示,其團隊曾參與龍芯、神威、寒武紀(jì)、華為昇騰等國產(chǎn)芯片的編譯器研發(fā),試圖通過虛擬指令集、編譯器和Runtime,為不同硬件提供較為統(tǒng)一的軟件接口。



當(dāng)然,這并不意味著不同品牌的芯片就可以毫無障礙地混裝在同一個大規(guī)模訓(xùn)練任務(wù)中。跨芯片協(xié)同還涉及集合通信、精度一致性、網(wǎng)絡(luò)拓撲和容錯等復(fù)雜問題。


更準(zhǔn)確地說,中科加禾希望降低同一個模型在不同國產(chǎn)芯片之間遷移、部署和性能優(yōu)化的成本,把分散在不同硬件平臺上的理論算力,盡量轉(zhuǎn)化成模型真正能夠調(diào)用的有效算力。


其SigInfer推理引擎宣稱,在特定測試場景中可將推理時延最高降低74倍、吞吐率最高提升3倍、能效比提升1.46倍。上述數(shù)字目前主要來自公司測試,尚不能直接等同于智譜生產(chǎn)環(huán)境中的實際效果,但哪怕其中一部分能夠兌現(xiàn),也會極大程度優(yōu)化智譜的Token算力成本。


第三層則是芯片設(shè)計。


與訓(xùn)練相比,推理工作負載通常更加穩(wěn)定。模型結(jié)構(gòu)、參數(shù)規(guī)模、內(nèi)存訪問方式和計算精度相對確定,因此更適合通過定制芯片進行專項優(yōu)化。


據(jù)了解,智譜目前只是評估與國內(nèi)芯片公司合作階段,暫無披露合作方、芯片架構(gòu)、流片時間和量產(chǎn)計劃。而真正值得關(guān)注的是,智譜已經(jīng)開始思考一個更上游的問題:與其讓GLM長期適應(yīng)市場上已有的芯片,能否讓未來的芯片架構(gòu)反過來適應(yīng)GLM?


算力承壓


智譜密集補齊底層算力設(shè)施能力,直接原因并不神秘:模型調(diào)用量增長得太快,基礎(chǔ)設(shè)施已經(jīng)多次接近承載上限。


今年1月,隨著GLM Coding Plan用戶快速增長,智譜宣布暫時限量銷售該產(chǎn)品,每日新增購買額度被壓縮到此前的20%。智譜當(dāng)時明確表示,部分用戶在工作日下午的調(diào)用高峰期遭遇并發(fā)限流、模型速度下降等問題,需要優(yōu)先為老用戶騰出算力資源。


到了3月,GLM-5上線后,Coding Agent每日調(diào)用量已經(jīng)達到數(shù)億次。與普通聊天相比,Coding Agent往往需要讀取更長的代碼上下文,持續(xù)生成大量Token,并反復(fù)調(diào)用搜索、執(zhí)行和調(diào)試工具,對推理系統(tǒng)的壓力高出一個量級。


壓力很快從“速度變慢”,蔓延到了模型輸出質(zhì)量。



一些用戶發(fā)現(xiàn),GLM-5在復(fù)雜任務(wù)中偶爾會出現(xiàn)亂碼、復(fù)讀和生僻字,看起來像是模型突然“變笨”。但智譜反復(fù)回放相同請求后發(fā)現(xiàn),這些異常無法穩(wěn)定復(fù)現(xiàn),模型權(quán)重本身并沒有發(fā)生變化。


經(jīng)過數(shù)周排查,問題最終被定位到高負載下的推理狀態(tài)管理。智譜在博客《Scaling Pain:超大規(guī)模Coding Agent推理實踐》中詳述了KV Cache錯配、競態(tài)沖突等成因,以及緩存分層與調(diào)度修復(fù)方案。


這次故障也暴露了一個容易被忽視的事實:模型能力不只由參數(shù)規(guī)模決定,也受模型的推理系統(tǒng)性能影響。


同一組模型權(quán)重,在低負載環(huán)境中可能輸出正常;一旦進入高并發(fā)、長上下文和長任務(wù)場景,緩存、調(diào)度和通信系統(tǒng)的細小錯誤,也能讓用戶感知到模型質(zhì)量下降。


GLM-5.2上線后,這種壓力繼續(xù)放大。The Information報道稱,該模型上線Vercel平臺首周,日均Token使用量增長27倍。與此同時,智譜還在與更多國產(chǎn)硬件平臺進行適配,以滿足持續(xù)上升的算力需求。


類似的高并發(fā)挑戰(zhàn)也發(fā)生在近期推新的Kimi和Qwen身上。



Kimi K3發(fā)布后,用戶請求量在48小時內(nèi)大幅超過預(yù)期,逼近現(xiàn)有集群的承載極限。月之暗面隨即暫停C端新用戶訂閱,將現(xiàn)有算力優(yōu)先分配給已付費用戶,并計劃隨著新增資源到位,分批恢復(fù)訂閱名額。公司還準(zhǔn)備將通用會員與Coding會員拆分,以便根據(jù)不同任務(wù)的算力消耗,更精細地分配資源。


剛剛亮相的Qwen3.8-Max總參數(shù)達到2.4萬億,多名開發(fā)者表示在Token Plan、Qoder等入口均提示訪問受限。官方解釋主要因為觸發(fā)了API平臺的并發(fā)限流(Rate Limit)或配額不足。


鏈條上探


算力壓力之所以越來越難以回避,與大模型公司的商業(yè)模式有關(guān)。


傳統(tǒng)軟件產(chǎn)品完成研發(fā)后,新增一名用戶的邊際成本通常很低。但大模型每回答一次問題,都要消耗真實的芯片、電力和內(nèi)存資源。


用戶越多,Token調(diào)用量越大,推理成本也會同步上升。模型公司收入增長,并不意味著利潤率會隨之改善。


智譜2025年的收入由3.12億元增長至7.24億元,同比增長131.9%;其中,云端API等部署收入增長292.6%,達到1.9億元。2026年第一季度,智譜的API調(diào)用量又增長約400%,公司隨后將API價格提高83%。


但另一面是,智譜2025年銷售成本由1.37億元增至4.28億元,同比增長213.3%,明顯快于收入增速。公司在財報中明確表示,成本上升主要來自業(yè)務(wù)擴張帶來的計算服務(wù)費增加。



同期,智譜研發(fā)支出達到31.8億元,全年凈虧損47.18億元,高于2024年的29.58億元。研發(fā)支出增長的原因之一,同樣是向第三方算力供應(yīng)商支付的計算服務(wù)費用增加,以及對更先進模型訓(xùn)練基礎(chǔ)設(shè)施的投入。


這也解釋了智譜為什么要向算力上游走。


如果長期完全依賴外部算力供應(yīng)商,模型公司每一次業(yè)務(wù)增長,都會同時增加采購成本,并受到資源排期和外部價格變化影響。


自建數(shù)據(jù)中心當(dāng)然不是免費的午餐。


它意味著公司需要承擔(dān)芯片采購、電力、冷卻、網(wǎng)絡(luò)、設(shè)備折舊和長期運維成本。如果模型需求低于預(yù)期,或者芯片迭代速度過快,巨額基礎(chǔ)設(shè)施也可能變成沉沒成本。


但當(dāng)模型調(diào)用量達到足夠大的規(guī)模后,自建基礎(chǔ)設(shè)施的價值便不只是“更便宜”,而是在算力供應(yīng)的確定性、軟硬件協(xié)同、成本三者之間尋求一個更大的平衡。


買算力解決的是眼前需求,控制算力決定的是模型公司未來能不能持續(xù)擴大規(guī)模。有理由相信,在智譜、DeepSeek之后將會有更多的模型獨立企業(yè)投入重點資源與資金在算力設(shè)施領(lǐng)域。


政策層面,相關(guān)補貼也正在從芯片研發(fā),進一步深入到算力項目的實際采購環(huán)節(jié)。


此前有媒體報道,獲得國家資金的新建數(shù)據(jù)中心,被要求只使用國產(chǎn)AI芯片。彭博社透露,一項未來五年約2萬億元的全國AI算力基礎(chǔ)設(shè)施方案有望落地。


當(dāng)前,算力一張網(wǎng)被納入到“十五五”開局之年的重要方向。在《“十五五”規(guī)劃綱要》中,“全國一體化算力網(wǎng)”被列為國家級重大工程,強調(diào)要深入推進東數(shù)西算工程,構(gòu)建多層次算力設(shè)施體系和全國一體化算力網(wǎng),讓算力像“水電”一樣隨取隨用,從而全面支撐人工智能與數(shù)字經(jīng)濟的高質(zhì)量發(fā)展。


這意味著國產(chǎn)芯片不再只依賴零散試點,而是將進入長期、成規(guī)模的基礎(chǔ)設(shè)施采購體系。

AI創(chuàng)投日報頻道: 前沿科技
本內(nèi)容來源于網(wǎng)絡(luò) 原文鏈接,觀點僅代表作者本人,不代表虎嗅立場。
如涉及版權(quán)問題請聯(lián)系 hezuo@huxiu.com,我們將及時核實并處理。
正在改變與想要改變世界的人,都在 虎嗅APP
惠安县| 蓝田县| 丁青县| 邛崃市| 丰台区| 武强县| 天全县| 洱源县| 应城市| 和静县| 惠安县| 盈江县| 湾仔区| 鹰潭市| 曲周县| 上栗县| 潜山县| 昌宁县| 尚志市| 马关县| 衡东县| 左权县| 哈巴河县| 吐鲁番市| 舒兰市| 板桥市| 灌云县| 高台县| 汉川市| 平泉县| 澎湖县| 甘南县| 温泉县| 泸水县| 开远市| 饶阳县| 烟台市| 安顺市| 芜湖县| 长治县| 临颍县|