撰文:創業邦
最近,有讀者發來一條智譜的公告。
用了幾個月的老套餐,要沒了。
此前那個「不限週額度」的GLM Coding Plan,將停止自動續訂,智譜給老用戶補償兩個月新套餐。
幾個月前,AI 程式設計市場還在比誰家套餐更便宜;到了現在,大家開始比另一個東西:
你到底能用多少 Token。
9月2日,智譜正式入駐天貓,開設官方旗艦店,上架GLM Coding Plan。個人版Lite月付118元、Pro月付538元、Max月付1078元,分別對應不同的積分額度;產品基於GLM-5.3,並適配ZCode、Claude Code、Codex等20餘款主流Agent。

這意味著,一件過去聽起來非常「技術」的東西,開始進入電商貨架:
AI 的使用額度,可以像手機流量一樣被直接購買。
但這裡真正值得關注的,並不是「智譜上天貓賣Token」這件事本身。
而是一個看起來有些反常識的變化:
Token 越來越便宜了,AI 公司卻開始越來越在意你用了多少 Token。
大家都開始限量了
過去幾個月,AI 行業出現了一個非常有意思的變化。
Kimi 曾因為算力壓力暫停 C 端新用戶訂閱。7月19日,月之暗面公告稱,Kimi K3 上線後請求量大幅超出預期,已經逼近現有集群承載極限,因此暫停 C 端新用戶訂閱,把算力優先留給已經付費的用戶。

阿里雲也在調整 Coding Plan。其 Lite 套餐從3月20日起停止新購,4月13日起停止續費和升級。
騰訊雲則在3月調整部分混元模型價格。其中,HY2.0 Instruct 輸入價格從每千 Token 0.0008元提高到0.004505元,漲幅超過460%。
AI 為什麼突然不再「大方」了?
過去20年,網路產品給人的最大經驗是數位化之後,邊際成本會越來越低。
手機流量就是最典型的例子。基地台、光纖和網路基礎設施建好以後,多傳1GB資料的邊際成本非常低。隨著基礎設施規模擴大,流量價格一路下降。
所以很多人自然會把這套邏輯套到 AI 上,晶片越來越強,模型越來越高效,單位 Token 的推理成本越來越低,那麼 AI 應該越來越便宜。
事實上,這個判斷的前半句完全正確。
智譜自己披露,隨著模型架構和推理基礎設施持續優化,其單位 Token 推理成本較年初下降80%。公司還稱,目前已經實現10萬級國產晶片規模化低成本推理。
問題在於,Token 便宜了,但 Token 的消耗速度增長得更快。這才是今天 AI 行業真正的矛盾。
Token 不是普通的資料流量。
一枚 Token 背後,是模型推理所消耗的計算資源,是 GPU 或 AI 加速晶片、高頻寬記憶體、網路、儲存,以及資料中心裡的電力和散熱。
Token 更像是 AI 算力被計量、被交易的一種單位。
當模型只是陪你聊天時,一次調用可能只需要幾百、幾千 Token。但當你讓 AI 替你完成一個複雜任務,它的消耗就完全不同了。
從「賣模型」到「賣調用」
智譜最新半年報,把這個變化寫在了財務資料裡。
2026年上半年,智譜實現營收9.54億元,同比增長399.7%。上半年,智譜 MaaS 開放平台及 API 業務收入達到8.25億元,同比增長2735.7%,佔總收入的86.5%。

而去年同期,這一比例只有15.2%。與此同時,本地化部署收入佔比從84.8%下降到13.5%。
一年時間,智譜的商業模式幾乎完成了一次換檔。
過去,客戶買的是模型。模型部署到企業自己的伺服器裡,進行客製化、整合和交付,一次專案往往對應一次收入。
現在,越來越多客戶直接調用雲端模型。調用一次,計一次費,用得越多,付得越多。這就是典型的 MaaS 生意。
而且,智譜這次的變化並不是簡單的「降價換規模」。恰恰相反,它出現了一個很有意思的組合:
Token 調用量較年初增長超過40倍;API 平均售價提升約101%;單位 Token 推理成本下降80%;MaaS 業務毛利率提升至24.6%。
成本在下降,收入在增長,用戶用得更多,平均售價反而還在提升。AI 商業化可能正在擺脫最初那種簡單的「價格戰」。
早期模型能力不夠強,平台只能透過低價甚至免費,把用戶吸引進來。
但當模型開始能夠真正完成程式碼生成、工具調用、持續執行等複雜任務後,用戶購買的就不再只是「一個模型」,而是模型替自己完成工作的能力。
這也是為什麼智譜管理層把商業模式概括成了一條很有意思的路徑:賣模型→賣調用→賣訂閱→賣端到端任務結果。
這四步,其實對應著 AI 商業化的四個階段。
智譜真正想賣的根本不是 Token
過去是 Chatbot 模式:你問一句,它回答一句。一次可能只需要幾百、幾千 Token。
現在是 Agent 模式:你說「幫我做一個網站」,它可能需要理解需求、搜尋資料、寫程式碼、調工具、跑測試、找 Bug、修改、再測試……一個任務可能消耗幾十萬、幾百萬甚至更多 Token。
再往後是 Multi-Agent:一個 Agent 負責規劃,一個負責搜尋,一個寫程式碼,一個測試,一個審查。Token 需求繼續膨脹。
2026年第一季,全球每週 Token 使用量暴增250%至22.7兆。OpenAI 平台 Token 調用量從2025年10月的每分鐘約60億次,飆升至2026年3月底的150億次,不足半年暴增150%。摩根士丹利報告顯示,頂尖大語言模型正經歷「非線性的能力躍升」,AI 爆炸式增長正碰上系統性的供應瓶頸。
所以真正發生的事情不是 Token 變貴了,而是每個人開始需要越來越多 Token。這可能比單純漲價更可怕。
經濟學裡有一個經典現象叫「傑文斯悖論」:
當一種資源的使用效率提高、單位成本下降之後,人們未必會減少使用,反而可能因為它變便宜了而大量增加使用。
AI 正在出現類似的情況。
Token 越便宜,大家越敢讓 AI 幹更多事情;AI 越聰明,大家又越願意把更複雜的事情交給它。
於是,Token 消耗形成了一個新的增長飛輪。
智譜上天貓賣 Token,看起來是在賣 AI 額度。但從半年報看,它真正做的是把模型能力變成可以持續計費的雲端服務。
2025年,智譜主要收入還是本地化部署;到了2026年上半年,MaaS/API 已經佔收入86.5%。公司將這一演進路徑概括為:「賣模型→賣調用→賣訂閱→賣端到端任務結果」。
智譜董事會秘書肖磊在財報電話會上直言:「相較收入增速,收入構成的切換更值得關注。」
這種切換意味著商業模式的根本變化——從一次性專案交付,變成持續性的服務收入。而定價邏輯也會隨之改變:從「每百萬 Token 多少錢」變成「完成一個任務多少錢」。智譜董事長劉德兵在電話會上表示:「單點榜單領先很快會被追平,真正重要的是誰能持續用更低成本交付更高智能。」
未來的趨勢可能是這樣的:
基礎 Token 會越來越便宜,但高級智能會越來越貴。
就像雲端運算:伺服器越來越便宜,但企業買雲端服務的錢並沒有因此消失,因為大家用得更多了。
AI也一樣。單Token價格下降≠AI使用成本下降。因為模型越強,大家讓它做的事情越複雜。從問一個問題到完成一個任務,再到管理一整套工作流程,Token消耗會不斷擴大。
智譜半年報中有一句話值得反覆咀嚼:「模型每完成一次能力躍遷,客戶購買的東西就向結果靠近一步,本公司的收入結構隨之改寫一次。」
所以未來真正值得關注的可能不是「1元能買多少Token」,而是一個人、一家公司,每個月到底消耗多少AI智能。
而智譜把Token擺上天貓,可能只是這場「AI計量經濟」走向大眾的第一步。

