几个月前,一个叫“Ox-Alpha牛来”的大模型在匿名测试平台上突然爆火,圈内人都在猜这是哪家的神秘作品,直到身份揭晓——智谱的GLM-5.3 Flash。真正让业内炸锅的不是模型本身,而是它跑在10万张国产AI芯片上,一块NVIDIA显卡都没用。这年头,能被当成“国产替代”的标杆案例来聊,已经算是一种硬核肯定了。
智谱今天发了上市后的首份半年报,核心亮点就藏在里面:公司已经实现10万级国产芯片的规模化低成本推理,单位Token推理成本较年初下降80%。这组数字背后,是真实流量压测过的——GLM-5.3-Flash以Ox-Alpha匿名上线OpenRouter和OpenCode时,Token调用量累计62万亿,正式发布后所有线上流量仍由这10万张国产芯片承载。至于这批卡到底来自哪家厂商,智谱依然没松口。
相比算力层面的技术叙事,财务数据更接地气。上半年营收9.54亿元,同比增长399.7%,差不多是去年同期的5倍。增长主力来自开放平台和API,这块收入从2910万元飙到8.25亿元,同比暴涨2735.7%,占总收入的86.5%。API毛利率也从去年的-0.4%翻正到24.6%,原因无非三个:调用量上去了、定价调高了、推理成本压下来了。
但增速猛不代表不亏钱。上半年研发支出21.31亿元,同比增长33.6%;经调整净亏损19.64亿元,比去年同期的17.52亿元扩大了12.1%。换句话说,卖API赚来的钱,大头又砸回了研发和算力里——这种“烧钱换规模”的剧本在AI赛道并不陌生,只不过智谱选了一条更硬核的国产路线。


