back

要走650亿,智谱的理想越来越贵

用钱搭梯,节奏不停。

撰文丨何己派

编辑丨鄢子为

9月中旬,清华大学的一间阶梯教室,座无虚席。

来听课的学生实在太多,有些只能在过道里蹲着、站着,旁听这门“高级机器学习”课程。

课程主讲人是唐杰,清华大学计算机系教授、智谱AI创始人。他分享了些前沿判断,比如,AI未来一两年会全面接管PC操作。

来源:网络

“听得酣畅淋漓。”一位清华学生评价说。

作为智谱实际控制人之一,唐杰仍活跃在清华园的三尺讲台,他拒绝传统的高管职务,只用“首席科学家”的头衔,以便把精力集中在前沿技术上。

这位49岁的高知教授,在过去4年半,累计烧掉超100亿元,又募集了数倍于此的资金,带领智谱开启一场“摸高计划”。

这场昂贵的游戏,暂时还看不到盈利的时点。

1

重仓算力

唐杰和同事的融资动作,真的又快又密:

1月登陆港交所,募资约49亿港元;7月首轮配售,募到40亿美元;9月再次融资50亿美元。

短短8个月,他们募集了整整650亿元人民币。

9月16日,智谱管理层举行沟通会,结合刚完成的约335亿元人民币融资,给投资者讲了三件事:算力约束解除、与云厂商合作取得突破、Co-work订单超10亿元。

高管表示,新一轮融资是出于算力扩容的需要。

2026年2月,GLM-5发布后,模型调用需求量暴增10倍,几乎在发布当周,智谱算力储备就消耗殆尽,只好暂时停售主力产品Coding Plan。

他们收购中科加禾,又进行策略调整,将算力效率提升2—3倍,但缺口始终还在,收入增速也受到限制。

来源:中科加禾

“我们用了数万张国产芯片全量上线,为了保证能用,所有infra优化技术全上了。”

唐杰说,团队研发GLM-5.3-Flash时,为省算力,做了不少“抠门的事”。

最终,智谱准备两笔大额融资,填平缺口。

7月、9月,两笔融资合计募到90亿美元,用于扩大算力布局,以确保“短期内,算力供给不再是收入增长的主要约束”。

内部算了笔账:投入300亿元,大约可建设10万P算力。这些算力预留40%来做训练研发,60%用于满足业务推理需求。

主流模型基准表现对比

基于GLM-5.3的高推理性价比,理论上最高可实现80%的推理毛利。照此测算,在60%的算力利用率下,按全价计算,一年收益可达400亿元。

理想情况下,一年下来,智谱可以收回全部算力投入,还能覆盖模型训练的研发费用,不用靠下一轮融资“输血”。

“对于大模型公司的算力投入,我们同样需要坚定的Scaling。”管理层强调。

2

落地生金

要花费如此多现金,唐杰团队也在努力安抚市场。

在最新的电话会上,管理层不断释放利好,意在表明,其商业化层次更丰富,根扎得更深了。

其一,与云厂商的合作有突破,云分成落地,开源首次变成收入项。

来源:网络

“我们近期与头部云服务商签署收入分成协议,相关收入将从10月起确认。”管理层提到,智谱GLM系列模型,在海外云服务平台上,以托管API形式提供服务,按约定分享收入。

这反映出,开源模型正加速商品化。

其二,Coding(编码)范式延伸至Co-work(协同工作),提速上量。

智谱给模型能力的演进划定了一条“阶梯”:Chat、Coding、Agent、Co-work、Autonomous AI。

到Co-work这一步,模型进入真实工作流,按完成的任务计价。该阶段的门槛是,交付的工作成果,可靠性达到专业人士愿意验收的水平,而非需要推倒重做。

唐杰的同事透露,GLM-5.3发布1个月来,Co-work行业订单金额超10亿元。

网络安全是率先落地的垂直场景,已有100家安全企业将GLM模型接入其安全产品和业务流程。

如果Co-work这条路能跑通,并复制到法律、金融等领域,其按业务价值付费的属性,将有助于丰富智谱的收入结构,尽快与自身算力扩张部分脱钩。

管理层表示,有信心将智谱年末ARR(年度经常性收入)指引由24亿美元上调至30亿美元。

截至当前,其全业务口径ARR达到18亿美元。

但是,唐杰团队没有给出盈利时点的具体预测,其经营拐点将取决于ARR增长速度、模型效率提升以及基座训练投入节奏。

3

理想丰满

掌舵技术方向的唐杰,似乎有意远离财务预算这类行政事务,继续高密度输出个人判断,风格坦诚且带点“反共识”。

他判断,Chat这一仗基本打完了,AI的下一站是自我进化、自己创造继任者,称之为RSI(Recursive Self-Improvement,递归自我改进)。

17日,唐杰连同GLM团队发了一篇长文,披露智谱GLM模型研发过程中,让他们备受震动的一个时刻:AI开始取代人类,自己造自己了。

唐杰 来源:网络

他们第一次透露了RSI的工程化实践成果。

8月下旬,智谱推出原生多模态模型GLM-5.3-Flash,首周就拿下OpenRouter平台调用量第一。

这款新模型背后,由GLM-5.3驱动的Infra Agent(基础设施智能体)仅用两周,就帮GLM-5.3-Flash首次在国产加速卡上跑通,并扛下全部线上流量,端到端吞吐能力提升3.2倍。

唐杰说,优秀的工程师,脑子里有一套隐性经验:什么时候看时间线,什么时候跑微基准,该对比哪一层的输出。

现在,智谱大模型把这套经验显式化了。

原本模糊的异常现象,转化为可验证的工程假设;复杂的系统问题,被拆解为迭代过程,可观测、可实验、可归因。

由此,模型优化系统,系统承载模型。唐杰称此机制为“稠密反馈”。

相对于唐杰对技术的兴奋,眼下,投资者的热情在减退。9月以来,智谱的市值已跌掉35%,相当于损失 2000亿港元 的账面财富, 较高点已蒸发超70%。

当唐杰驱动更多资本服务其理想时,后者对回报的要价,也在暗中不断提高。

图片来源:智谱,除标注外

若您对文章内容有建议或异议,请联系编辑部。

办公电话:020 87399753