智谱又开始募资了。
最近,从DeepSeek到Kimi再到智谱,大模型战场硝烟四起。Kimi正在谋求上市,DeepSeek开始把注意力放在上游的算力基础设施,已经上市的智谱则再次从资本市场拿钱。海外,OpenAI和Anthropic也在奔向IPO。
这些多重信号都在说明一个问题,虽然现在留在牌桌上的公司少了,但这场战争变得激烈了。
9月11日,据路透报道,智谱启动新一轮融资,包括约20亿美元的股票配售,以及30亿美元的可转换债券发行,总规模达到50亿美元,折合人民币超过350亿元。
距离智谱上一次从资本市场拿钱,只过去两个月。今年7月,智谱刚刚通过配售募集约40亿美元。再往前,今年1月,智谱登陆港交所。从上市到两次再融资,智谱从资本市场募集资金的速度明显加快。
钱主要流向了同一个地方。
根据此次披露,智谱募集资金将用于研发、算力资源及相关基础设施、业务扩张、战略投资和潜在并购等。今年7月的40亿美元融资中,算力、研发和人才同样是主要用途。
一家已经上市的大模型公司,仍然在如此密集地从资本市场拿钱。这背后发生的变化是,大模型正在变成一门越来越重的生意。最直接的变化发生在算力上。
今年7月,有消息称智谱已经建成一座1GW级数据中心并开始部分投入运营,主要用于GLM系列模型研发,全部采用国产AI芯片。除此之外,智谱还运营着多个万卡计算集群,并被曝收购异构算力软件公司中科加禾、与国内芯片公司讨论定制AI芯片。
同一时间,DeepSeek也开始关注基础设施,并重金投入。
今年以来,DeepSeek开始在内蒙古乌兰察布招聘数据中心高级交付经理、运维工程师以及IDC设计规划工程师。7月底,又有消息称,DeepSeek计划在乌兰察布增加1GW规模算力,并同时从外部租赁额外算力。
从租算力、买算力,到自己盖数据中心,模型公司正在发生一个明显的角色变化:它们开始从算力的使用者,变成算力基础设施的建设者。模型公司为何开始自建算力?智谱之外,谁也在重押基建?
为什么?我们从过去三年大模型玩家的竞争规则里可以看出答案。
2023年“百模大战”刚刚开始时,一家大模型公司最重要的事情,是证明自己能不能把模型训练出来。比如参数规模、Benchmark、训练用了多少张GPU、模型能力能不能追上GPT-4,这些都是最早一批模型公司的竞争指标。Scaling Law仍然有效,模型能力也存在明显代际差距。只要训练出一个足够好的模型,公司就能够获得融资、用户以及下一张牌桌的入场券。
因此,那时候的算力还只是生产资料。
模型公司拿到融资,再采购或者租赁算力,完成一次模型训练。当时算力固然重要,但它最重要服务于模型。