赵祺到豆包后同样看重人效。据了解,此前豆包有一个独立的评测团队,今年赵祺将其拆散,分到了各业务组。
负责对话方向的产品后训练团队(Product Posttrain-Chat)也在缩减。
该团队由朱文佳负责,隶属于大模型部门 Seed,与豆包产品团队协作,基于 Seed 的基础模型进行后训练,产出供豆包直接调用的小模型。由于业务需求减少,部分员工已转岗至 Horizon RL、产品后训练-办公(Product Posttrain-Work)等其他部门。另据了解,对话模型合版负责人在一个月内换了两次。
豆包目前是国内日活跃用户数最高的AI应用,DAU已超过2亿,但它过去的成功,本质上仍是对话产品的成功。
今年以来,对话产品的商业化瓶颈逐渐显现。每天2亿用户带来的成本不只有文字对话,还有图片、语音、视频等多模态功能。豆包向每位用户免费提供每天5条Seedance视频生成额度,需与火山引擎单独结算。一些漫剧制作者甚至通过批量注册账号搭建“号池”,集中使用免费额度,进一步推高豆包成本。
与此同时,Anthropic在企业市场的收入快速增长,开始推动大厂将重心从对话转向企业服务和商业化。
目前,豆包的收入业务分为两条线:豆包PC端和飞书产品负责人童遥负责“生产力”,包括豆包专业版、企业版以及飞书内的豆包工作;原抖音电商搜索负责人夏宁负责生活服务和电商。此前还有一条由杨康负责的小程序调用业务,例如在豆包内打车。近期,该团队被并入前两条业务线。
一些原本用于改善对话体验的工作被放缓。“讨好”问题是其中一个例子。
今年4月,豆包将推出付费版的消息传出后,用户开始集中抱怨其回答“又蠢又讨好”,质疑这样的体验是否值得付费。
讨好倾向的形成与豆包的产品策略有关。豆包不只看模型够不够聪明,也很在意用户是否喜欢这个产品。核心指标之一是留存,即一段时间内用户回来使用的天数。每次上线新版本,留存至少不能下降。
为此,产品和后训练团队会一起调整模型:通用 Session 团队定义豆包该怎么回答,包括信源排序、答案长度、语气、是否追问等;后训练团队里的 Strong Character(强人格)小组,会用脱敏后的用户反馈训练奖励模型,塑造模型的人设和回答风格。
这套方法提升了留存,也带来了副作用。今年春节前,豆包上线一版新模型,训练时过度放大了用户偏好的权重,模型因此变得更会讨好用户,甚至影响回答准确率。春节后用户量迅速增长,豆包已经很难回退旧版本。
到了4月,豆包内部开始讨论要如何调整:一旦纠正讨好倾向,让回答变得冷静、克制,留存就会下滑,一段时间里没有人敢拍板。最终Flow部门负责人朱骏(Alex)决定,接受短期留存下滑来纠正产品体验。