从蒸馏到合成数据到 RSI,模型竞争的下一个焦点是什么?|对谈 Evolvent AI 联创孟繁青
2026年8月8日 · 59:29
本期曲凯对话 Evolvent AI 联创孟繁青,核心反共识是:国内模型的真正优势在 Pre-training,而非 Post-training。孟繁青曾在 Kimi 做 Agent 与 RL Infra,参与 K2.5 和 Kimi Linear,他比较了在模型厂与创业公司的差异,提到模型厂内部训练流程已工程化,认为训练模型门槛大降,数据质量比 Infra 更难评判,且数据行业变化极快,重人力的专家标注公司难以存活。他还解释了为什么 Post-training 的人更容易创业:Pre-training 研究太吃资源,而 Agent 和 Bench 离落地更近;今天的 Bench 已从解题变成在模拟工作环境里完成长程任务,评分靠人与 Agent 共同 check。合成数据这波已接近尾声,贵的一条能卖到几千块,下一波是 RSI 数据,长程轨迹要跑十几小时甚至一天,因此更宝贵。关于蒸馏,他强调这只是加速手段,不是国模变强的决定性因素;即便海外封掉所有蒸馏通道,国模仍可靠预训练架构创新(如在卡仅为国外 1/10 时追近前沿)维持竞争力。他也判断,模型厂最终拼的是组织架构与人才密度,而非单纯算力;并直言不存在 RSI 基础模型,创业公司的机会在桥接模型厂与应用层。