设计原则
组件可以换。下面几条来自论文和一线分享里反复出现的约束。换掉其中一条,搜推双引擎都要重画。
没有 Query · 发现页
多路召回
粗排 / 精排 / GenRank
重排后双列卡片
有 Query · 搜索
QP-OneModel
召回 + 生成式相关性
结果页 / 问一问
01 搜索和推荐同时是产品
打开 App 是发现页,输入框是另一套操作系统。架构必须让两边共用内容理解,但不要共用同一条在线漏斗。
02 先看懂笔记,再看后验
新笔记没有点赞。NoteLLM 把图文压成可检索向量,就是为了让冷启动不靠「已经火了」。
03 多目标,而不是只追点击
公开训练信号包括点击、隐藏、点赞、收藏、评论、分享、关注。只优化 CTR 会推出封面党。
04 批流同一套归因
有效点击、停留多久,必须在 Flink 和离线 Hive 里是同一个定义,否则线上模型和报表会各说各话。
05 生成式改的是模块,不是换掉漏斗
QP-OneModel、生成式相关性、GenRank 都嵌在原有 QP / 召回 / 排序位置上,并蒸馏到可上线的小模型。
06 用实验而不是直觉改排序
上述论文都报告了线上 A/B。没有实验平台,搜推中台只是一堆模型文件。