learntoall

设计原则

组件可以换。下面几条来自论文和一线分享里反复出现的约束。换掉其中一条,搜推双引擎都要重画。

没有 Query · 发现页
多路召回
粗排 / 精排 / GenRank
重排后双列卡片
有 Query · 搜索
QP-OneModel
召回 + 生成式相关性
结果页 / 问一问
提醒:发现页、搜索、打点三条路

01 搜索和推荐同时是产品

打开 App 是发现页,输入框是另一套操作系统。架构必须让两边共用内容理解,但不要共用同一条在线漏斗。

02 先看懂笔记,再看后验

新笔记没有点赞。NoteLLM 把图文压成可检索向量,就是为了让冷启动不靠「已经火了」。

03 多目标,而不是只追点击

公开训练信号包括点击、隐藏、点赞、收藏、评论、分享、关注。只优化 CTR 会推出封面党。

04 批流同一套归因

有效点击、停留多久,必须在 Flink 和离线 Hive 里是同一个定义,否则线上模型和报表会各说各话。

05 生成式改的是模块,不是换掉漏斗

QP-OneModel、生成式相关性、GenRank 都嵌在原有 QP / 召回 / 排序位置上,并蒸馏到可上线的小模型。

06 用实验而不是直觉改排序

上述论文都报告了线上 A/B。没有实验平台,搜推中台只是一堆模型文件。