作者：巨人电商

为什么今日头条们，总知道你喜欢看什么？

POST TIME:2021-08-20

现在有很多像今日头条、轻芒阅读这样为你个性推荐资讯的 app，为什么同样是个性推荐，它们却有着不同的风格？今天分享的这篇文章，从 3 个方面为你简单介绍，app 是如何为你推荐个性化资讯的。

不了解今日头条是怎么运作的。不过因为在 Facebook 工作时负责新鲜事（Newsfeed）的个性化推荐与排序，我可以说说 Facebook 是怎么衡量自己推荐和排序的质量的。

在具体执行层面，主要有 3 个方式，分别是从机器学习模型、产品数据，和用户调查上来考核推荐引擎的效果。

1. 机器学习模型

推荐引擎的一大核心就是机器学习（不过现在都说人工智能了，但本质上还是 supervised learning）。如果是想考察机器学习模型的质量，学术上早就有一套成熟的实践方法。

无论是模型的选择（比如从 decision tree 替换成 neural network），还是迭代改进（比如模型训练时多用一倍的数据），都可以使用基于 supervised learning 的衡量办法。最常见的就是 AUC。

另一方面，对于某一类特定问题也有更细致的指标。比如说，可以通过模型特征的重要性（feature importance）知道新加的特征是不是有用。

2. 产品数据

再牛逼的机器学习模型都要经历产品数据的实际检验。这方面大家就都比较熟悉了，KPI 嘛。不过在 Facebook 特别是 Newsfeed 这种牵一发动全身的地方，我们会追踪一系列数据来描述产品，而不是依赖某一个单一标准。

这些数据包括但不限于：

而且，在日常的快速迭代和 A/B 测试中，只有这些笼统的数据是不够的，我们还需要些更细致的数据来真正理解我们的一些改动。比如说：

内容类型的分布是怎么变动的：用户原创和转发的比重分布，网页链接和图片视频的比重分布，长视频和短视频的比重分布等等
对公众帐号是怎么影响的：什么样的公众号会受益于这次改动
哪些第三方巨头受到了影响，影响是否合理：比如我最早在 FB 实习时候的项目是整顿 SPAM 帐号。那个改动重创了 Zynga（因为 Zynga 严重依赖用户骚扰它的好友来吸量），但大家觉得挺合理的，让公关去沟通了下就发布了。

另外，为了防止短暂的眼球效应，对每一个重要的产品决策，我们都会维护一个长期的 backtest，用来评估这个决策的长久影响。比如说：