深度推荐模型之DIN学习

DIN，Deep Interest Network，深度兴趣网络。论文的关键在于对用户历史行为的embedding向量的改进。模型结构如下：

基本DeepCTR网络结构和DIN网络结构.png

左边是一般的深度推荐模型，右边则是DIN模型。改进的关键在于DIN提出了一个局部激活单元，用来产生用户历史行为特征的权重，从而根据候选商品进行自适应调整不同历史行为特征对最终结果的影响程度。传统方法中不管候选商品是什么，经过SUM Pooling后得到的用户历史行为特征都是一样的。但是从现实角度来看，对于不同的候选商品，用户的不同历史行为商品的影响程度是不一样的，而传统深度模型并没有体现出这一点。而DIN中的local activation unit则会根据历史行为商品和候选商品算出一个权重作为该历史行为商品对点击率的影响程度，此时经过 SUM Pooling后得到的用户历史行为特征则会根据不同候选商品发生变化，模型的多样化表征能力也就更强了。我们再来看下上图最右边的local activation unit，模型的输入是历史行为商品embedding向量和候选商品embedding向量，但是传到内部全连接层的输入还加上了两个特征向量的乘积，论文中提到是为了“help relevance modeling”。
其他的工程改进还有：

对正则化进行改进。由于商品id维度太大了，这类特征对应的embedding矩阵表是巨大的，模型参数太多，如果不加正则化则模型很快过拟合（论文中也指出不加regularization模型在第一个epoch后就过拟合了）。但是直接加上传统的L2正则是不现实的，因为加入L2正则后，每个batch都要对整个embedding矩阵表进行更新，这样会带来过多的计算量。DIN提出了新的正则化方式，只对batch中参与了前向计算的embedding向量进行更新，此时有 $L_2(W) \approx \sum_{j=1}^K\sum_{m=1}^B\frac{\alpha_{mj}}{n_j}||w_j||_2^2$ 。其中， $K$ 表示特征空间维度（也就是embedding矩阵表的行数）， $B$ 表示batch-size， $\alpha_{mj}$ 表示当前batch第m个样本中是否出现了第j个特征id，从而决定是否要对该特征id对应的embedding向量 $w_j$ 加上正则化。
对激活函数进行改进。DIN对PReLU进行改进，提出了Dice。PReLU是带参数的ReLU，公式如下： $PReLU(s) = \begin{cases} s,&\text{$s$>0} \\ \alpha s,&\text{$s \leq$0} \end{cases}=p(s)*s+(1-p(s))*\alpha s$ 其中 $\alpha$ 是可学习的参数， $p(s)$ 根据输入 $s$ 取0或者1。当 $\alpha$ 固定时，PReLU就是ReLU或者leakyReLU。PReLU的不足在于 $p(s)$ 是硬分配，激活函数的分界点是固定的，所以Dice对PReLU做了一点改进，保证函数的分界点是自适应的。Dice公式如下： $f(s)=p(s)*s+(1-p(s))*\alpha s, \; p(s)=\frac{1}{1+e^{-\frac{s-E(s)}{\sqrt{Var(s)+\epsilon}}}}$ 其中，在训练阶段 $E(s)$ 和 $Var(s)$ 是输入batch的均值和方差，测试阶段则是所有batch均值和方差的滑动平均。当 $E(s)$ 和 $Var(s)$ 都是0时，Dice就是PReLU了。
评估标准的改进。Metrics的不同，模型最后达到的效果也是不一样的。一般的CTR都是选择AUC作为评估标准，但是不同用户的点击习惯是不一样的，为了消除用户偏差对模型性能评估的影响，DIN选择对每个用户单独计算AUC，最后再计算整体AUC。新的AUC计算公式如下： $AUC_{new} = \frac{\sum_{i=1}^n \#imporession_i *AUC_i}{\sum_{i=1}^n \#impression_i}$ 其中 $\#impression_i$ 表示第i个用户在测试集中出现的次数， $AUC_i$ 表示第i个用户的传统AUC值。传统AUC方式是将测试集中的所有预测结果进行排序计算AUC值，新的AUC计算方式是将测试集中的样本按照用户拆分，对每个用户的预测结果进行排序计算AUC值，这样计算的AUC值就能更好的反映模型对于不同用户的预测效果，最后再将这些AUC值进行加权求和得到最终模型的整体评估效果。

人面猴
序言：七十年代末，一起剥皮案震惊了整个滨河市，随后出现的几起案子，更是在滨河造成了极大的恐慌，老刑警刘岩，带你破解...
沈念sama阅读 219,635评论 6赞 508
死咒
序言：滨河连续发生了三起死亡事件，死亡现场离奇诡异，居然都是意外死亡，警方通过查阅死者的电脑和手机，发现死者居然都...
沈念sama阅读 93,628评论 3赞 396
救了他两次的神仙让他今天三更去死
文/潘晓璐我一进店门，熙熙楼的掌柜王于贵愁眉苦脸地迎上来，“玉大人，你说我怎么就摊上这事。” “怎么了？”我有些...
开封第一讲书人阅读 165,971评论 0赞 356
道士缉凶录：失踪的卖姜人
文/不坏的土叔我叫张陵，是天一观的道长。经常有香客问我，道长，这世上最难降的妖魔是什么？我笑而不...
开封第一讲书人阅读 58,986评论 1赞 295
港岛之恋（遗憾婚礼）
正文为了忘掉前任，我火速办了婚礼，结果婚礼上，老公的妹妹穿的比我还像新娘。我一直安慰自己，他们只是感情好，可当我...
茶点故事阅读 68,006评论 6赞 394
恶毒庶女顶嫁案：这布局不是一般人想出来的
文/花漫我一把揭开白布。她就那样静静地躺着，像睡着了一般。火红的嫁衣衬着肌肤如雪。梳的纹丝不乱的头发上，一...
开封第一讲书人阅读 51,784评论 1赞 307
城市分裂传说
那天，我揣着相机与录音，去河边找鬼。笑死，一个胖子当着我的面吹牛，可吹牛的内容都是我干的。我是一名探鬼主播，决...
沈念sama阅读 40,475评论 3赞 420
双鸳鸯连环套：你想象不到人心有多黑
文/苍兰香墨我猛地睁开眼，长吁一口气：“原来是场噩梦啊……” “哼！你这毒妇竟也来了？” 一声冷哼从身侧响起，我...
开封第一讲书人阅读 39,364评论 0赞 276
万荣杀人案实录
序言：老挝万荣一对情侣失踪，失踪者是张志新（化名）和其女友刘颖，没想到半个月后，有当地人在树林里发现了一具尸体，经...
沈念sama阅读 45,860评论 1赞 317
护林员之死
正文独居荒郊野岭守林人离奇死亡，尸身上长有42处带血的脓包…… 初始之章·张勋以下内容为张勋视角年9月15日...
茶点故事阅读 38,008评论 3赞 338
白月光启示录
正文我和宋清朗相恋三年，在试婚纱的时候发现自己被绿了。大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
茶点故事阅读 40,152评论 1赞 351
活死人
序言：一个原本活蹦乱跳的男人离奇死亡，死状恐怖，灵堂内的尸体忽然破棺而出，到底是诈尸还是另有隐情，我是刑警宁泽，带...
沈念sama阅读 35,829评论 5赞 346
日本核电站爆炸内幕
正文年R本政府宣布，位于F岛的核电站，受9级特大地震影响，放射性物质发生泄漏。R本人自食恶果不足惜，却给世界环境...
茶点故事阅读 41,490评论 3赞 331
男人毒药：我在死后第九天来索命
文/蒙蒙一、第九天我趴在偏房一处隐蔽的房顶上张望。院中可真热闹，春花似锦、人声如沸。这庄子的主人今日做“春日...
开封第一讲书人阅读 32,035评论 0赞 22
一桩弑父案，背后竟有这般阴谋
文/苍兰香墨我抬头看了看天上的太阳。三九已至，却和暖如春，着一层夹袄步出监牢的瞬间，已是汗流浃背。一阵脚步声响...
开封第一讲书人阅读 33,156评论 1赞 272
情欲美人皮
我被黑心中介骗来泰国打工，没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留，地道东北人。一个月前我还...
沈念sama阅读 48,428评论 3赞 373
代替公主和亲
正文我出身青楼，却偏偏与公主长得像，于是被迫代替她去往敌国和亲。传闻我的和亲对象是个残疾皇子，可洞房花烛夜当晚...
茶点故事阅读 45,127评论 2赞 356

深度推荐模型之DIN学习

推荐阅读更多精彩内容