几篇KDD'24大厂推荐系统优化工作总结

科技 2024-10-18 08:05 北京

点关注，不迷路，用心整理每一篇算法干货~

后台留言”交流“，加入圆圆算法交流群~

👇🏻扫码👇🏻加入圆圆算法知识星球~

（已有880+同学加入学习，700+干货笔记）

今天这篇文章给大家介绍几篇KDD2024中，大厂在推荐系统领域的优化工作，论文来自爱彼迎、腾讯、快手、美团等公司，设计多目标建模、多样性、搜索意图建模、ranking loss等问题。

爱彼迎：多目标建模和模型蒸馏

论文标题：Multi-objective Learning to Rank by Model Distillation

下载地址：https://arxiv.org/pdf/2407.07181

多目标建模转换成模型蒸馏问题。多目标的场景要求最小化一个目标的预测误差，同时其他目标的预估误差在一个约束内。假设单独训练的一个单目标模型，效果一定比多目标一起训练的这个目标的预测误差要小，上述问题就等价于一个模型蒸馏损失函数。这个损失函数一方面包括主目标的hard label的优化目标，另一方面包括每个其他目标下，多目标蒸馏单目标最优模型soft label的优化目标。通过各个辅助目标蒸馏损失的权重，以及主目标hard label和辅助目标soft label的权重，调节模型优化过程。

Ranking Loss有效性分析

论文标题：Understanding the Ranking Loss for Recommendation with Sparse User Feedback

下载地址：https://arxiv.org/pdf/2403.14144

推荐系统的预估模型一般采用Binary Cross Entropy训练，一些研究发现引入list-wise或者pair-wise的ranking loss可以显著提升模型AUC。本文探索了ranking loss的引入带来效果提升的原因。通过对比在BCE基础上是否引入ranking loss，模型在梯度更新、训练超平面等角度的分析，本文发现ranking loss有效的核心原因是在正样本稀疏的场景下，相比单独BCE模型，引入ranking loss可以让梯度变得更大，模型训练更容易收敛，负样本优化超平面更加陡峭，进而带来效果提升。

快手：上下文蒸馏提升精排多样性

论文标题：Contextual Distillation Model for Diversified Recommendation

下载地址：https://arxiv.org/pdf/2406.09021

本文提出了一种在精排阶段提升推荐系统多样性的建模方法。一般提升推荐系统多样性都是在重排阶段使用NMR算法实现，该算法每次将精排打分最高且和已经选择的候选相似度最低的样本加入结果集，迭代该过程实现考虑推荐结果多样性的重排。然而，如果精排阶段没有较好的考虑多样性，会导致送入重排阶段的多样性较差，进而影响了整体推荐系统的多样性。

为了解决上述问题，本文提出了一种基于上下文信息的多样性蒸馏方法。该方法在精排模型中，以NMR的排序结果作为Teacher，将多样性信息蒸馏到精排模型中。由于NMR算法需要输入上下文信息，文中将所有精排候选当做上下文。同时，根据attention和anti-attention，从精排候选中采样和当前item相关及对抗的候选，丰富上下文信息，并通过对比学习获取两类item的embedding，输入MLP网络蒸馏NMR Teacher的多样性预测结果。

美团：搜索意图引入推荐模型

论文标题：Unified Dual-Intent Translation for Joint Modeling of Search and Recommendation

下载地址：https://arxiv.org/pdf/2407.00912v1

推荐系统相比搜索场景，一个核心难点是缺少像query那样的显示用户意图表达。本文提出利用搜索场景的用户、item历史搜索query，建模用户的query意图表征，相当于学习一个虚拟的用户query，再将其表征应用到推荐系统中，提升推荐系统建模效果。

用户意图可以分为稳定意图和变化意图。针对这两类意图信息，文中构建了一个dual-intent转化表征学习方法。首先基于用户的历史搜索query和点击的item，构建异构图，图中节点是user或item，边是用户和item交互时搜索的query。对于query和user使用term embedding pooling以及引入user个性化门控等方式获取query表征，并以用户真实搜索query的表征作为进行监督学习，以此作为用户的动态意图。同时，使用GNN融合图上用户的临接节点信息，刻画用户的固有意图。最后，结合用户交互item=用户静态意图+动态意图的转化逻辑，建立表征优化的训练目标。这些搜索意图表征信息最后输入到推荐系统模型底层进行最终目标拟合。

END

后台留言”交流“，加入圆圆算法交流群~

后台留言”星球“，加入圆圆算法知识请星球~【时序预测专题课程持续更新中】

知识星球提供一文贯通笔记、经典代码解析、问答服务、新人入门，已有880+小伙伴加入，价格随人数增加和内容丰富上涨，感兴趣的同学尽早加入~

投稿&加交流群请加微信，备注机构+方向拉群~

【历史干货算法笔记】

生成式模型入门：一文讲懂3大类生成式模型

Sptial-Temporal时空预测总结：建模思路、优化方法梳理

时序预测顶会论文数据集、数据处理方法、训练方法汇总

时间序列预测实战方法概述：从数据到模型

Informer模型结构和代码解析

基于Transformer的时序预测模型TFT代码详解

时空预测经典模型STGCN原理和代码解读

一网打尽：14种预训练语言模型大汇总

Vision-Language多模态建模方法脉络梳理

花式Finetune方法大汇总

从ViT到Swin，10篇顶会论文看Transformer在CV领域的发展历程

如果觉得有帮助麻烦分享在看点赞~

http://mp.weixin.qq.com/s?__biz=MzIyOTUyMDIwNg==&mid=2247491263&idx=1&sn=4422bb163eade8b110b37d2c71f89ddd

圆圆的算法笔记

定期更新深度学习/算法干货笔记和世间万物学习记录~

最新文章

清华大学提出基于多模态大模型的时间序列异常检测方法

我发现了找顶会创新点的最强公式，真的不需要脑子

最全汇总！2024推荐系统大厂顶会工作整理

检索增强时序预测——大模型RAG建模思路在时序预测中的应用

今天面试了一个字节女生，当场想给她offer！

2024时序预测都有哪些经典工作——总结篇

针对长周期非平稳多元时间序列的异常检测方法

NeurIPS'24：针对时序预测中时间戳特征的研究

发一篇顶会真不难

高效的卷积+Attention多元时序预测模型结构，实现长短期&变量间关系建模

最后3天！双11星球特惠~

适用于各类结构&领域时序数据的通用时序预测模型

最后3天！双11星球特惠~

取代Mamba，超越Transformer！扩展LSTM到数十亿参数

Salesforce推出首个通用时序预测模型评测基准GIFT-Eval，助力时序通用基础模型研究

南大&阿里发布多模态大模型WINGS，解决基于LLM的多模态训练灾难遗忘问题

港科技&MIT&浙大联合发布通用时序特征机器TimeMixer++，多项任务取得SOTA效果

双11星球优惠券来啦~

Salesforce推出Moirai-MoE，新视角设计下一代时序基础模型

免费白皮书《从头训练大模型最佳实践》

清华大学NeurIPS'24：时序大模型AutoTimes，结合In-context Learning提升预测效果

时间序列模型深度解析知识库

NIPS 2024时间序列工作——公众号已更新文章汇总

多阶段对比学习+多专家CLIP实现细粒度多模态表征学习

FoundTS：时间序列预测基础模型的全面统一测评基准

剑桥大学时间序列对比学习新方法，缓解伪负样本影响

时间序列+深度学习干货笔记专栏

几篇KDD'24大厂推荐系统优化工作总结

华为诺亚方舟实验室与华东师范大学联合发布时序预测通用模型ROSE——轻量规模，SOTA效果！

（更新至27节）时间序列预测专题系列干货文章

清华大学最新发布：统一时序预测模型，上下文长度首次扩展至千级别，适用各类数据集

重磅！机器学习时间序列预测+Transformer，堪称顶会收割机！

阿里达摩院最新多模态大模型介绍，多项图文任务取得SOTA效果

20场kaggle时间序列比赛Top方案GrandMaster整理

时序预测数据处理新方法汇总：多粒度和频域的可逆归一化

腾讯KDD‘24公开最新广告推荐系统建模方案

近7年深度学习时序预测建模方法汇总

普林斯顿大学提出首个基于MoE的稀疏时序预测大模型，参数量扩展到2.4billion

15种金融时间序列预测方法总结

时序预测中的多类型模型组合建模方案

时间序列预测专题系列干货文章

KDD'24系列：统一时间序列预训练Transformer

Transformer手撕BP，当场拿了offer

不会捞“偏门”，这辈子别想发计算机顶会顶刊！

一文汇总：长周期时序预测有哪些优化点？

LSTM+transformer=金融时序预测超高精准度！

高维多变量下的Transformer时序预测建模方法

分类

时事

民生

政务

教育

文化

科技

财富

体娱

健康

情感

旅行

百科

职场

楼市

企业

乐活

学术

汽车

时尚

创业

美食

幽默

美体

文摘

原创标签

时事社会财经军事教育体育科技汽车科学房产搞笑综艺明星音乐动漫游戏时尚健康旅游美食生活摄影宠物职场育儿情感小说曲艺文化历史三农文学娱乐电影视频图片新闻宗教电视剧纪录片广告创意壁纸头像心灵鸡汤星座命理教育培训艺术文化金融财经健康医疗美妆时尚餐饮美食母婴育儿社会新闻工业农业时事政治星座占卜幽默笑话独立短篇连载作品文化历史科技互联网

发布位置

广东北京山东江苏河南浙江山西福建河北上海四川陕西湖南安徽湖北内蒙古江西云南广西甘肃辽宁黑龙江贵州新疆重庆吉林天津海南青海宁夏西藏香港澳门台湾美国加拿大澳大利亚日本新加坡英国西班牙新西兰韩国泰国法国德国意大利缅甸菲律宾马来西亚越南荷兰柬埔寨俄罗斯巴西智利卢森堡芬兰瑞典比利时瑞士土耳其斐济挪威朝鲜尼日利亚阿根廷匈牙利爱尔兰印度老挝葡萄牙乌克兰印度尼西亚哈萨克斯坦塔吉克斯坦希腊南非蒙古奥地利肯尼亚加纳丹麦津巴布韦埃及坦桑尼亚捷克阿联酋安哥拉