123悬赏网_发布悬赏任务_广告任务平台

首頁 > 生活分享 > 免費(fèi)教學(xué) > 多模態(tài)對(duì)齊在小紅書推薦的研究及應(yīng)用

多模態(tài)對(duì)齊在小紅書推薦的研究及應(yīng)用

發(fā)布時(shí)間:2024-09-24 16:52:42來源: 13041198719

在 CIKM 2024 上,小紅書中臺(tái)算法團(tuán)隊(duì)提出了一種創(chuàng)新的聯(lián)合訓(xùn)練框架 AlignRec,用于對(duì)齊多模態(tài)表征學(xué)習(xí)模型和個(gè)性化推薦模型。本文指出,由于多模態(tài)模型與推薦模型在訓(xùn)練過程中存在步調(diào)不一致問題,導(dǎo)致聯(lián)合訓(xùn)練被推薦信號(hào)主導(dǎo),從而丟失大量多模態(tài)信息。AlignRec 通過分階段對(duì)齊的方式,設(shè)計(jì)了三種針對(duì)性的優(yōu)化損失函數(shù),使得聯(lián)合訓(xùn)練能夠同時(shí)兼顧多模態(tài)信息和推薦信息。實(shí)驗(yàn)結(jié)果表明,AlignRec 在多個(gè)數(shù)據(jù)集上的性能超過了現(xiàn)有的 SOTA(state-of-the-art)模型。此外,AlignRec 還提供了在當(dāng)前廣泛使用的公開數(shù)據(jù)集亞馬遜上的預(yù)處理特征,這些特征的效果顯著優(yōu)于現(xiàn)有的開源特征。


最近多模態(tài)是個(gè)非常熱門的話題,尤其是在大模型以及 AIGC 領(lǐng)域,多模態(tài)基建和技術(shù)是走向未來商業(yè)化的奠基石。在過去的多模態(tài)大模型研究方向上,模態(tài)的“對(duì)齊”已經(jīng)被驗(yàn)證非常重要,分布的不一致?lián)p害不同模態(tài)的理解,我們此次要討論的核心問題是多模態(tài)在推薦中的對(duì)齊問題;

 

在具體介紹論文工作之前,我們先來介紹下我們過去在推薦和電商中的實(shí)踐工作:

 

推薦實(shí)踐


上述方法是我們對(duì) BM3論文進(jìn)行改進(jìn) 上線的方案,該方案實(shí)際上做的是通過損失函數(shù)來實(shí)現(xiàn)“對(duì)齊”工作。我們的對(duì)模型的期望也是保留個(gè)性化的同時(shí),能夠?qū)R行為和多模態(tài)的空間,進(jìn)一步增加長(zhǎng)尾的個(gè)性化分發(fā)能力。先說效果:

 

該模型實(shí)驗(yàn)在推薦發(fā)現(xiàn)頁取得時(shí)長(zhǎng)、曝光、點(diǎn)擊等核心指標(biāo)收益,除此之外,在長(zhǎng)尾分發(fā)上,0 粉作者筆記點(diǎn)擊和曝光獲得大幅增長(zhǎng),整個(gè)召回路增加了全局可分發(fā)筆記數(shù) 6%,分發(fā)筆記集中在 1k-5k 的筆記曝光集合;同時(shí),我們的方法也被復(fù)用在了電商場(chǎng)景,分發(fā)長(zhǎng)尾同時(shí),獲得 DGMV 等核心指標(biāo)收益。

 

很顯然,從上述可以看出,“對(duì)齊”的效果立竿見影,在業(yè)界應(yīng)用上我們已經(jīng)取得實(shí)質(zhì)性進(jìn)展,但本質(zhì)上這樣的設(shè)計(jì)方案依然并沒有完全解決多模態(tài)推薦問題,因?yàn)槲覀兊亩嗄B(tài)模型和推薦模型是相對(duì)割裂的,等同于直接拿表征來使用,這樣的設(shè)計(jì)打通了應(yīng)用范式,卻無法判斷多模態(tài)模型本身能力對(duì)效果的上限,對(duì)于選擇合適多模態(tài)表征存在一定的難度。但如果我們引入文本/圖等 Encoder(Transformer)等進(jìn)行聯(lián)合訓(xùn)練,會(huì)引入如下的問題:

 

在大規(guī)模的數(shù)據(jù)下,分布式訓(xùn)練引入圖文 Encoder 會(huì)造成資源和性能問題,尤其是注重高時(shí)效性的 Streaming Data;
訓(xùn)練步調(diào)不一致,往往多模態(tài)模型需要大量數(shù)據(jù)甚至多個(gè) Epoch 才能收斂,但推薦模型通常采取單輪訓(xùn)練,這也導(dǎo)致多模態(tài)模型訓(xùn)練不充分;

所以我們?cè)O(shè)計(jì)聯(lián)合訓(xùn)練模型,通過設(shè)計(jì)分階段對(duì)齊的方式和中間指標(biāo)評(píng)估,解決上述聯(lián)合訓(xùn)練問題,并且引入了三種針對(duì)性的優(yōu)化損失函數(shù),使得聯(lián)合訓(xùn)練能夠同時(shí)兼顧多模態(tài)信息和推薦信息,解決聯(lián)合訓(xùn)練中的“對(duì)齊”問題,提升效果上限。

 

下面我們從相關(guān)工作,核心挑戰(zhàn),模型設(shè)計(jì)介紹整體工作。

 

我們?cè)谶@里通過 (a), (b), (c) 描述了在過往的學(xué)術(shù)界目前多模態(tài)推薦方向的相關(guān)工作,總結(jié)主要的發(fā)展路徑:

圖(a),直接利用,比如把 embedding,多模態(tài)特征作為信號(hào)輸入網(wǎng)絡(luò);
圖(b),利用圖等方式聚合,希望能得到更豐富的多模態(tài)信息表達(dá),這本質(zhì)上也是增加多模態(tài)側(cè)信息的召回率;
圖(c),聯(lián)合優(yōu)化,把模態(tài)損失和行為損失共同優(yōu)化,但這忽略了本身筆記側(cè)的多模態(tài)學(xué)習(xí)。
在工業(yè)界,現(xiàn)階段推薦系統(tǒng)主要還是依賴于 ID 特征的學(xué)習(xí), 大多數(shù)多模態(tài)推薦把多模態(tài)信息作為 sideinfo 去輔助 ID 特征的學(xué)習(xí)。但是, 多模態(tài)之間以及 ID 模型與多模態(tài)之間都存在著語義鴻溝, 直接使用甚至可能適得其反。

 

核心挑戰(zhàn)

為了貼合業(yè)界實(shí)際,設(shè)計(jì)一款有效的多模態(tài)與推薦聯(lián)合訓(xùn)練模型會(huì)遇到如下的挑戰(zhàn):

 

挑戰(zhàn)1: 如何對(duì)齊多模態(tài)表征。包括內(nèi)容模態(tài)之間(如圖文)的對(duì)齊,以及內(nèi)容模態(tài)與 ID 模態(tài)之間的對(duì)齊;
挑戰(zhàn)2: 如何平衡好內(nèi)容模態(tài)和 ID 模態(tài)之間的學(xué)習(xí)速度問題。內(nèi)容模態(tài)可能需要超大規(guī)模的數(shù)據(jù)和時(shí)間去訓(xùn)練, 而 ID 模態(tài)的學(xué)習(xí)更新可能只需要幾個(gè) epoch。
挑戰(zhàn)3: 如何評(píng)估多模態(tài)特征對(duì)推薦系統(tǒng)的影響。引入不合適的多模態(tài)信息可能需要更多的精力去做糾正, 甚至可能影響推薦系統(tǒng)的性能。

我們所提出的方法命名為 AlignRec,整體框架如下圖所示, 主要包含3個(gè)模塊: Multimodal Encoder Module, Aggregation Module, 以及 Fusion Module, 下面分別進(jìn)行介紹。


Multimodal Encoder Module

 

免費(fèi)教學(xué)更多>>

摩托車能不能再上路?最近幾年各地政策有變化,更多人開始騎摩托 左手“油電”右手“安全” ,沃爾沃能否領(lǐng)跑豪華新能源賽道? 聯(lián)合開發(fā)降低成本,瑪莎拉蒂將與阿爾法·羅密歐合作 38.98萬元!斯巴魯WRX Wagon開售,網(wǎng)友:自動(dòng)擋+丑沒人買 嵐圖邵明峰揭秘FREE+底盤:全系標(biāo)配倍適登EDC,百萬級(jí)懸架下探30萬級(jí)市場(chǎng) 35萬級(jí)MPV你選誰?魏牌高山對(duì)比騰勢(shì)D9 DM,究竟有哪些差別? 零跑C10:15萬級(jí)SUV卷王!800V快充+605km續(xù)航+激光雷達(dá),值嗎? 不愧是全球銷量第一的SUV!第六代RAV4榮放震撼登場(chǎng) 2.5L油電混動(dòng) 5月,小型車銷量前十榜單,曾經(jīng)的神車“飛度”淪為“守門員” 智界,在鴻蒙智行體系里 “茍且求生” 還是 “破局重生” 試完深藍(lán)S05,才明白15萬級(jí)純電SUV應(yīng)該長(zhǎng)這樣 一汽大眾速騰:國民家轎的標(biāo)桿之作 凱迪拉克拿出“誠意”!曲面屏設(shè)計(jì)+9AT,不足16萬,性價(jià)比超高 東風(fēng)雪鐵龍2026款天逸C5 AIRCROSS煥新登場(chǎng) 黑化后還是率性有品 東風(fēng)標(biāo)致新4008 五菱繽果 SUV:家庭出行的理想之選? 10 萬級(jí)越野SUV 怎么選?捷途山海T1 對(duì)比哈弗猛龍 中國用戶眼饞!福特F-150 Lobo套件發(fā)布: 猛禽披“狼皮” 全新日產(chǎn)Leaf將于6月17日發(fā)布!定位純電動(dòng)緊湊型SUV 本田ADV350、三陽劍齒虎,標(biāo)致XP400,三選一,你選誰? 買車正當(dāng)時(shí)補(bǔ)貼加優(yōu)惠一汽豐田bZ5讓用戶贏麻了 “聚變2030”戰(zhàn)略持續(xù)深化,廣汽豐田躍入中國自研2.0時(shí)代 以“比亞迪速度”領(lǐng)跑新賽道:媒體融合發(fā)展暨綠色創(chuàng)新實(shí)踐交流會(huì)首站走進(jìn)比亞迪 1分鐘了解一款車:吉利星愿 全新一代奧迪Q5L來了!華為智駕+雙激光雷達(dá)+3塊大屏,又要賣爆? 二手新能源車推薦:從ES6到Model 3,這幾款真不虧! 馬威電動(dòng)力選用世索科PEEK材料制造新型高壓電機(jī) 輕描淡寫的升級(jí) 2026款沃爾沃S90新車圖解 理想L6、問界M7再添新對(duì)手,方程豹鈦7諜照曝光 中大型SUV漲幅最大
主站蜘蛛池模板: 定量包装机,颗粒定量包装机,粉剂定量包装机,背封颗粒包装机,定量灌装机-上海铸衡电子科技有限公司 | 北京办公室装修,办公室设计,写字楼装修-北京金视觉装饰工程公司 北京成考网-北京成人高考网 | 细石混凝土泵_厂家_价格-烟台九达机械有限公司 | 臻知网大型互动问答社区-你的问题将在这里得到解答!-无锡据风网络科技有限公司 | 万濠投影仪_瑞士TRIMOS高度仪_尼康投影仪V12BDC|量子仪器 | 诺冠气动元件,诺冠电磁阀,海隆防爆阀,norgren气缸-山东锦隆自动化科技有限公司 | 济南保安公司加盟挂靠-亮剑国际安保服务集团总部-山东保安公司|济南保安培训学校 | 美国HASKEL增压泵-伊莱科elettrotec流量开关-上海方未机械设备有限公司 | 玻璃钢型材-玻璃钢风管-玻璃钢管道,生产厂家-[江苏欧升玻璃钢制造有限公司] | 创富网-B2B网站|供求信息网|b2b平台|专业电子商务网站 | 真空搅拌机-行星搅拌机-双行星动力混合机-广州市番禺区源创化工设备厂 | 酒万铺-酒水招商-酒水代理| wika威卡压力表-wika压力变送器-德国wika代理-威卡总代-北京博朗宁科技 | 真空冷冻干燥机_国产冻干机_冷冻干燥机_北京四环冻干 | 卧涛科技有限公司科技项目申报公司|高新技术企业申报|专利申请 | 浩方智通 - 防关联浏览器 - 跨境电商浏览器 - 云雀浏览器 | 量子管通环-自清洗过滤器-全自动反冲洗过滤器-北京罗伦过滤技术集团有限公司 | 抖音短视频运营_企业网站建设_网络推广_全网自媒体营销-东莞市凌天信息科技有限公司 | 螺旋叶片_螺旋叶片成型机_绞龙叶片_莱州源泽机械制造有限公司 | 穿线管|波纹穿线管|包塑金属软管|蛇皮管?闵彬专注弱电工程? | 桁架机器人_桁架机械手_上下料机械手_数控车床机械手-苏州清智科技装备制造有限公司 | 5L旋转蒸发器-20L-50L旋转蒸发器-上海越众仪器设备有限公司 | 不锈钢丸厂家,铝丸,铸钢丸-淄博智源铸造材料有限公司 | 北京宣传片拍摄_产品宣传片拍摄_宣传片制作公司-现像传媒 | 云南丰泰挖掘机修理厂-挖掘机维修,翻新,再制造的大型企业-云南丰泰工程机械维修有限公司 | 东莞市踏板石餐饮管理有限公司_正宗桂林米粉_正宗桂林米粉加盟_桂林米粉加盟费-东莞市棒子桂林米粉 | 北京遮阳网-防尘盖土网-盖土草坪-迷彩网-防尘网生产厂家-京兴科技 | 多物理场仿真软件_电磁仿真软件_EDA多物理场仿真软件 - 裕兴木兰 | 视频直播 -摄影摄像-视频拍摄-直播分发 | 亳州网络公司 - 亳州网站制作 - 亳州网站建设 - 亳州易天科技 | 跨境物流_美国卡派_中大件运输_尾程派送_海外仓一件代发 - 广州环至美供应链平台 | 航空连接器,航空插头,航空插座,航空接插件,航插_深圳鸿万科 | 热工多功能信号校验仪-热电阻热电偶校验仿真仪-金湖虹润仪表 | 爱德华真空泵油/罗茨泵维修,爱发科-比其尔产品供应东莞/杭州/上海等全国各地 | 纯化水设备-纯水设备-超纯水设备-[大鹏水处理]纯水设备一站式服务商-东莞市大鹏水处理科技有限公司 | 除甲醛公司-甲醛检测治理-杭州创绿家环保科技有限公司-室内空气净化十大品牌 | 连续密炼机_双转子连续密炼机_连续式密炼机-南京永睿机械制造有限公司 | 等离子空气净化器_医用空气消毒机_空气净化消毒机_中央家用新风系统厂家_利安达官网 | 济南网站策划设计_自适应网站制作_H5企业网站搭建_济南外贸网站制作公司_锐尚 | 活性炭厂家-蜂窝活性炭-粉状/柱状/果壳/椰壳活性炭-大千净化-活性炭 | 水篦子|雨篦子|镀锌格栅雨水篦子|不锈钢排水篦子|地下车库水箅子—安平县云航丝网制品厂 |