1. 项目概述
在数字营销领域,转化率(CVR)预估一直是核心挑战之一。传统CVR预估主要关注"点击-转化"这一单阶段行为,但随着电商业务精细化运营需求的提升,业界开始关注更复杂的后链路指标预估问题。阿里妈妈展示推广团队联合厦门大学提出的TESLA和READER框架,正是针对这一行业痛点提出的创新解决方案。
这两个框架的核心价值在于解决了多阶段延迟反馈这一关键难题。在实际业务场景中,用户从点击广告到最终完成购买(甚至可能发生退款)往往存在显著的时间延迟,这种延迟会导致模型训练时出现严重的标签偏差。TESLA专注于净转化率(NetCVR)预估,READER则针对点击后商品交易总额(GMV)预估,两者共同构成了完整的后链路价值评估体系。
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 核心挑战解析
2.1 延迟反馈问题的本质
延迟反馈问题本质上是一个数据观测完整性的挑战。在理想情况下,我们应该等到所有用户行为(包括可能的转化和退款)都完成后再进行模型训练。但在实际业务中,这种等待会导致模型更新严重滞后,无法满足实时竞价的需求。
以NetCVR预估为例,一个完整的用户旅程可能包含:
- 用户点击广告(即时可观测)
- 用户完成购买(可能有数小时甚至数天的延迟)
- 用户申请退款(购买后可能有7天甚至更长的犹豫期)
这种多阶段的延迟使得传统单阶段延迟反馈模型(如DEFER、DEFUSE等)难以直接应用。
2.2 多阶段延迟的独特性
多阶段延迟与单阶段延迟有几个关键区别:
- 级联效应:前一阶段的延迟会累积影响后一阶段。例如,购买行为的延迟会进一步推迟退款行为的观测。
- 阶段间依赖:后一阶段行为往往依赖于前一阶段的结果。没有购买就不会有退款。
- 标签翻转风险:早期标记为正向的样本(已购买)可能因为后续退款而变为负向。
这些特性使得简单的等待窗口策略或重要性采样方法效果有限。
3. TESLA框架深度解析
3.1 框架设计理念
TESLA框架的创新之处在于将NetCVR分解为两个相关但独立的子任务:
- 转化率预估(CVR)
- 退款率预估(RFR)
通过这种分解,TESLA能够:
- 分别处理两个阶段的延迟反馈
- 捕捉阶段间的相关性
- 保留各自任务的独特性
3.2 模型架构细节
TESLA采用多任务学习架构,包含以下核心组件:
- 共享编码层:学习用户和商品的通用特征表示
- CVR专用塔:专注学习转化行为的特异性模式
- RFR专用塔:专注学习退款行为的特异性模式
- 延迟感知模块:将延迟时间作为重要特征输入
这种共享-私有的架构设计既避免了完全独立建模导致的信息割裂,又防止了简单联合建模带来的任务干扰。
3.3 关键技术创新
3.3.1 分阶段重要性加权
TESLA采用两阶段纠偏策略:
- 对"点击-转化"阶段应用传统延迟反馈纠偏
- 对"转化-退款"阶段设计专门的退款延迟纠偏
这种分层处理方式比直接建模NetCVR能获得更准确的无偏估计。
3.3.2 延迟感知排序损失(DAR Loss)
DAR Loss的创新点在于:
- 为快速转化的样本分配更高权重
- 为快速退款的样本分配更高权重
- 将延迟时间直接作为训练信号
这种设计使模型能够优先学习高置信度的样本,有效缓解了标签模糊问题。
3.3.3 不确定性感知负采样
通过以下策略提升训练稳定性:
- 使用模型预测概率进行采样
- 优先选择低预测概率样本作为负例
- 动态调整采样比例
这种方法在流式训练中表现出色,显著降低了标签翻转带来的负面影响。
4. READER框架深度解析
4.1 GMV预估的特殊性
GMV预估与传统的CVR预估有几个关键区别:
- 回归任务:预测目标是连续值(交易金额)而非二分类
- 复购效应:单次点击可能引发多次购买
- 金额差异:不同商品的交易金额差异可能很大
这些特性使得传统的分类问题延迟反馈解决方案无法直接应用。
4.2 双分支架构设计
READER的核心创新是复购感知的双分支设计:
- 单次购买塔:专注处理只产生一次购买的点击
- 复购塔:专门处理会产生多次购买的点击
- 路由模块:预测点击属于哪种类型,决定使用哪个塔的输出
这种设计的关键优势在于:
- 不同购买模式可以有不同的特征交互方式
- 每个专家塔可以专注于特定模式的学习
- 通过路由机制实现软性切换,避免硬分割带来的误差
4.3 回归任务的标签纠偏
READER针对GMV预估的回归特性,提出了三项创新纠偏策略:
-
回归目标校准(Calib):
- 预训练校准器建模观察标签与真实标签的偏差
- 在流式训练中使用校准后的标签
-
真实标签对齐(GRA):
- 归因周期结束后用完整标签重新训练
- 确保模型最终收敛到真实分布
-
有偏标签遗忘(PLU):
- 识别并"忘记"早期有偏的标签更新
- 通过梯度上升实现选择性遗忘
这三项技术共同作用,有效缓解了回归任务中的延迟反馈偏差。
5. 数据集建设与实验验证
5.1 CASCADE数据集特点
阿里妈妈开源的CASCADE数据集具有以下重要特性:
- 包含完整的"点击-转化-退款"链路数据
- 时间戳精度达到15分钟级别
- 规模达到数千万样本量级
- 支持流式训练评估
这些特性使其成为研究NetCVR预估的理想基准。
5.2 TRACE数据集价值
TRACE数据集填补了GMV预估领域的空白:
- 记录每次点击引发的完整交易序列
- 包含精确的交易金额和时间戳
- 支持复购行为分析
- 适合在线学习研究
5.3 实验结果分析
TESLA和READER在各自任务上都取得了显著提升:
-
TESLA结果:
- NetCVR预估的AUC提升12.41%
- PRAUC提升14.94%
- 证明了级联建模的有效性
-
READER结果:
- GMV预估AUC提升0.86%
- 准确率提升2.19%
- 对数绝对误差降低6.88%
这些提升在实际业务中意味着可观的收入增长。
6. 实际应用建议
6.1 实施注意事项
在实际系统中部署这类模型时,需要注意:
-
数据时效性:
- 确保特征和标签的时间对齐
- 处理特征穿越问题
-
系统延迟:
- 平衡模型更新频率和计算成本
- 设计高效的特征回填机制
-
线上监控:
- 建立完整的指标监控体系
- 包括短期指标和长期指标
6.2 参数调优经验
基于实际部署经验,分享几个关键调优点:
-
延迟窗口选择:
- 转化延迟窗口通常设为7天
- 退款延迟窗口建议设为15-30天
- 需根据具体业务调整
-
损失函数权重:
- CVR和RFR任务的权重比例建议从1:1开始
- 根据业务重要性微调
-
路由阈值选择:
- READER的路由阈值θ建议初始设为0.7
- 通过AB测试找到最佳值
7. 未来发展方向
基于当前研究,以下几个方向值得进一步探索:
-
终身学习框架:
- 处理用户行为分布的长期变化
- 避免灾难性遗忘
-
多模态融合:
- 结合图像、文本等多媒体信息
- 提升模型对商品的理解能力
-
因果推理:
- 区分相关性和因果关系
- 提高模型的反事实推理能力
-
联邦学习:
- 在保护用户隐私的前提下
- 实现跨平台协同学习
这些方向都可能带来下一阶段的性能突破。
