LLM4ES: Learning User Embeddings from Event Sequences via Large Language Models

发布时间:2026/10/5 2:15:23
LLM4ES: Learning User Embeddings from Event Sequences via Large Language Models 文章主要内容和创新点主要内容本文提出了一种名为LLM4ES的新型框架,旨在利用预训练大型语言模型(LLMs)从事件序列中提取高质量的用户嵌入。其核心流程包括:将结构化事件序列(如金融交易、医疗记录等)转换为文本表示;通过文本富集技术(利用预训练LLM将事件序列重写为多样化格式和风格的文本)增强数据语义;在富集后的文本上微调LLM(以next-token预测为目标),并通过平均模型最后8层的隐藏状态提取用户嵌入;在金融(如用户流失、性别、年龄分类)和非金融(如电影偏好的性别/年龄预测、客户终身价值预测)领域验证,结果显示LLM4ES在用户分类任务中性能优于现有方法,且与其他方法集成时表现更优。创新点提出LLM4ES框架:通过将事件序列转换为富集文本并微调LLM,提取通用用户嵌入,在金融和非金融数据集上较现有方法实现高达7%的ROC-AUC相对提升,且与CoLES等方法集成时性能进一步提升(如年龄预测任务提升3.3%)。引入文本富集技术:针对低变异性领域(事件序列数据往往格式单一),利用LLM将事件序列重写为多样化文本格式,解决LLM在结构化数据上的分布偏移问题,较原始序列化数据训练实现1.8%的ROC-AUC相对提升。翻译部分摘要本文提出了LLM4ES,这是一种新颖的框架,它利用预训练的大型语言模型(LLMs)从事件

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询