美团搜索3.0:LLM 语义表征在排序模型的探索与应用
·
在大语言模型(LLM)技术的深刻影响下,搜索引擎正经历第三次范式跃迁:从 1.0 时代的“关键词文本匹配”,到 2.0 时代的“行为统计与个性化搜索”,再到 3.0 时代向“复杂意图理解与认知决策”的全面进化。 美团搜索团队正依托团垂融合新架构与生成式大模型新技术,全面重构本地生活搜索底座。本系列技术博客将持续介绍美团搜索 3.0 的技术探索,本文聚焦 LLM 语义表征在服务零售排序场景上的三期实践——从单点特征验证到系统性表征体系构建,再到跨场景迁移复用,探索语义匹配信号在搜索排序中的应用路径。 一、背景与动机 服务零售是将服务销售给最终消费者的商业活动,与之对应的概念为商品零售。服务零售和商品零售是美团零售业务的两个主要组成部分。 在美团搜索场景下,相较于到家和其他到店业务,服务零售具有以下显著特点: 品类丰富:覆盖丽人、休闲娱乐、家政、进场零售等众多细分行业。 搜索需求类型丰富:交易型、信息型、留资型并存。 供给非标准化程度高:交易内容的多维组合性(e.g. 券、时间、位次、场次、空间、技师等)以及基于”人”和”场所”进行履约,共同促使供给的个性化和非标准化。 传统精排模型的语义建模高度依赖文本匹配,但这类特征构建成本高、泛化能力弱,在面对服务零售大量长尾品类、复杂 Query 意图时尤为明显。例如,”宠物 SPA+洗澡”这个 Query 对应的商品名称可能是”萌宠清洁护理套餐”、”春节大扫除”这个 Query 对应的商品名称可能是”深度保洁服务套餐”,在这些 Case 中,搜索词和供给在文字上几乎没有重叠,但语义上是高度相关的。 这类语义 Gap 在美团服务零售搜索场景(生活服务、休闲娱乐等)尤为突出。服务零售的品类长尾分散、商品描述非结构化、Query 意图复杂多样,传统特征工程难以覆盖。而大语言模型(LLM)在语义理解方面的能力成熟度正在快速提升,给我们带来了新的解题思路。 从 2025 年 Q4 到 2026 年 Q2,服务零售搜索排序团队系统性地探索了 LLM 在精排模型中的应用,核心方向是用 LLM 为搜索词(Query)、商家(POI)和商品(Deal)生成高质量的语义向量表征,将语义匹配信息以 cosine 相似度的形式注入排序模型,弥补传统特征在语义理解上的不足。经过三期迭代,累计完成 3 个 Launch Review(LR),均已完成全量上线,带来了显著的线上收益。 下图展示了三期技术演进的整体脉络。每一期都在前一期的基础上进行系统性升级,从验证可行性到全面优化再到跨模块迁移复用,逐步构建起一套完整的语义表征体系。 二、一期:精排引入大模型语义表征(验证可行性) 2.1 核心思路 服务零售精排在语义层面的建模几乎为零,排序模型主要依赖少量文本匹配和 Query 统计类特征。所以一期的目标很纯粹:验证…