遇见数据集

跨境商品消费偏好垂类大模型语料数据

收藏
浙江省数据知识产权登记平台2026-07-22 更新2026-07-23 收录
官方服务:

资源简介:

本数据产品专为训练跨境电商商品分析领域垂类大语言模型构建,旨在提升模型对商品销售表现、店铺结构、价格带分布、折扣策略、类目映射及异常商品识别等问题的理解能力,并将自然语言问题转换为可执行查询语句。数据以跨境商品销售明细为核心,包含店铺ID、商品ID、商品名称、折扣价、原价、品类信息、统计周期、销量、销售额及全品类汇总字段,可支持热销商品识别、头部店铺排行、主力品类判断、价格带渗透分析、折扣效果评估、爆款贡献测算及类目映射核查等业务场景。经训练后,模型可更准确理解“折扣价”“销量”“销售金额”“类目映射”“价格带分布”等高频概念,企业可结合自身商品库和订单库快速用于商品问答、选品辅助、价格分析、促销复盘及类目治理。对行业而言,这类语料能够把多语种商品信息、商品交易数据和经营分析需求连接起来,降低跨境电商企业对人工取数和人工写SQL的依赖,为商品运营智能化、数据分析能力建设以及垂类模型训练与评测提供更有针对性的基础数据支撑。

创建时间:
2026-07-22
搜集汇总
数据集介绍
跨境商品消费偏好垂类大模型语料数据 数据集图片
背景与挑战
背景概述
该数据产品专为训练跨境电商商品分析领域的垂类大语言模型而构建,旨在提升模型对商品销售表现、店铺结构、价格带分布等问题的理解能力。数据以跨境商品销售明细为核心,包含店铺ID、商品ID、品类信息等字段,可支持热销商品识别、折扣效果评估等业务场景,帮助企业降低对人工取数和SQL的依赖。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务