遇见数据集

健康体检用户画像问数垂类大模型语料数据

收藏
浙江省数据知识产权登记平台2026-09-17 更新2026-09-18 收录
官方服务:

资源简介:

该数据可用于训练健康体检用户画像问数垂类大语言模型,使其能够理解体检用户在人群结构、年龄分布、性别结构、婚育状态、套餐偏好、支付状态、消费金额和复购分层等方面的自然语言查询,并准确转换为SQL。依托 `dwd_exam_user_profile_fact` 表中的 `order_code`、`user_code`、`order_month`、`institution_type`、`gender`、`age_band`、`marital_status`、`pregnancy_status`、`package_category`、`payment_status`、`order_amount`、`repeat_segment` 等字段,模型可回答“25-34岁女性更偏好哪些套餐”“已婚用户支付完成率如何”“复购用户平均消费金额是多少”“不同年龄段用户退款结构如何”等体检用户经营问题。平台可基于该语料构建面向客群洞察、套餐推荐、专项营销和用户运营复盘的自然语言查询能力,帮助业务人员快速理解用户结构与套餐需求的关系。本数据为健康体检行业提供面向用户画像分析的问数语料库,支撑人群分层运营、产品供给

创建时间:
2026-09-17
搜集汇总
数据集介绍
健康体检用户画像问数垂类大模型语料数据 数据集图片
背景与挑战
背景概述
该数据集是面向健康体检用户画像问数垂类大模型训练的语料数据,旨在使模型理解体检用户在人群结构、年龄分布、套餐偏好、支付状态等方面的自然语言查询并转换为SQL。依托`dwd_exam_user_profile_fact`表中的相关字段,模型可回答体检用户经营问题,支撑客群洞察、套餐推荐和用户运营复盘。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务