遇见数据集

建筑企业资质业绩智能匹配问数垂类大模型语料数据

收藏
浙江省数据知识产权登记平台2026-07-27 更新2026-07-31 收录
官方服务:

资源简介:

本数据产品专为训练建筑行业企业资质业绩智能匹配领域垂类大语言模型而构建。 当前,建筑企业在参与项目投标和资质升级时,需要将企业资质(资质名称、资质等级、资质类别)与历史业绩(业绩项目名称、工程类型、项目所在地、合同金额、开工竣工日期、业绩角色)进行精准匹配验证,但企业资质业绩信息分散、数据格式不统一,跨平台查询效率低下且难以实现精准匹配。 本数据产品采用Text-to-SQL(自然语言转SQL)技术路径,紧密适配资质业绩信息表结构,覆盖企业资质业绩总览、业绩工程类型查询、金额范围筛选、日期范围查询、企业多资质查询、多条件组合查询、资质业绩匹配、业绩数量统计、资质业绩综合查询等18种典型查询场景,生成高质量的自然语言问题-SQL语句-叙述式结果三元组训练语料。 语料数据可直接适配企业自身数据表结构,实现快速复用和部署。 作为建筑行业稀缺的、高质量的垂直领域语料,本数据产品为垂类大语言模型的训练和优化提供了有力支撑,对推动建筑行业数据要素价值释放和AI技术应用落地具有重要意义。

创建时间:
2026-07-27
搜集汇总
数据集介绍
建筑企业资质业绩智能匹配问数垂类大模型语料数据 数据集图片
背景与挑战
背景概述
该数据集为建筑行业企业资质与历史业绩智能匹配场景构建的垂类大语言模型训练语料。其核心内容围绕企业资质(资质名称、等级、类别)与历史业绩(项目名称、工程类型、合同金额、日期、角色等)的精准匹配验证需求,通过Text-to-SQL技术路径覆盖多条件组合查询、业绩统计等18种典型查询场景,产出自然语言问题、SQL语句与叙述式结果的三元组语料,可直接适配企业数据表结构,用于垂类大模型的训练与优化。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务