登录后查看消息通知
遇见数据集
杭州中亚汽配有限公司

杭州中亚汽配有限公司

企业

杭州中亚汽配有限公司围绕相关业务开展运营。面向维护预测、设备健康管理、精密磨削质量预测等领域提供数据服务,开放工业设备故障预测与健康评估分析数据(维护预测、设备健康管理)、工贸业万向节端面质量综合分析训练数据(精密磨削质量预测、汽车零部件工艺优化)、工贸行业十字轴轴径精磨单工序质量管控垂类大模型训练数据(制造质量智能管控、垂类大语言模型训练),支撑品质管理与工艺优化。

维护预测设备健康管理精密磨削质量预测
成立于 2000 年浙江省85370133@qq.com

数据概览

82
数据集总量
298
总浏览量
0
关注人数
2026-09-22
最近更新
分类统计

相关机构

  • 绍
    绍兴西奥电梯工程有限公司
    拥有数据集:34个
    企业
  • 盾
    盾构及掘进技术国家重点实验室
    拥有数据集:18个
    企业
  • 贵
    贵州乾之象生物科技有限责任公司
    拥有数据集:16个
    企业
  • 重
    重庆川仪自动化股份有限公司
    拥有数据集:15个
    企业
  • 马
    马鞍山易联仓储科技有限公司
    拥有数据集:6个
    企业

数据集列表

轴套冲压成型工序质量分析语料训练数据
冲压成型质量分析
工业大模型训练语料
本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解轴套冲压成型工序质量管控场景中的尺寸偏差、成型缺陷、模具磨损等核心需求,从而实现冲压件尺寸精度分析、模具状态评估、成型工艺优化等应用目标。依托企业真实冲压检验数据构建标准化语料体系,模型经训练后可精准理解"内口直径""轴套高度""内平厚度""外圆圆度""底部径向R"等轴套冲压工序特有检验指标及判定标准。万向节制造企业可基于本语料数据的分类如"单件检验分析""批次质量汇总""异常件诊断""工艺知识描述"等字段内容,适配自身冲压检验数据结构,快速启用冲压成型质量分析文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了轴套冲压成型工序的自然语言处理技术研发、模型训练与评测,对推动万向节制造行业冲压质量数据价值的深度挖掘和智能冲压分析技术的发展具有重要意义。1.数据清洗与标准化 数据清洗:按"品号+流转卡号+检验项目"去重,剔除重复语料;通过逻辑校验删除矛盾数据(如"内径偏差超出公差但判定合格");保留"项目检验结果=不合格"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。 格式统一:统一时间格式(YYYY-MM-DD)、检验指标名称(内口直径、轴套高度、内平厚度)、数值精度(保留4位小数);对"检验设备"字段补全,补全率100%。 2.语料分类与结构化 从过程检验记录中提取冲压成型工序数据,按"单件检验分析""批次质量汇总""异常件诊断""工艺知识描述"四种语料风格分类,标注"检验点""检验项目""判定结果"标签,确保覆盖冲压成型工序90%以上核心检验场景,构建基础语料库。 3.语料生成与质量校验 语料生成:基于品号、流转卡号、检验日期、检验点、检验项目、实际检验值、标准值、检验设备、判定结果等字段,按"产品+批次+工序+指标+数值+偏差+判定"七要素模板生成自然语言文本。 数值一致性校验:确保文本中引用的数值与原始数据完全一致,一致性率100%。 异常语料过滤:剔除文本长度小于50字或关键数值字段缺失的语料,过滤率≥99%。 人工核验:由资深质检工程师对生成语料进行抽样核验,核验比例≥5%,确保语料业务准确性。 4.语料库迭代优化 构建语料库的闭环迭代机制。新产生的检验数据及经核验的语料定期注入语料库。同时,通过分析大语言模型在实际应用中的反馈,定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。
浙江省数据知识产权登记平台2026-09-21 更新00
轴承生产批次追溯语料训练数据
轴承生产追溯
制造质量评估
本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解轴承生产批次追溯场景中的制造任务、流转卡、装配工序等核心需求,从而实现批次质量追溯、工序流转分析、装配异常定位等应用目标。依托企业真实制造任务数据构建标准化语料体系,模型经训练后可精准理解"制造任务号""品号""品名""计划量""排产数""实际量""实际进度"等轴承生产批次追溯特有指标及判定标准。万向节制造企业可基于本语料数据的分类如"生产批次追溯""工序流转记录""质量追溯分析""生产知识"等字段内容,适配自身轴承制造任务数据结构,快速启用轴承生产批次追溯文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了轴承生产批次追溯的自然语言处理技术研发、模型训练与评测,对推动万向节制造行业轴承生产追溯数据价值的深度挖掘和智能追溯技术的发展具有重要意义。1.数据清洗与标准化 数据清洗:按"任务号+品号"去重,剔除重复语料;通过逻辑校验删除矛盾数据;保留"实际进度<80%"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。 格式统一:统一时间格式(YYYY-MM-DD)、制造任务号标准化、品号编码标准化;对"品名"字段补全,补全率100%。 2.语料分类与结构化 从制造任务记录中提取轴承生产批次追溯数据,按"生产批次追溯""工序流转记录""质量追溯分析""生产知识"四种语料风格分类,标注"任务号""品号""排产状态"标签,确保覆盖轴承生产批次追溯90%以上核心场景,构建基础语料库。 3.语料生成与质量校验 语料生成:基于任务号、品号、品名、计划量、排产数、实际量、实际进度、排产状态、创建时间等字段,按"任务+品号+品名+计划量+排产数+实际量+进度+状态"八要素模板生成自然语言文本。 数值一致性校验:确保文本中引用的数值与原始数据完全一致,一致性率100%。 异常语料过滤:剔除文本长度小于50字或关键数值字段缺失的语料,过滤率≥99%。 人工核验:由资深生产工程师对生成语料进行抽样核验,核验比例≥5%,确保语料业务准确性。 4.语料库迭代优化 构建语料库的闭环迭代机制。新产生的生产数据及经核验的语料定期注入语料库。同时,通过分析大语言模型在实际应用中的反馈,定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。
浙江省数据知识产权登记平台2026-09-12 更新20
轴承装滚针工序质量分析语料训练数据
轴承装滚针工序质量分析
万向节装配质量控制
本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解轴承装滚针工序质量管控场景中的滚针选配、装配间隙、油脂填充等核心需求,从而实现装配质量分析、滚针选配优化、装配工艺改进等应用目标。依托企业真实装配检验数据构建标准化语料体系,模型经训练后可精准理解"滚针型号""轴承内切圆""轴承内油脂""油脂型号""轴承状态"等轴承装配工序特有检验指标及判定标准。万向节制造企业可基于本语料数据的分类如"装配检验分析""批次质量汇总""异常件诊断""工艺知识描述"等字段内容,适配自身装配检验数据结构,快速启用装配质量分析文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了轴承装滚针工序的自然语言处理技术研发、模型训练与评测,对推动万向节制造行业装配质量数据价值的深度挖掘和智能装配分析技术的发展具有重要意义。1.数据清洗与标准化 数据清洗:按"品号+流转卡号+检验项目"去重,剔除重复语料;通过逻辑校验删除矛盾数据(如"轴承内切圆超标但判定合格");保留"项目检验结果=不合格"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。 格式统一:统一时间格式(YYYY-MM-DD)、检验指标名称(滚针型号、轴承内切圆、轴承内油脂)、数值精度标准化;对"检验设备"字段补全,补全率100%。 2.语料分类与结构化 从过程检验记录中提取装滚针工序数据,按"装配检验分析""批次质量汇总""异常件诊断""工艺知识描述"四种语料风格分类,标注"检验项目""判定结果"标签,确保覆盖装滚针工序90%以上核心检验场景,构建基础语料库。 3.语料生成与质量校验 语料生成:基于品号、流转卡号、检验日期、检验项目、实际检验值、标准值、检验设备、判定结果等字段,按"产品+批次+工序+指标+数值+判定"六要素模板生成自然语言文本。 数值一致性校验:确保文本中引用的数值与原始数据完全一致,一致性率100%。 异常语料过滤:剔除文本长度小于50字或关键数值字段缺失的语料,过滤率≥99%。 人工核验:由资深装配工程师对生成语料进行抽样核验,核验比例≥5%,确保语料业务准确性。 4.语料库迭代优化 构建语料库的闭环迭代机制。新产生的检验数据及经核验的语料定期注入语料库。同时,通过分析大语言模型在实际应用中的反馈,定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。
浙江省数据知识产权登记平台2026-09-11 更新00
自动装配线设备运维语料训练数据
自动装配线设备运维
万向节制造智能运维
本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解自动装配线设备运维场景中的装配力矩、定位精度、节拍时间等核心需求,从而实现装配线状态诊断、节拍优化、装配质量保障等应用目标。依托企业真实设备保养数据构建标准化语料体系,模型经训练后可精准理解"装配力矩""定位精度""节拍时间""设备稼动率"等自动装配线设备运维特有指标及判定标准。万向节制造企业可基于本语料数据的分类如"设备运维记录""维护计划""故障分析""设备知识"等字段内容,适配自身装配设备保养数据结构,快速启用装配设备运维文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了自动装配线设备运维的自然语言处理技术研发、模型训练与评测,对推动万向节制造行业装配设备运维数据价值的深度挖掘和智能运维技术的发展具有重要意义。1.数据清洗与标准化 数据清洗:按"设备编号+保养日期+保养项目"去重,剔除重复语料;通过逻辑校验删除矛盾数据;保留"设备状态=异常"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。 格式统一:统一时间格式(YYYY-MM-DD)、设备名称标准化(自动装配线)、数值精度标准化;对"保养项目"字段补全,补全率100%。 2.语料分类与结构化 从设备保养记录中提取自动装配线运维数据,按"设备运维记录""维护计划""故障分析""设备知识"四种语料风格分类,标注"保养项目""保养情况""验收结果"标签,确保覆盖自动装配线运维90%以上核心场景,构建基础语料库。 3.语料生成与质量校验 语料生成:基于设备编号、保养日期、保养项目、保养标准、保养情况、验收结果等字段,按"设备+日期+项目+标准+情况+验收"六要素模板生成自然语言文本。 数值一致性校验:确保文本中引用的数值与原始数据完全一致,一致性率100%。 异常语料过滤:剔除文本长度小于50字或关键数值字段缺失的语料,过滤率≥99%。 人工核验:由资深装配工程师对生成语料进行抽样核验,核验比例≥5%,确保语料业务准确性。 4.语料库迭代优化 构建语料库的闭环迭代机制。新产生的保养数据及经核验的语料定期注入语料库。同时,通过分析大语言模型在实际应用中的反馈,定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。
浙江省数据知识产权登记平台2026-09-08 更新00
网带炉热处理设备运维语料训练数据
热处理设备运维
制造行业垂类大语言模型训练
本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解网带炉热处理设备运维场景中的炉温控制、碳势管理、淬火介质等核心需求,从而实现热处理炉状态诊断、工艺参数优化、质量异常追溯等应用目标。依托企业真实设备保养数据构建标准化语料体系,模型经训练后可精准理解"炉温均匀性""碳势控制""网带速度""淬火介质""渗碳"等网带炉热处理设备运维特有指标及判定标准。万向节制造企业可基于本语料数据的分类如"设备运维记录""维护计划""故障分析""设备知识"等字段内容,适配自身热处理设备保养数据结构,快速启用热处理设备运维文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了网带炉热处理设备运维的自然语言处理技术研发、模型训练与评测,对推动万向节制造行业热处理设备运维数据价值的深度挖掘和智能运维技术的发展具有重要意义。1.数据清洗与标准化 数据清洗:按"设备编号+保养日期+保养项目"去重,剔除重复语料;通过逻辑校验删除矛盾数据;保留"设备状态=异常"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。 格式统一:统一时间格式(YYYY-MM-DD)、设备名称标准化(网带炉热处理)、数值精度标准化;对"保养项目"字段补全,补全率100%。 2.语料分类与结构化 从设备保养记录中提取网带炉运维数据,按"设备运维记录""维护计划""故障分析""设备知识"四种语料风格分类,标注"保养项目""保养情况""验收结果"标签,确保覆盖网带炉运维90%以上核心场景,构建基础语料库。 3.语料生成与质量校验 语料生成:基于设备编号、保养日期、保养项目、保养标准、保养情况、验收结果等字段,按"设备+日期+项目+标准+情况+验收"六要素模板生成自然语言文本。 数值一致性校验:确保文本中引用的数值与原始数据完全一致,一致性率100%。 异常语料过滤:剔除文本长度小于50字或关键数值字段缺失的语料,过滤率≥99%。 人工核验:由资深热处理工程师对生成语料进行抽样核验,核验比例≥5%,确保语料业务准确性。 4.语料库迭代优化 构建语料库的闭环迭代机制。新产生的保养数据及经核验的语料定期注入语料库。同时,通过分析大语言模型在实际应用中的反馈,定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。
浙江省数据知识产权登记平台2026-09-04 更新50
万向节全工序质量追溯综合语料训练数据
万向节全工序质量追溯
跨工序异常诊断
本数据产品专为训练制造行业垂类大语言模型而构建,旨在让模型能够深度理解万向节全工序质量追溯场景中的跨工序质量关联、多产品协同检验、全流程质量管控等核心需求,从而实现全工序质量追溯报告自动生成、跨工序异常关联分析、全流程质量预警等应用目标。依托企业真实跨工序过程检验数据构建标准化语料体系,模型经训练后可精准理解十字轴、轴套、热处理件、轴承等多产品跨工序的检验指标及判定标准。可基于本语料数据的分类如"跨工序检验分析""多产品对比""异常关联诊断""全流程知识"等字段内容,适配自身全工序检验数据结构,快速启用全工序质量追溯文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了万向节全工序质量追溯的自然语言处理技术研发、模型训练与评测,对推动制造行业全流程质量数据价值的深度挖掘和智能追溯技术的发展具有重要意义。1.数据清洗与标准化 数据清洗:按"品号+流转卡号+检验项目"去重,剔除重复语料;通过逻辑校验删除矛盾数据;保留"项目检验结果=不合格"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。 格式统一:统一时间格式(YYYY-MM-DD)、检验指标名称标准化、数值精度(保留4位小数)。 2.语料分类与结构化 从过程检验记录中提取跨工序综合数据,按"跨工序检验分析""多产品对比""异常关联诊断""全流程知识"四种语料风格分类,标注"品名""工序""检验项目""判定结果"标签,确保覆盖万向节全工序90%以上核心检验场景,构建基础语料库。 3.语料生成与质量校验 语料生成:基于工序、流转卡号、检验日期、检验点、检验项目、实际检验值、标准值、检验设备、判定结果等字段,按"工序+批次+指标+数值+偏差+判定"要素模板生成自然语言文本。 数值一致性校验:确保文本中引用的数值与原始数据完全一致,一致性率100%。 异常语料过滤:剔除文本长度小于50字或关键数值字段缺失的语料,过滤率≥99%。 人工核验:由资深质检工程师对生成语料进行抽样核验,核验比例≥5%,确保语料业务准确性。 4.语料库迭代优化 构建语料库的闭环迭代机制。新产生的检验数据及经核验的语料定期注入语料库。同时,通过分析大语言模型在实际应用中的反馈,定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。
浙江省数据知识产权登记平台2026-09-16 更新00
双端面磨床设备运维语料训练数据
双端面磨床运维
设备运维文本生成
本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解双端面磨床设备运维场景中的端面磨削精度、砂轮磨损、主轴状态等核心需求,从而实现双端面磨床状态诊断、保养计划优化、故障预警等应用目标。依托企业真实设备保养数据构建标准化语料体系,模型经训练后可精准理解"端面磨削""砂轮磨损""主轴精度""冷却系统""进给机构"等双端面磨床设备运维特有指标及判定标准。万向节制造企业可基于本语料数据的分类如"设备运维记录""维护计划""故障分析""设备知识"等字段内容,适配自身设备保养数据结构,快速启用双端面磨床运维文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了双端面磨床设备运维的自然语言处理技术研发、模型训练与评测,对推动万向节制造行业磨削设备运维数据价值的深度挖掘和智能运维技术的发展具有重要意义。1.数据清洗与标准化 数据清洗:按"设备编号+保养日期+保养项目"去重,剔除重复语料;通过逻辑校验删除矛盾数据;保留"设备状态=异常"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。 格式统一:统一时间格式(YYYY-MM-DD)、设备名称标准化(双端面磨床)、数值精度标准化;对"保养项目"字段补全,补全率100%。 2.语料分类与结构化 从设备保养记录中提取双端面磨床运维数据,按"设备运维记录""维护计划""故障分析""设备知识"四种语料风格分类,标注"保养项目""保养情况""验收结果"标签,确保覆盖双端面磨床运维90%以上核心场景,构建基础语料库。 3.语料生成与质量校验 语料生成:基于设备编号、保养日期、保养项目、保养标准、保养情况、验收结果等字段,按"设备+日期+项目+标准+情况+验收"六要素模板生成自然语言文本。 数值一致性校验:确保文本中引用的数值与原始数据完全一致,一致性率100%。 异常语料过滤:剔除文本长度小于50字或关键数值字段缺失的语料,过滤率≥99%。 人工核验:由资深设备工程师对生成语料进行抽样核验,核验比例≥5%,确保语料业务准确性。 4.语料库迭代优化 构建语料库的闭环迭代机制。新产生的保养数据及经核验的语料定期注入语料库。同时,通过分析大语言模型在实际应用中的反馈,定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。
浙江省数据知识产权登记平台2026-09-12 更新20
降低十字轴磨削不良率的工序质量诊断大模型指令微调数据
十字轴磨削质量诊断
磨削缺陷分析
本数据集聚焦十字轴磨削工序的质量诊断场景,旨在让AI大模型理解十字轴磨削工序的质量诊断,采集了十字轴磨削加工过程中12种典型缺陷类型(磨削烧伤、磨削裂纹、表面粗糙度超差、直径尺寸超差、圆度超差、圆柱度超差、端面跳动超差、同轴度超差、表面波纹度、烧伤软点、直线度超差、磨削台阶)的工艺参数、质量检测数据、缺陷原因及诊断方法等多维度信息。数据集涵盖粗磨轴径、软磨端面、精磨轴径、精磨端面、一次磨五道磨削工序,包含砂轮线速度、进给速度、磨削深度、冷却液流量等关键工艺参数与质量特性的对应关系。通过构建结构化的指令微调数据,支持大模型学习十字轴磨削工序质量诊断的推理能力,实现从"缺陷现象识别→缺陷原因分析→诊断方法选择→纠正措施制定"的全链路质量诊断,有效降低十字轴磨削不良率,提升万向节产品质量一致性。原始数据来源于公司十字轴磨削工序质量检测记录。数据构建遵循以下规则: 1.指令生成规则:以十字轴磨削质量诊断为任务场景,设计6类指令模板——缺陷类型识别诊断、缺陷原因分析定位、诊断方法选择应用、纠正措施制定匹配、工艺参数优化调整、质量趋势预测预警。每类指令结合具体工艺参数、缺陷特征和检测数据生成,确保指令多样性和业务贴合度。 2.知识注入规则:将磨削热力学理论、磨削烧伤机理、无心磨削原理、磨削表面完整性、SPC统计过程控制、磨削参数优化理论、磨削液作用机理、砂轮特性、十字轴热处理与磨削关联、质量诊断推理方法等专业知识注入到knowledge_context字段。每条数据至少包含5个实体关系三元组,涵盖磨削工艺-缺陷关系、缺陷-诊断方法关系、工序-设备关系、材料-热处理关系等,形成完整的质量诊断知识图谱。 3.推理链构建规则:按照缺陷现象确认→工艺参数分析→多因素根因定位→诊断方法选择→纠正措施制定→效果验证的六步推理逻辑构建reasoning_chain,确保推理过程可追溯、可解释。推理链长度覆盖3-6步,复杂场景包含不少于5个推理步骤,平均推理链长度208字符。 4.参数区间映射规则:磨削工艺参数按照实际生产范围取值——砂轮线速度25-45m/s、进给速度0.3-3.0m/min、磨削深度0.005-0.05mm、冷却液流量20-60L/min。质量特性值按照行业标准设定公差范围——表面粗糙度Ra≤0.8μm、直径公差±0.01mm、圆度≤0.005mm、端面跳动≤0.02mm。缺陷场景模拟时,工艺参数在标准值基础上偏移5%-20%,以生成符合实际的缺陷数据。 难度分级规则:按照质量诊断复杂度分为三级——简单(单一缺陷类型+标准诊断方法,占比约30%)、中等(多因素关联缺陷+综合诊断方法,占比约50%)、复杂(交叉缺陷+多方案对比+优化建议,占比约20%)。难度与推理链步数、参数维度数量正相关。
浙江省数据知识产权登记平台2026-09-09 更新70
轴套冲压成型工序质量分析语料训练数据
冲压成型质量分析
万向节制造
本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解轴套冲压成型工序质量管控场景中的尺寸偏差、成型缺陷、模具磨损等核心需求,从而实现冲压件尺寸精度分析、模具状态评估、成型工艺优化等应用目标。依托企业真实冲压检验数据构建标准化语料体系,模型经训练后可精准理解"内口直径""轴套高度""内平厚度""外圆圆度""底部径向R"等轴套冲压工序特有检验指标及判定标准。万向节制造企业可基于本语料数据的分类如"单件检验分析""批次质量汇总""异常件诊断""工艺知识描述"等字段内容,适配自身冲压检验数据结构,快速启用冲压成型质量分析文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了轴套冲压成型工序的自然语言处理技术研发、模型训练与评测,对推动万向节制造行业冲压质量数据价值的深度挖掘和智能冲压分析技术的发展具有重要意义。
浙江省数据知识产权登记平台2026-09-08 更新00
万向节产品全生命周期知识语料训练数据
万向节制造知识问答
工艺参数推荐
本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解万向节产品全生命周期知识场景中的产品体系、工艺标准、检验规范、设备运维、供应链管理等核心需求,从而实现全生命周期知识问答、工艺参数推荐、质量标准查询等应用目标。依托企业真实全流程经营数据构建标准化语料体系,模型经训练后可精准理解万向节全品类产品(十字轴、轴套、轴承、滚针等)的工艺路线、检验标准、设备参数、供应链信息等全生命周期知识。万向节制造企业可基于本语料数据的分类如"产品知识""工艺知识""检验知识""设备知识""供应链知识"等字段内容,适配自身产品体系数据结构,快速启用全生命周期知识文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了万向节全生命周期知识的自然语言处理技术研发、模型训练与评测,对推动万向节制造行业全流程知识数据价值的深度挖掘和智能知识管理技术的发展具有重要意义。1.数据清洗与标准化 数据清洗:按"品号+流转卡号+检验项目"去重,剔除重复语料;通过逻辑校验删除矛盾数据;保留"项目检验结果=不合格"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。 格式统一:统一时间格式(YYYY-MM-DD)、检验指标名称标准化、数值精度(保留4位小数);对"检验设备"字段补全,补全率100%。 2.语料分类与结构化 从过程检验记录中提取全品类数据,按"产品知识""工艺知识""检验知识""设备知识""供应链知识"五种语料风格分类,标注"品名""工序""检验项目""判定结果"标签,确保覆盖万向节全生命周期90%以上核心知识场景,构建基础语料库。 3.语料生成与质量校验 语料生成:基于品号、品名、工序、流转卡号、检验日期、检验点、检验项目、实际检验值、标准值、检验设备、判定结果等字段,按"产品+工序+批次+指标+数值+偏差+判定"七要素模板生成自然语言文本。 数值一致性校验:确保文本中引用的数值与原始数据完全一致,一致性率100%。 异常语料过滤:剔除文本长度小于50字或关键数值字段缺失的语料,过滤率≥99%。 人工核验:由资深工程师对生成语料进行抽样核验,核验比例≥5%,确保语料业务准确性。 4.语料库迭代优化 构建语料库的闭环迭代机制。新产生的检验数据及经核验的语料定期注入语料库。同时,通过分析大语言模型在实际应用中的反馈,定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。
浙江省数据知识产权登记平台2026-09-02 更新20
关于我们
遇见数据集——让每个数据集都被发现,让每一次遇见都有价值。
数发科官网www.sfktec.com
联系我们
selectdataset@iotsh.com.cn
商业合作
数据驱动未来,携手共赢发展
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15沪公网安备31010402336585号
热门搜索