遇见数据集

工贸行业十字轴轴径精磨工序工业大模型训练数据

收藏
浙江省数据知识产权登记平台2026-07-19 更新2026-07-20 收录
官方服务:

资源简介:

本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解十字轴精磨轴径工序质量管控场景中的检验数据、偏差分析、异常诊断等核心需求,从而实现质量分析报告自动生成、异常原因智能诊断、工艺参数优化建议等应用目标。依托企业真实过程检验数据构建标准化语料体系,模型经训练后可精准理解"轴径外圆""圆度""粗糙度""开档长度"等万向节精磨工序特有检验指标及判定标准。 制造行业的企业可基于本语料数据的分类如"单件检验分析""批次质量汇总""异常件诊断""工艺知识描述"等字段内容,适配自身检验数据结构,快速启用质量分析文本生成功能进行复用。本数据为工贸行业制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了十字轴精磨轴径工序的自然语言处理技术研发、模型训练与评测,对推动工贸制造行业质量数据价值的深度挖掘和智能质量分析技术的发展具有重要意义。1.数据清洗与标准化 数据清洗:按"品号+流转卡号+检验项目"去重,剔除重复语料;通过逻辑校验删除矛盾数据(如"轴径偏差超出公差但判定合格");保留"项目检验结果=不合格"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。格式统一:统一时间格式(YYYY-MM-DD)、检验指标名称(轴径、圆度、粗糙度)、数值精度(保留4位小数)。 2.语料分类与结构化 从过程检验记录中提取精磨轴径工序数据,按"单件检验分析""批次质量汇总""异常件诊断""工艺知识描述"四种语料风格分类,标注"检验点""检验项目""判定结果"标签,确保覆盖精磨轴径工序90%以上核心检验场景,构建基础语料库。 3.语料生成与质量校验 语料生成:基于品号、流转卡号、检验日期、检验点、检验项目、实际检验值、标准值、检验设备、判定结果等字段,按"产品+批次+工序+指标+数值+偏差+判定"七要素模板生成自然语言文本,文本内容包括检验数据描述、偏差分析、工序状态判定、异常原因诊断等要素。数值一致性校验:确保文本中引用的数值与原始数据完全一致,一致性率100%。 异常语料过滤:剔除文本长度小于50字或关键数值字段缺失的语料,过滤率≥99%。 人工核验:由资深质检工程师对生成语料进行核验,确保语料业务准确性。 4.语料库迭代优化 构建语料库的闭环迭代机制。新产生的检验数据及经核验的语料定期注入语料库。同时,通过分析大语言模型在实际应用中的反馈(如行业术语理解错误、工艺参数描述偏差),定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。

创建时间:
2026-06-02
搜集汇总
数据集介绍
工贸行业十字轴轴径精磨工序工业大模型训练数据 数据集图片
背景与挑战
背景概述
该数据集基于企业真实过程检验记录构建,专为训练万向节制造行业垂类大语言模型而设计,旨在使模型深入理解十字轴精磨轴径工序的质量管控场景,支持质量分析报告自动生成、异常原因智能诊断及工艺参数优化等应用。数据经过严格清洗、标准化和结构化处理,按单件检验分析、批次质量汇总等四种风格分类,并采用“七要素”模板生成自然语言文本,确保数值一致性达100%,覆盖核心检验场景90%以上。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务