遇见数据集

十字轴精磨端面工序质量分析语料训练数据

收藏
浙江省数据知识产权登记平台2026-08-19 更新2026-08-20 收录
官方服务:

资源简介:

本数据产品专为训练万向节制造行业垂类大语言模型而构建,旨在让模型能够深度理解十字轴精磨端面工序质量管控场景中的端面长度、端面对称、端面跳动等核心需求,从而实现端面精度分析、对称度评估、跳动量控制等应用目标。依托企业真实端面检验数据构建标准化语料体系,模型经训练后可精准理解"端面长度""端面对称""端面跳动""端面粗糙度"等精磨端面工序特有检验指标及判定标准。万向节制造企业可基于本语料数据的分类如"单件检验分析""批次质量汇总""异常件诊断""工艺知识描述"等字段内容,适配自身端面检验数据结构,快速启用精磨端面质量分析文本生成功能进行复用。本数据为万向节制造企业提供了稀缺的、高质量的垂直领域语料,有力支撑了十字轴精磨端面工序的自然语言处理技术研发、模型训练与评测,对推动万向节制造行业端面质量数据价值的深度挖掘和智能端面分析技术的发展具有重要意义。1.数据清洗与标准化:按"品号+流转卡号+检验项目+检验点"组合键去重,剔除同一工件同一检验项目的重复检验记录;通过逻辑校验删除矛盾数据;保留"判定结果=不合格"的样本,增强模型对异常场景的处理能力,清洗后数据有效率≥98%。格式统一:统一时间格式、检验项目名称标准化、数值精度保留 4 位小数;对"检验设备"字段补全。 2.语料分类与结构化:从过程检验记录中提取精磨工序数据,按"单件检验分析"、"批次质量汇总"、"异常件诊断"、"工艺知识描述"四种语料风格分类,标注"检验项目""检验设备""判定结果"标签,确保覆盖精磨轴径工序 90%以上核心检验场景,构建基础语料库。 3.语料数值一致性校验:确保文本中引用的数值与实际检验值、标准要求字段完全一致,一致性率 100%。异常语料过滤:剔除文本长度小于 20 字或关键数值字段缺失的语料,过滤率≥99%。人工核验:对生成语料进行抽样核验,核验比例≥5%,确保语料业务准确性。 4.语料库迭代优化:构建语料库的闭环迭代机制。新产生的检验数据及经核验的语料定期注入语料库。定位语料库的薄弱环节并进行针对性补充,形成"应用-反馈-优化"良性循环,持续提升语料库的覆盖度和质量。

创建时间:
2026-06-30
搜集汇总
数据集介绍
十字轴精磨端面工序质量分析语料训练数据 数据集图片
背景与挑战
背景概述
该数据集为万向节制造行业垂类大语言模型训练提供高质量的十字轴精磨端面工序质量分析语料,涵盖端面长度、对称度、跳动等检验指标,支持端面精度分析、对称度评估等应用。数据基于企业真实检验记录构建,经过清洗、分类、数值一致性校验和人工核验,按单件检验分析、批次质量汇总等类别结构化,覆盖90%以上核心检验场景,并具备闭环迭代优化机制,有力支撑行业自然语言处理技术研发与模型评测。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务