登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
中外文期刊元数据语料
中外文期刊元数据语料
收藏
合肥数据要素流通平台
2026-03-11 更新
2026-03-13 收录
期刊元数据
模型训练
数据链接:
https://www.bigdatadex.com.cn/dataCirculation/listMoreb/details?shopId=2031615670695301122&commodityType=2
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
15000余种中文期刊元数据 可用于大模型语料训练
应用场景:
提供机构:
重庆维普资讯有限公司
创建时间:
2026-03-11
搜集汇总
背景与挑战
背景概述
该数据集是一个大规模的中外文期刊元数据集合,专注于提供超过15000种中文期刊的元数据信息。其主要特点是数据量丰富,以中文内容为核心,旨在支持大语言模型的语料训练需求,适用于自然语言处理和相关研究领域。
以上内容由遇见数据集搜集并总结生成
相关数据集
MBZUAI/LaMini-Hallucination
自然语言处理
模型训练
--- dataset_info: features: - name: question dtype: string - name: category dtype: string splits: - name: test num_bytes: 2785 num_examples: 40 download_size: 3220 datase
Hugging Face
2024-02-17 更新
15
0
Magpie-Llama-3.1-Pro-MT-500K-v0.1
自然语言处理
模型训练
 Project Web: [https://magpie-align.github.io/](https://magpie-align.github.io/) A
魔搭社区
2025-12-05 更新
13
0
pbelcak/pmc-train-4100000-to-4200000-GemmaTokens
自然语言处理
模型训练
--- dataset_info: features: - name: input_ids sequence: int32 - name: attention_mask sequence: int8 splits: - name: train num_bytes: 3302423177 num_examples: 694769 downloa
Hugging Face
2024-05-08 更新
8
0
ainewtrend07/EncoderLora
机器学习
模型训练
该数据集包含了模型训练和评估所需的多种参数和性能指标,如模型名称、训练集和测试集大小、是否自动寻找批处理大小、梯度累积步数、学习率、日志记录步数、学习率调度器类型、训练周期数、优化器类型、输出目录、报告输出位置、保存策略、保存限制、随机种子、预热步数、权重衰减、LoRA序列、参数数量、可训练参数数量、相关系数、内存分配和训练时间等。此外,数据集的性能指标包括准确率、宏平均F1分数、加权平均F1分数
Hugging Face
2025-10-19 更新
15
0
mekaneeky/masked_language_model_v0_1
自然语言处理
模型训练
--- dataset_info: features: - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: labels sequence: int64 splits: - name: train num_bytes: 25840065
Hugging Face
2023-04-24 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广