登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
『現代日本語書き言葉均衡コーパス』品詞構成表(Version 1.1)
『現代日本語書き言葉均衡コーパス』品詞構成表(Version 1.1)
收藏
repository.ninjal.ac.jp
2025-03-23 收录
日语语言学
自然语言处理
数据链接:
https://repository.ninjal.ac.jp/record/3233/files/BCCWJ_frequencylist_pos_ver1_1.zip
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
National Institute for Japanese Language and Linguistics
日本语言与语言学国家研究院
应用场景:
提供机构:
repository.ninjal.ac.jp
相关数据集
prli/pubmed-full_chopped_pyt_llama_alpha_0-1
医学文本处理
自然语言处理
该数据集包含文本、元信息、句子扰动数量以及文档统计信息。文本是数据集的主要特征,元信息中包含了数据集的集合名称。文档统计信息详细记录了文档的优势分数、长度变化比例、原始句子长度、替换后的句子长度等多个统计数据。数据集分为验证集,验证集大小为4000个样本。
Hugging Face
2025-10-14 更新
13
0
line.10.9.10.10000
文本生成
自然语言处理
该数据集包含输入文本(input_text)和目标文本(target_text)两个字段,适用于研究文本生成任务。数据集分为训练集和验证集,其中训练集有10000个样本,验证集有1024个样本。数据集用于支持论文《Roll the dice & look before you leap: Going beyond the creative limits of next-token predicti
Hugging Face
2025-05-27 更新
9
0
luca0621/multi-RLHF-processed-llama1B-dataset-with-1000-rewards
自然语言处理
强化学习
该数据集包含查询(query)、响应(response)和奖励(reward)三个特征,其中查询和响应为字符串类型,奖励为浮点数类型。数据集分为训练集和测试集,训练集包含8000个样本,测试集包含2000个样本。总下载大小为2276183字节,数据集总大小为7148705字节。
Hugging Face
2024-11-30 更新
7
0
Dawnnn0429/MathInstruct-PoT-NumGLUE
数学教育
自然语言处理
该数据集包含三个字段:来源(source),指令(instruction)和输出(output),均为文本格式。数据集分为训练集和测试集两部分,其中训练集包含12126个示例,测试集包含1348个示例。数据集主要用于某种文本生成或处理任务,具体应用场景需结合字段内容和数据集划分进一步分析。
Hugging Face
2025-11-12 更新
10
0
ElementXMaster/conversational_data
自然语言处理
该数据集包含文本字符串类型的特征,划分为训练集,共有2,866,645个示例,总大小为5,380,175,829字节。数据集的默认配置指定了训练集的数据文件路径。
Hugging Face
2025-03-25 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广