登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Natual Language Modeling Data
Natual Language Modeling Data
收藏
kaggle
2025-10-20 更新
2025-12-06 收录
自然语言处理
语言建模
数据链接:
https://www.kaggle.com/datasets/optimusstudios/natual-language-modeling-data
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Natual Language Modeling
自然语言建模(Natural Language Modeling)
应用场景:
创建时间:
2025-07-12
相关数据集
JGTV_Pref_DS
自然语言处理
机器学习
该数据集包含多个特征字段,如prompt(提示)、choices(选择)、label(标签)、source(来源)等,以及不同模型(如mistral、gemma、llama)的偏好和拒绝输出。数据集分为训练集,包含9348个样本,总大小为28685328字节。
Hugging Face
2025-01-30 更新
14
0
Results for different types and sizes of n-grams in complete novels using ALL features.
自然语言处理
n-gram
Results for different types and sizes of n-grams in complete novels using ALL features.
NIAID Data Ecosystem
9
0
Lots-of-LoRAs/task1308_amazonreview_category_classification
文本分类
自然语言处理
该数据集名为Natural Instructions,主要用于文本生成任务,特别是亚马逊评论分类任务。数据集包含5200个训练样本、650个验证样本和650个测试样本。每个样本包含输入、输出和ID三个特征。数据集的语言为英语,创建者和注释者均为众包。数据集的许可证为Apache-2.0。
Hugging Face
2024-07-16 更新
6
0
oda-99/aozora_head_3_consonant_romaji
自然语言处理
罗马音标注音
该数据集包含了文本的部分(section)、押韵(rhyme)和新的文本(new_text)三个字段。数据集被分割为训练集和测试集,其中训练集包含1009225个示例,测试集包含112137个示例。
Hugging Face
2025-01-05 更新
10
0
epinnock/smol-evol-feedback-10k-oai-format
自然语言处理
反馈系统
--- dataset_info: features: - name: messages dtype: string splits: - name: train num_bytes: 51819133 num_examples: 9863 download_size: 19743354 dataset_size: 51819133 configs:
Hugging Face
2024-01-28 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广