登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
hanesh007/Roberta_Outputs
hanesh007/Roberta_Outputs
收藏
Hugging Face
2024-03-12 更新
2024-06-11 收录
自然语言处理
预训练语言模型
数据链接:
https://hf-mirror.com/datasets/hanesh007/Roberta_Outputs
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
应用场景:
提供机构:
hanesh007
原始信息汇总
数据集概述
许可协议
协议类型
: Apache-2.0
相关数据集
AIME2025-long-hints
教育
自然语言处理
该数据集包含了问题、答案、完整句子及其正确性、领域、注释、有提示和无提示情况下的准确率等字段。它被设计用于训练模型,其中的训练集包含了30个示例,数据集总大小为2,152,843字节。
Hugging Face
2025-04-27 更新
17
0
mlfoundations-dev/instruction_filtering_fasttext_seed_data_code
自然语言处理
机器学习
该数据集包含了对话指令种子(instruction_seed)、来源(source)、以及对应的70B蒸馏模型响应(r1_distill_70b_response)等字段。此外,每个样本还有一个原始行索引(__original_row_idx)和会话信息(conversations),其中会话信息包含发送者(from)和消息内容(value)。数据集被拆分为训练集(train),包含2500个示例
Hugging Face
2025-02-14 更新
5
0
The Finnish Sub-corpus of the JRC-Acquis Multilingual Parallel Corpus, Downloadable Version
自然语言处理
语言学
This is the legal subcorpus of the [Helsinki Korp Version of the Finnish TreeBank 3](http://urn.fi/urn:nbn:fi:lb-2016042602). The corpus is available for online browsing through the concordancer Korp
SSH Open MarketPlace
2025-07-04 更新
2
0
RylanSchaeffer/collapse_gemma-2-9b_hs2_accumulate_iter2_sftsd0_temp1_max_seq_len512
自然语言处理
机器学习
该数据集包含两个主要特征:prompt(提示)和response(响应),均为字符串类型。数据集包含一个训练集(train),其中包含12531个样本,总大小为15358934字节。下载大小为904870字节,数据集总大小为15358934字节。数据集的配置文件指定了默认配置,数据文件路径为data/train-*。
Hugging Face
2024-11-24 更新
6
0
AnanthZeke/tamil_sentences_sample
自然语言处理
泰米尔语
该数据集名为tamil_combined_sentences,包含泰米尔语的句子,主要用于句子相似性和零样本分类任务。数据集来源于OSCAR和Wikipedia,大小在1M到10M之间。数据集的特征包括句子,分割为训练集,包含2,391,475个例子,总大小为1,164,550,978字节。
Hugging Face
2023-10-13 更新
3
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广