登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Tulu Dataset from Srinivas institute of Technology
Tulu Dataset from Srinivas institute of Technology
收藏
kaggle
2024-05-25 更新
2024-05-26 收录
自然语言处理
OCR
数据链接:
https://www.kaggle.com/datasets/swathisherigar/tulu-alphabets-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
An Annotated Dataset of Tulu Letters
《图卢语字母标注数据集》
应用场景:
创建时间:
2024-05-25
相关数据集
JGTV_Pref_DS
自然语言处理
机器学习
该数据集包含多个特征字段,如prompt(提示)、choices(选择)、label(标签)、source(来源)等,以及不同模型(如mistral、gemma、llama)的偏好和拒绝输出。数据集分为训练集,包含9348个样本,总大小为28685328字节。
Hugging Face
2025-01-30 更新
14
0
epinnock/smol-evol-feedback-10k-oai-format
自然语言处理
反馈系统
--- dataset_info: features: - name: messages dtype: string splits: - name: train num_bytes: 51819133 num_examples: 9863 download_size: 19743354 dataset_size: 51819133 configs:
Hugging Face
2024-01-28 更新
7
0
eval_act_so100_test7
机器人评估
自然语言处理
该数据集为HuggingFace LeRobot格式机器人数据集。
Hugging Face
2025-05-19 更新
3
0
Results for different types and sizes of n-grams in complete novels using ALL features.
自然语言处理
n-gram
Results for different types and sizes of n-grams in complete novels using ALL features.
NIAID Data Ecosystem
9
0
Lots-of-LoRAs/task1308_amazonreview_category_classification
文本分类
自然语言处理
该数据集名为Natural Instructions,主要用于文本生成任务,特别是亚马逊评论分类任务。数据集包含5200个训练样本、650个验证样本和650个测试样本。每个样本包含输入、输出和ID三个特征。数据集的语言为英语,创建者和注释者均为众包。数据集的许可证为Apache-2.0。
Hugging Face
2024-07-16 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广