登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
cognitivecomputations/SystemChat_Sinhala
cognitivecomputations/SystemChat_Sinhala
收藏
Hugging Face
2024-08-27 更新
2025-04-08 收录
僧伽罗语对话系统
多语言聊天数据
数据链接:
https://hf-mirror.com/datasets/cognitivecomputations/SystemChat_Sinhala
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 language: - si --- This is a SystemChat dataset for Sinhala
应用场景:
提供机构:
cognitivecomputations
相关数据集
cognitivecomputations/SexDrugsAndRockAndRoll
成人内容检测
内容过滤
该数据集是一个包含成人内容、毒品相关图像和摇滚文化主题的全面图像集合,旨在训练多模态模型。每张图像都带有详细的元数据标签,包括显式内容、毒品引用、裸体、暴力等相关属性的注释。数据集的主要用途是训练AI模型以准确检测、分类和管理成人主题内容,使系统实施者能够进行详细的内容过滤。
Hugging Face
2024-06-19 更新
39
0
cognitivecomputations/open-instruct-uncensored
AI模型训练
数据处理
该数据集是Allen AI的open-instruct数据集,用于训练Tulu系列的模型。数据集经过处理,包括下载未过滤的sharegpt数据集、合并处理后的数据文件,并通过自定义脚本移除拒绝回答的内容,生成了一个未经过滤的版本。作者正在使用这个未经过滤的数据集训练一个新的模型系列。
Hugging Face
2023-06-22 更新
19
0
cognitivecomputations/dolphin
语言模型训练
指令调优优化
--- license: apache-2.0 task_categories: - text-generation language: - en configs: - config_name: flan1m-alpaca-uncensored data_files: flan1m-alpaca-uncensored.jsonl - config_name: flan5m-alpaca-unc
Hugging Face
2023-12-18 更新
15
0
cognitivecomputations/dolphin-r1
自然语言处理
模型训练
Dolphin R1是一个由Eric Hartford和Cognitive Computations团队创建的Apache-2.0许可的数据集。这个数据集包含了800k个样本,其组成与用于训练DeepSeek-R1 Distill模型的训练集相似,包括来自DeepSeek-R1的30万个推理样本,来自Gemini 2.0的30万个快速思考推理样本,以及20万个Dolphin聊天样本。该数据集的目的
Hugging Face
2025-01-30 更新
29
0
cognitivecomputations/wizard_vicuna_70k_unfiltered
对话系统
自然语言处理
该数据集是基于junelee/wizard_vicuna_70k数据集,移除了包含对齐的对话,最终保留了34598个对话。该数据集的灵感来源于anon8231489123创建的ShareGPT_Vicuna_unfiltered数据集,并使用了其脚本来处理这个新数据集。
Hugging Face
2023-05-16 更新
16
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广