登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
TokenBender/telugu_high_quality_convo
TokenBender/telugu_high_quality_convo
收藏
Hugging Face
2023-09-01 更新
2024-03-04 收录
泰卢固语
对话数据
数据链接:
https://hf-mirror.com/datasets/TokenBender/telugu_high_quality_convo
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
应用场景:
提供机构:
TokenBender
原始信息汇总
数据集许可证
许可证类型:Apache 2.0
相关数据集
LMSYS-Chat-1M
语言模型
对话数据
LMSYS-Chat-1M是由加州大学伯克利分校的研究团队创建的大型语言模型对话数据集,包含一百万条真实世界的对话记录。该数据集通过LMSYS项目收集,涵盖了25个最先进的语言模型,并从210,000个独特的IP地址中收集。数据集内容丰富,包括对话的收集过程、基本统计数据和主题分布,强调了其多样性、原创性和规模。该数据集的应用领域广泛,包括开发内容审核模型、构建安全基准、训练指令遵循模型以及创建挑
arXiv
2024-03-11 更新
227
0
k-arthik-r/mental-health-conversations-in-Llama2-promt-format
心理健康
对话数据
--- dataset_info: features: - name: text dtype: string splits: - name: train num_bytes: 4712402 num_examples: 3512 download_size: 2570825 dataset_size: 4712402 configs: - confi
Hugging Face
2024-05-18 更新
18
0
TokenBender/sentence_retrieval_hindi_SFT
印地语句子检索
监督微调
--- license: apache-2.0 ---
Hugging Face
2024-01-28 更新
12
0
SynthPAI
个人属性推断
对话数据
该数据集名为synthPAI,是一个经过人工验证的合成对话数据集,专为个人属性推断研究设计。它包含了7,823条由300个不同合成用户生成的评论,覆盖了8个个人属性,包括年龄、性别、收入水平、地理位置、出生地、教育水平、职业和婚姻状况。SynthPAI中的评论在风格和质量上与真实的Reddit评论高度相似,该数据集被用于构建一个扰动数据库,以评估防御方法的有效性。规模上,数据集包含了来自300个合
arXiv
27
0
hippocrates/qa_train
对话数据
机器学习
--- dataset_info: features: - name: id dtype: string - name: conversations list: - name: from dtype: string - name: value dtype: string - name: text dtype: stri
Hugging Face
2023-12-18 更新
14
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广