登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Dataset for model - Poirot
Dataset for model - Poirot
收藏
kaggle
2023-08-10 更新
2024-03-07 收录
模型训练
页面分类
数据链接:
https://www.kaggle.com/datasets/tsrdjan/dataset-for-model-poirot
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Profile page classification
个人资料页面分类
应用场景:
创建时间:
2023-08-09
相关数据集
Ichsan2895/DPO_ID-Wiki_10kTesting
模型训练
强化学习
--- license: cc-by-nc-sa-4.0 --- ## HOW TO WRANGLING THIS DATASET TO DPO & CHATML FORMAT ``` def return_prompt_and_responses(samples) -> dict[str, str, str]: return { "prompt": [
Hugging Face
2023-11-25 更新
22
0
pankajmathur/WizardLM_Orca
文本生成
模型训练
Explain tuned WizardLM数据集包含约55K条数据,使用了Orca研究论文中的方法来生成。与原始数据集使用的普通指令调优方法不同,该数据集利用了Orca研究论文中提供的15个系统指令来生成自定义数据集。这有助于学生模型(如orca_mini_13b)从教师模型(ChatGPT,gpt-3.5-turbo-0301版本)中学习思维过程。系统提示在每个指令之前添加。
Hugging Face
2023-06-26 更新
14
0
DKYoon/dolphin-r1-deepseek-filtered-short
通信分析
模型训练
这个数据集包含了对话信息和模型信息。对话信息由内容和角色组成,而模型信息可能是指使用的模型类型或名称。数据集分为训练集,共有226813个样本,总大小为1.5GB。提供了一个默认配置文件,用于指定训练集的数据文件。
Hugging Face
2025-02-04 更新
13
0
Math COT Data
数学推理
模型训练
Math COT Data 是一个基于数学数据集合成的数据集,包含7500个样本,用于增强模型的推理能力。
github
2024-12-24 更新
20
0
ChunB1/phi-2-symbol-100k-en-512
自然语言处理
模型训练
--- dataset_info: features: - name: task dtype: string - name: inputs dtype: string - name: targets dtype: string - name: symbols sequence: string splits: - name: train
Hugging Face
2024-04-04 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广