遇见数据集

tangledlabs/tangled-llama-pints-1.5b-v0.1-dataset

收藏
Hugging Face2024-08-28 更新2025-11-02 收录
官方服务:

资源简介:

--- license: apache-2.0 datasets: - laurentiubp/systemchat-sharegpt - Open-Orca/slimorca-deduped-cleaned-corrected - Crystalcareai/openhermes_200k_unfiltered - Locutusque/function-calling-chatml - m-a-p/CodeFeedback-Filtered-Instruction - microsoft/orca-math-word-problems-200k language: - eng configs: - config_name: default data_files: - split: train path: "tangled-llama-pints-1.5b-v0.1.jsonl" --- # tangled-llama-pints-1.5b-v0.1-dataset Combined dataset as single JSONL from following datasets: - laurentiubp/systemchat-sharegpt - Open-Orca/slimorca-deduped-cleaned-corrected - Crystalcareai/openhermes_200k_unfiltered - Locutusque/function-calling-chatml - m-a-p/CodeFeedback-Filtered-Instruction - microsoft/orca-math-word-problems-200k

--- 许可证:Apache-2.0 关联数据集: - laurentiubp/systemchat-sharegpt - Open-Orca/slimorca-deduped-cleaned-corrected - Crystalcareai/openhermes_200k_unfiltered - Locutusque/function-calling-chatml - m-a-p/CodeFeedback-Filtered-Instruction - microsoft/orca-math-word-problems-200k 语言:英语(eng) 配置项: - 配置名称:默认 数据文件: - 数据拆分:训练集(train) 文件路径:"tangled-llama-pints-1.5b-v0.1.jsonl" --- # tangled-llama-pints-1.5b-v0.1 数据集 本数据集由以下所列多个数据集合并得到,采用单一JSONL格式存储: - laurentiubp/systemchat-sharegpt - Open-Orca/slimorca-deduped-cleaned-corrected - Crystalcareai/openhermes_200k_unfiltered - Locutusque/function-calling-chatml - m-a-p/CodeFeedback-Filtered-Instruction - microsoft/orca-math-word-problems-200k

提供机构:
tangledlabs
二维码
社区交流群
二维码
科研交流群
商业服务