登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
m-a-p/neo_sft_phase2
m-a-p/neo_sft_phase2
收藏
Hugging Face
2024-06-12 更新
2024-06-15 收录
数据链接:
https://hf-mirror.com/datasets/m-a-p/neo_sft_phase2
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
许可证:Apache-2.0
应用场景:
提供机构:
m-a-p
原始信息汇总
数据集许可证
许可证类型:Apache 2.0
搜集汇总
数据集介绍
以上内容由遇见数据集搜集并总结生成
相关数据集
m-a-p/CHC-Bench
中文理解评估
多领域知识基准
CHC-Bench是一个多学科的中文难点基准测试数据集,收集了来自不同来源的问题,包括写作、人文与历史、科学、数学、阅读理解、角色扮演和中文理解的难点。该数据集用于评估模型在理解和执行中文指令方面的能力,评估标准不仅包括准确性,还包括有用性、相关性、深度、创造性和详细程度。
Hugging Face
2024-04-08 更新
273
0
m-a-p/PIN-14M
多模态文档
知识密集型
PIN-14M数据集是一个包含14M样本的多模态文档数据集,涵盖了8个子集,如PIN-PMC、DocLayNet、Linux-CN等。每个样本包含文本内容、内容图像和整体图像,并以JSONL格式存储。数据集主要用于多模态文档处理,支持中英文语言。
Hugging Face
2025-09-22 更新
41
0
m-a-p/TerminalTraj
终端代理轨迹生成
容器技术分析
--- dataset_info: features: - name: query dtype: string - name: messages list: - name: content dtype: string - name: role dtype: string splits: - name: train
Hugging Face
2026-02-11 更新
22
0
m-a-p/CodeFeedback-Filtered-Instruction
代码生成
自然语言处理
--- language: - en pipeline_tag: text-generation tags: - code license: apache-2.0 task_categories: - question-answering size_categories: - 10K OpenCodeInterpreter: Inte
Hugging Face
2024-02-26 更新
44
0
m-a-p/SciMMIR
科学研究
多模态信息检索
SciMMIR数据集是一个用于评估科学领域中多模态信息检索(MMIR)模型的基准数据集。该数据集包含537K科学图像-文本对,这些数据是从2023年5月至2023年10月的Arxiv论文中提取的。数据集采用了两个子集,五个子类别的数据层次结构,并使用人工创建的关键词对数据进行分类。数据集可以通过HuggingFace的Datasets库获取,并提供了示例代码展示如何使用数据集。
Hugging Face
2024-01-25 更新
33
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广