登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Mozilla/coco-gpt4o
Mozilla/coco-gpt4o
收藏
Hugging Face
2024-07-26 更新
2025-04-12 收录
数据链接:
https://hf-mirror.com/datasets/Mozilla/coco-gpt4o
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 --- Test
--- 许可证:Apache 2.0许可证(Apache License 2.0) --- 测试
应用场景:
提供机构:
Mozilla
相关数据集
Mozilla/alt-text-validation
图像识别
模型微调
该数据集包含来自不同来源的图像和替代文本。它用于通过checkvite应用程序控制Mozilla的distilvit模型的质量。该应用程序允许用户在图像上测试模型并进行分类。数据集会根据用户反馈进行更新,特别是标记为需要训练的图像将用于微调模型以修正其不准确性。
Hugging Face
2024-08-07 更新
31
0
Common Voice
语音识别
自然语言处理
Common Voice是一个开源语音数据集,由Mozilla开发维护。该数据库包含大量由志愿者录制的语音样本及其对应的文本转录,旨在为语音识别、语音合成等人工智能研究提供训练数据。Common Voice采用众包方式收集数据,支持多种语言,研究人员可以免费获取和使用这些数据。
知名数据库
22
0
Mozilla/history-search-tool-calling
对话系统
搜索工具
该数据集名为历史搜索-评估数据集,包含用于历史搜索工具使用的仅评估数据集。它包括三个配置:intent、intent_turns和temporal。intent数据集评估在多轮对话中模型是否应调用历史搜索,每行代表一个对话并保留完整上下文。intent_turns数据集是intent的扁平化视图,每行代表一个对话轮次,仅用于HF数据集查看器和分析。temporal数据集评估调用历史搜索时的时间解析
Hugging Face
2026-01-15 更新
8
0
Mozilla Common Voice Mcv-Accent
语音识别
多语言处理
该数据集涵盖了五个已知口音(澳大利亚、加拿大、苏格兰、英国、美国)和九个未知口音(非洲、香港、印度、爱尔兰、马来西亚、新西兰、菲律宾、新加坡、威尔士)。此外,该数据集还包括了100小时和620小时的训练分割音频数据,以及17小时的验证和测试数据。其规模分为Mcv-Accent-100(100小时)和Mcv-Accent-600(620小时)。该数据集的任务是自动语音识别(ASR)。
arXiv
23
0
Mozilla/smart_intent_dataset
意图识别
文本分类
该数据集用于意图分类任务,属于文本分类类别。数据集包含三个主要特征:序列(文本数据)、目标(分类目标)和标签(分类标签)。数据集分为训练集和验证集,训练集包含100,729个样本,验证集包含5,302个样本。
Hugging Face
2024-11-04 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广