登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
C-ORAL-ROM_EXM
C-ORAL-ROM_EXM
收藏
SSH Open MarketPlace
2025-07-04 更新
2025-07-05 收录
自然语言处理
口语分析
数据链接:
https://marketplace.sshopencloud.eu/dataset/mLjkTQ
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
This is a corpus of formal and informal speech. The corpus is available from PORTULAN.
应用场景:
创建时间:
2025-07-04
相关数据集
open-llm-leaderboard-old/details_AIDC-ai-business__Marcoroni-70B
自然语言处理
模型评估
该数据集是在Open LLM Leaderboard上对模型AIDC-ai-business/Marcoroni-70B进行评估时自动创建的。数据集由61个配置组成,每个配置对应一个评估任务。数据集由4次运行生成,每次运行的结果作为特定配置中的一个分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,还有一个名为results的配置存储了所有运行的聚合结果,用于在Open LLM
Hugging Face
2023-09-19 更新
16
0
AbderrahmanSkiredj1/ahadith_translation_34k
圣训翻译
自然语言处理
该数据集包含三个特征:文本(text)、标签(label)和提示(prompt),数据类型均为字符串。数据集包含一个训练集(train),大小为56339232字节,包含34088个样本。下载大小为19500537字节,数据集总大小为56339232字节。数据集的任务类别为翻译(translation),语言为阿拉伯语(ar)。
Hugging Face
2024-07-15 更新
6
0
artfultom/dataset_from_groq
自然语言处理
文本校正
俄罗斯语拼写校正数据集,包含1200对俄语句子,其中每对句子包含一个错误版本(input)和一个正确版本(target)。这些句子通常是由电影名称或演员名字组成的。该数据集适用于拼写和语法错误修正、语音识别后处理以及文本自动校正模型的训练。
Hugging Face
2025-10-12 更新
4
0
Wikipedia Talk Corpus
在线讨论
自然语言处理
We provide a corpus of discussion comments from English Wikipedia talk pages. Comments are grouped into different files by year. Comments are generated by computing diffs over the full revision histor
figshare.com
2017-01-23 更新
7
0
mlfoundations-dev/top_4_ranking_stackexchange
Stack Exchange
自然语言处理
该数据集包含指令和完成情况的对,以及原始行索引和对话信息。它分为训练集,共有20万个示例,数据集总大小超过1.5GB。对话信息包括发送者和消息内容。
Hugging Face
2025-01-07 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广