登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
subtitles database opensubtitles
subtitles database opensubtitles
收藏
kaggle
2025-09-26 更新
2025-10-25 收录
字幕库
多语言处理
数据链接:
https://www.kaggle.com/datasets/priyanshu007/small-subtitles-database-opwnsubtitles
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
This is a subset of database from opensubtitles
本数据集为开放字幕(OpenSubtitles)数据库的一个子集
应用场景:
创建时间:
2025-09-26
相关数据集
数鼎科技-全球多语言处理主数据
多语言处理
汽车行业数据
该数据基于数鼎科技自主研发的多语言数据模型框架,将互联网采集的汽车行业大数据,经过多语言版本的储存、维护、切换、应用等一系列主数据设计开发技术处理,结合所拥有的汽车行业内专有名词等专业术语应用的专家经验,打造多语言并发,适应不同国际社会文化和市场的多语言主数据。满足能够容纳多种语言的全球互通共享的数据需求,促进企业扩大规模和贸易全球化进程。
广东省数据知识产权存证登记平台
2023-11-15 更新
30
0
infinex/LaMini-en-id
自然语言处理
多语言处理
--- dataset_info: features: - name: instruction dtype: string - name: response dtype: string - name: instruction_source dtype: string - name: context_id dtype: string - nam
Hugging Face
2023-12-06 更新
19
0
FreedomIntelligence/ApolloMoEBench
医学问答
多语言处理
ApolloMoEDataset是一个包含12种主要语言和38种少数民族语言的医学领域问答数据集,用于训练和评估多语言医学大型语言模型。
Hugging Face
2024-10-15 更新
15
0
NLU-Metaphor
比喻语言理解
多语言处理
# SEA Metaphor SEA Metaphor evaluates a model's ability to interpret paired figurative phrases with divergent meanings. It is sampled from [Multilingual-Fig-QA](https://aclanthology.org/2023.finding
魔搭社区
2026-04-28 更新
27
0
M2LabOrg/jwlang
自动语音识别
多语言处理
JWLang Corpus是一个多语言的音频和文本数据集,源自jw.org网站上的JW Broadcasting视频,用于训练和微调自动语音识别(ASR)模型,特别是OpenAI Whisper。数据集存储在Hugging Face上,采用Parquet格式,原始音频文件为MP3格式,对应文本文件。该数据集适用于训练、验证和测试ASR模型,数据下载于2024年6月。
Hugging Face
2024-06-24 更新
17
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广