登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
spa_news_2022
spa_news_2022
收藏
corpora.uni-leipzig.de
2025-03-22 收录
西班牙语
新闻语料库
数据链接:
https://corpora.uni-leipzig.de?corpusId=spa_news_2022
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Spanish news corpus based on material from 2022
基于2022年资料的西班牙新闻语料库
应用场景:
提供机构:
corpora.uni-leipzig.de
相关数据集
INFERES
自然语言推理
西班牙语
INFERES是首个为欧洲西班牙语设计的自然语言推理(NLI)数据集,由德克萨斯大学奥斯汀分校信息学院的研究团队创建。该数据集包含8055个黄金标准的命题-假设对,涵盖广泛的主题和语言现象,特别关注基于否定的对比和对抗性示例。数据集的创建过程结合了专家语言学家和众包工作者的策略,旨在提供高质量数据并系统评估自动化系统。INFERES不仅用于训练自动化系统,还用于深入理解推理的本质,特别是在否定和指
arXiv
2022-10-07 更新
28
0
D572_Hours_Spanish_Speech_Data_by_Mobile_Phone
语音识别
西班牙语
西班牙语语音数据_朗读(手机),基于给定的脚本朗读并模拟录制,涵盖新闻、评论、百科、经济、科学、法律等领域,内容丰富。此数据集标注了文本内容,噪音等多种属性,由800名西班牙、墨西哥、阿根廷等国的西班牙语母语人员参与录制,准确性高,为语音识别相关研究及应用提供了丰富的资源,经多家AI公司验证:有助于模型面对真实世界的多样性时能够表现出色。我们严格遵循数据保护法规和隐私规定,确保数据采集、存储和使用
OpenCSG
2026-03-04 更新
16
0
spanish-ir/eswiki_20240401_corpus
信息检索
西班牙语
MessIRve (corpus)数据集是一个基于2024年4月1日西班牙语维基百科转储文件的大规模信息检索数据集。每个文档对应维基百科中的一个段落,并提供了文章标题作为检索时的额外上下文。数据集的字段包括docid(文档ID)、title(文章标题)和text(段落文本)。docid遵循X#Y的模式,其中X表示文章ID,Y表示段落在文章中的顺序。
Hugging Face
2024-09-11 更新
14
0
altbrainblock/medquades
医学问答
西班牙语
medquades数据集是MEDQUAD数据集(BenAbacha-BMC-2019)的西班牙语部分版本,包含15869个问答对。该数据集是原始英文数据集medquad的西班牙语翻译版本,翻译工作由Gemini免费服务通过简单脚本完成。数据集的语言为西班牙语,标签包括问答、医学和西班牙语,许可证为cc-by-4.0。任务类别为问答。
Hugging Face
2024-04-11 更新
17
0
Rodrimr112/dataset2
文本生成
西班牙语
--- task_categories: - text-generation language: - es ---
Hugging Face
2024-03-23 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广