登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
spa_newscrawl_2011
spa_newscrawl_2011
收藏
corpora.uni-leipzig.de
2025-03-26 收录
西班牙语
新闻语料
数据链接:
https://corpora.uni-leipzig.de?corpusId=spa_newscrawl_2011
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Spanish news corpus based on material crawled in 2011
基于2011年爬取资料的西班牙语新闻语料库
应用场景:
提供机构:
corpora.uni-leipzig.de
相关数据集
mar_wikipedia_2021
自然语言处理
语言学
Marathi Wikipedia corpus based on material from 2021
corpora.uni-leipzig.de
13
0
Nexdata/Spanish_Conversational_Speech_Data_by_Telephone
语音识别
西班牙语
该数据集是一个西班牙语对话语音数据集,包含了超过700名母语者的对话录音,总计500小时。录音设备为各种手机,音频格式为8kHz、8bit,所有录音均在安静的室内环境中进行。数据集还包括了语音的手动转录文本、每个有效句子的开始和结束时间以及说话者识别信息。此外,数据集的应用场景包括语音识别和声纹识别,单词准确率不低于98%。
Hugging Face
2024-01-26 更新
10
0
Spanish Speech Recognition Dataset
语音识别
西班牙语
Dataset comprises 488 hours of telephone dialogues in Spanish
kaggle
2025-12-02 更新
7
0
ferrazzipietro/LS_Llama-3.1-8B_diann-sentences-spanish_NoQuant_16_64_0.05_64_BestF1
自然语言处理
西班牙语
该数据集包含多个文本处理相关的特征,如句子、ID、标题、关键词、注释文本、原始文本、句子注释、实体、标记、NER标签、输入ID、注意力掩码、标签、预测和真实标签等。数据集分为验证集和测试集,验证集包含364个样本,测试集包含480个样本。数据集的下载大小为1282688字节,总大小为6053518字节。
Hugging Face
2024-12-11 更新
10
0
riturralde/keywords-umsa
文本摘要
西班牙语
--- dataset_info: features: - name: abstract dtype: string - name: title dtype: string - name: keywords dtype: string splits: - name: train num_bytes: 28203744 num_exam
Hugging Face
2023-10-26 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广