登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
SVT news 2007 (2022-03-31) SVT nyheter 2007 (2022-03-31)
SVT news 2007 (2022-03-31) SVT nyheter 2007 (2022-03-31)
收藏
B2FIND
2026-04-29 收录
新闻文本分析
多语言自然语言处理
数据链接:
https://b2find.eudat.eu/dataset/5bd0075d-2524-5473-ab32-0aab7eee01fc
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
News texts from svt.se Nyhetstexter från svt.se
来自svt.se的新闻文本
应用场景:
相关数据集
XiaChuFang Recipe Corpus 下厨房食谱语料库
多语言自然语言处理
食谱推荐
本食谱语料库包含 1,520,327 种中国食谱。其中,1,242,206 食谱属于 30,060 菜肴。一道菜平均有 41.3 个食谱。食谱的平均长度是 224 个字符。最大长度为 62,722 个字符,最小长度为 10 个字符。食谱由 415,272 位作者贡献。其中,最有生产力的作者上传 5,394 食谱。
超神经
2023-12-27 更新
354
0
XLEnt
跨语言实体识别
多语言自然语言处理
XLEnt数据集由约翰斯·霍普金斯大学等机构创建,包含1.64亿对跨语言实体,覆盖120种语言与英语的对应关系。该数据集通过自动挖掘网络数据,利用词义音位对齐技术LSP-Align构建,旨在改善低资源语言的跨语言实体识别。XLEnt不仅支持机器翻译和跨语言信息链接,还为多语言自然语言处理任务提供重要资源,有助于推动全球语言技术的进步。
arXiv
2021-09-11 更新
29
0
duwuonline/UIT-VSMEC
情感分析
多语言自然语言处理
该数据集来自UIT(信息技术大学),包含7个类别:其他、厌恶、享受、愤怒、惊讶、悲伤、恐惧。数据集的语言为越南语,主要用于情感分类任务。
Hugging Face
2023-08-28 更新
16
0
SETimes
自然语言处理
新闻文本分析
This corpus contains texts from the setimes.com website. The corpus is available for download from a dedicated webpage.
SSH Open MarketPlace
2025-07-04 更新
30
0
cmrc2019
多语言自然语言处理
机器阅读理解
## GitHub repository: https://github.com/ymcui/cmrc2019 This repository contains the data for [The Third Evaluation Workshop on Chinese Machine Reading Comprehension (CMRC 2019)](https://hfl-rc.gith
魔搭社区
2026-05-30 更新
26
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广