登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Lenta Short Sentences
Lenta Short Sentences
收藏
OpenXLab
2026-04-18 收录
俄语语言建模
文本处理
数据链接:
https://openxlab.org.cn/datasets/OpenDataLab/Lenta_Short_Sentences
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Lenta Short Sentences 数据集是用于俄语语言建模的文本数据集。它由从 Lenta News 数据集中采样的 236K 句子组成。
应用场景:
提供机构:
OpenDataLab
创建时间:
2022-08-19
相关数据集
dgambettaphd/D_gen0_run0_llama2-7b_wiki_doc1000_real64_synt64_vuw
文本处理
自然语言处理
该数据集包含1000个样本,每个样本具有唯一的标识符(id)和文档内容(doc)。数据集分为一个训练集,文件大小为580426字节,下载大小为358365字节。
Hugging Face
2024-12-15 更新
13
0
Clothing Attributes Dataset
服装属性识别
细粒度分析
我们引入服装属性数据集,以促进学习对象视觉属性的研究。该数据集包含1856个图像,具有26个地面真相服装属性,例如 “长袖”,“有衣领” 和 “条纹图案”。标签是使用Amazon Mechanical Turk收集的。
OpenXLab
8
0
hotchpotch/wikipedia-multilingual-ir-pairs
多语言信息检索
文本处理
--- dataset_info: - config_name: arwiki-20251202-v1.1.0 features: - name: query dtype: string - name: document dtype: string splits: - name: train num_bytes: 2745141765 num_e
Hugging Face
2026-02-10 更新
4
0
Income Text Utils API
文本处理
API工具
Text utility API with slug, clean, upper/lower, stats operations
RapidAPI
2025-12-10 更新
13
0
Polish Political Advertising Dataset
政治广告分析
自然语言处理
用于检测波兰语中特定文本块和政治广告类别的数据集。它包含 1,705 条人工注释的推文,标记有九个类别,这些类别构成波兰选举法下的竞选活动。
OpenDataLab
2026-08-23 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广