登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
News from lenta.ru
News from lenta.ru
收藏
kaggle
2026-05-15 更新
2026-07-24 收录
文本处理
俄语新闻分析
数据链接:
https://www.kaggle.com/datasets/romaneyvazov/df-lenta
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
360000+ news from lenta.ru
超36万条来自Lenta.ru的新闻
应用场景:
创建时间:
2026-05-15
相关数据集
dgambettaphd/D_gen0_run0_llama2-7b_wiki_doc1000_real64_synt64_vuw
文本处理
自然语言处理
该数据集包含1000个样本,每个样本具有唯一的标识符(id)和文档内容(doc)。数据集分为一个训练集,文件大小为580426字节,下载大小为358365字节。
Hugging Face
2024-12-15 更新
13
0
LocalResearchGroup/split-finemath-decontaminated
文本处理
自然语言处理
该数据集包含了网页的URL、抓取时间、MIME类型、WARC文件信息、文本内容、字符和单词数量、元数据、评分等信息。数据集分为训练集和测试集,可用于网页内容分析、自然语言处理等任务。
Hugging Face
2025-11-08 更新
10
0
on1onmangoes/SAMLONEv3_20240409005709_TestNumber5
语音识别
文本处理
--- dataset_info: features: - name: audio dtype: audio - name: text dtype: string splits: - name: train num_bytes: 1584208.0 num_examples: 1 download_size: 1576838 datase
Hugging Face
2024-04-08 更新
7
0
Income Text Utils API
文本处理
API工具
Text utility API with slug, clean, upper/lower, stats operations
RapidAPI
2025-12-10 更新
13
0
jkeisling/projectgutenberg-kokoro_v1-mimi
文本处理
语音识别
该数据集包含四个字段:整数序列的codes、规范化文本的text_normalized、音素序列的phonemes和说话者ID的speaker_id。数据集提供了一个训练集,包含300万个示例,总大小约为16GB。数据集适用于需要处理文本和音频数据的NLP和语音处理任务。
Hugging Face
2025-02-02 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广