ai-forever/ria-news-retrieval
收藏官方服务:
资源简介:
--- configs: - config_name: default data_files: - split: test path: data/test.jsonl - config_name: corpus data_files: - split: corpus path: data/corpus.jsonl.zip - config_name: queries data_files: - split: queries path: data/queries.jsonl task_categories: - text-retrieval language: - ru size_categories: - 1M<n<10M ---
配置项: - 配置名:default(默认配置) 数据文件: - 拆分集:test 路径:data/test.jsonl - 配置名:corpus(语料库) 数据文件: - 拆分集:corpus 路径:data/corpus.jsonl.zip - 配置名:queries(查询语句) 数据文件: - 拆分集:queries 路径:data/queries.jsonl 任务类别:文本检索(text-retrieval) 语言:俄语(ru) 样本规模区间:100万 < n < 1000万
提供机构:
ai-forever原始信息汇总
数据集配置
- 默认配置
- 分割:测试
- 路径:
data/test.jsonl
- 语料库配置
- 分割:语料库
- 路径:
data/corpus.jsonl.zip
- 查询配置
- 分割:查询
- 路径:
data/queries.jsonl
任务类别
- 文本检索
语言
- 俄语
数据集大小
- 1M<n<10M



