登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
全景图-分词名单
全景图-分词名单
收藏
重庆市公共数据开放平台
2024-02-07 更新
2024-07-02 收录
自然语言处理
文本分类
数据链接:
http://data.cq.gov.cn/opendata/directory/directoryDetail/R500000TAB2023120400151640
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
全景图-分词名单,包含:id、单词、0白名单1黑名单等...
应用场景:
提供机构:
市政协办公厅
创建时间:
2023-12-04
搜集汇总
背景与挑战
背景概述
该数据集名为'全景图-分词名单',主要包含id、单词以及区分白名单和黑名单的标识字段。它用于管理分词相关的名单信息。
以上内容由遇见数据集搜集并总结生成
相关数据集
AStaniszewski/Diorisis
古希腊语文本
自然语言处理
该数据集基于Diorisis古希腊语料库,主要用于标记分类任务,涉及的语言为古希腊语,数据规模在10M到100M之间。
Hugging Face
2024-12-10 更新
8
0
cc.en.300.bin.gz
自然语言处理
词向量
Fasttext English 300 dimension word vector binary model file. Required file to allow model code to run.
DataCite Commons
2020-07-14 更新
6
0
lak882/epic-query-embeddings-normalized
文本嵌入
自然语言处理
该数据集包含五个字段:唯一标识符(id),文本内容(text),文本的嵌入表示(embedding),子领域(subfield)和选择性(selectivity)。数据集划分为训练集,共有100个示例。数据集的下载大小为533429字节,解压后大小为403870字节。
Hugging Face
2025-11-12 更新
2
0
lingvenvist/bxr-animacy-test-data-no-postproc_output.csv
生命性识别
自然语言处理
--- dataset_info: features: - name: sentences dtype: string - name: tokens sequence: string - name: anim_tags sequence: class_label: names: '0': N
Hugging Face
2024-05-25 更新
7
0
kotoba-speech/wiki40b_lines_en
维基百科
自然语言处理
--- dataset_info: - config_name: shard_01 features: &id001 - name: text dtype: string - name: key dtype: string splits: - name: train num_bytes: 202068254 num_examples: 20000
Hugging Face
2025-12-10 更新
3
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广