登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Kubord 1 - Ordfrekvenser Östgöta Correspondenten 2014
Kubord 1 - Ordfrekvenser Östgöta Correspondenten 2014
收藏
DataCite Commons
2026-05-03 更新
2025-04-16 收录
文献数据挖掘
自然语言处理
数据链接:
https://spraakbanken.gu.se/resurser/kubord-ogc-2014
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Del av samlingen Kubord 1
库博德1号(Kubord 1)藏品集的一部分
应用场景:
提供机构:
Språkbanken Text
创建时间:
2024-06-18
相关数据集
Pinyin to Character Conversion Dataset
自然语言处理
拼音转汉字
该数据集是为了拼音转汉字任务(P2C)而创建的,它包含了从主要中文新闻网站收集的文章。此外,数据集还整合了“常用词汇”和“网络词汇”等外部词库,以提升转换性能。其规模包括260万篇训练文章和1000篇测试文章,专门用于拼音转汉字的任务。
arXiv
31
0
open-llm-leaderboard-old/details_abacusai__Smaug-70B-v0.1
模型评估
自然语言处理
该数据集是在评估模型abacusai/Smaug-70B-v0.1时自动创建的,主要用于在Open LLM Leaderboard上进行评估。数据集包含63个配置,每个配置对应一个评估任务。数据集由1次运行生成,每次运行的结果作为一个特定的分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,还有一个名为results的配置,存储了所有运行的聚合结果,并用于在Open LLM L
Hugging Face
2024-02-03 更新
17
0
avemio/German-RAG-DPO-ShareGPT-HESSIAN-AI
自然语言处理
多语言问答系统
这是一个专门为细调语言模型而设计的德语RAG任务数据集,使用合成增强的德语维基百科数据构建。数据集包含多个子任务,每个子任务都针对不同的训练目标,例如提取式问答、考虑时间差异的问答、带有多个引用的问答等。数据集以问题-答案节点和相关/无关上下文节点的形式构建训练知识图。
Hugging Face
2025-02-06 更新
8
0
davanstrien/similarity-dataset-sc2-8b
自然语言处理
机器学习
--- language: - en size_categories: n<1K dataset_info: features: - name: anchor dtype: string - name: positive dtype: string - name: negative dtype: string splits: - name: trai
Hugging Face
2024-05-30 更新
22
0
WritingPrompts-Filtered
自然语言处理
文本数据清洗
这个数据集包含了从Reddit上过滤和去污染的WritingPrompts,专门处理以移除与LitBench测试集的重叠内容,确保了用于语言模型训练的数据清洁且无测试集污染。
Hugging Face
2025-09-13 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广