登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Result of the linear mixed model for domain specific vocabulary.
Result of the linear mixed model for domain specific vocabulary.
收藏
Figshare
2018-09-17 更新
2026-04-29 收录
领域词汇分析
语言建模
数据链接:
https://figshare.com/articles/dataset/Result_of_the_linear_mixed_model_for_domain_specific_vocabulary_/7095485
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Result of the linear mixed model for domain specific vocabulary.
应用场景:
创建时间:
2018-09-17
相关数据集
emozilla/dolma-v1_7-30B-tokenized-llama2-nanoset
语言建模
大规模语言模型
Dolma数据集是一个经过Llama 2模型分词处理的版本,源自emozilla/dolma-v1_7-30B数据集。该数据集被分割成10 GB的块,便于下载和处理。提供了下载和重新组合这些数据块的命令行指令,以及如何使用numpy直接处理这些数据的示例代码。
Hugging Face
2024-07-09 更新
75
0
mGeNTE
性别中立翻译
语言建模
mGeNTE是一个多语言数据集,旨在支持性别中立翻译和语言建模的研究。该数据集由布鲁诺·凯斯勒基金会、博洛尼亚大学和汉堡大学的研究团队创建,扩展了现有的GeNTE语料库,涵盖了英语-意大利语、英语-德语和英语-西班牙语的语言对。数据集包含4500条句子级别的三元组,每条三元组由源语言句子、性别化目标语言句子和性别中立目标语言句子组成。数据来源于Europarl语料库,经过专家和翻译学生的精心筛选和
arXiv
2025-01-16 更新
29
0
TucanoBR/ViTucano-Pretrain
视觉助手
语言建模
ViTucano-Pretrain数据集是一个经过葡萄牙语翻译的图像到文本和文本生成任务的数据集,用于训练ViTucano视觉助手模型。该数据集基于LLaVA-Pretrain LCS-558K子集,通过Google翻译API进行了翻译,并具有更加平衡的概念覆盖分布。
Hugging Face
2025-08-15 更新
8
0
M2D2
语言建模
多领域
M2D2是一个大规模多领域语言建模数据集,用于语言模型的训练和评估。
github
2022-11-22 更新
36
0
Natual Language Modeling Data
自然语言处理
语言建模
Natual Language Modeling
kaggle
2025-10-20 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广