登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Selected clinical and non-clinical foundational language models.
Selected clinical and non-clinical foundational language models.
收藏
Figshare
2026-02-20 更新
2026-04-28 收录
语言模型
基础模型
数据链接:
https://figshare.com/articles/dataset/_p_Selected_clinical_and_non-clinical_foundational_language_models_p_/31381570
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Selected clinical and non-clinical foundational language models.
应用场景:
创建时间:
2026-02-20
相关数据集
rewoo/sotu_qa_2023
政治问答
语言模型
这是一个关于2023年国情咨文的问答基准数据集,特别适用于工具增强的语言模型(LMs)或增强语言模型(ALMs)来测试模型在回答私有文档问题上的能力。
Hugging Face
2023-05-22 更新
20
0
tellarin-ai/llm-japanese-dataset-vanilla-aya-format
语言模型
数据调优
该数据集是从其原始v1.0.0格式转换而来,并在此以相同的CC-BY-SA 4.0许可证和条件下发布。它包含用于LLM构建/调整的日语指令类数据。数据集仅包含一个train分割,约有2.46M行数据。格式转换的细节包括如何将原始数据集中的instruction和input列合并,并在特定情况下添加前缀句子。转换后的数据集仅使用Aya格式指定的两列:inputs和targets。
Hugging Face
2024-01-31 更新
15
0
cygu/sampling-distill-train-data-aar-k3
水印技术
语言模型
该数据集用于基于采样的水印蒸馏训练,使用了Aar (k=3)水印策略。生成过程使用了Llama 2 7B模型,并基于解码水印技术生成了640,000个水印样本,每个样本长度为256个token。样本的生成基于OpenWebText的50-token前缀提示,但这些提示不包含在样本中。
Hugging Face
2024-05-23 更新
11
0
fine-tuned/jinaai_jina-embeddings-v2-base-es-6262024-yjwm-webapp
语言模型
西班牙文化
数据集“当代西班牙语言和文化”是一个生成的数据集,旨在支持开发特定领域的嵌入模型以用于检索任务。
Hugging Face
2024-06-26 更新
16
0
NeuralNovel/Neural-Story-v1
语言模型
文学创作
Neural-Story-v1数据集是一个精心策划的短故事集合,涵盖了丰富的类型和情节设置。该数据集由NeuralNovel组装,旨在为使用LoRa测试和微调小型语言模型提供有价值的资源。数据内容是通过Mixtral 8x7b的自动生成和手动精炼相结合的方式获得的。数据集特别设计用于测试目的,旨在提高类型多样性和写作中的创意与细微差别。策划该数据集的理由是为了提供多样化的类型混合,以激发和鼓励更多
Hugging Face
2023-12-29 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广