登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
GPT4all weights
GPT4all weights
收藏
kaggle
2023-03-30 更新
2024-03-07 收录
语言模型
模型量化
数据链接:
https://www.kaggle.com/datasets/konradb/gpt4all-weights
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Assistant-style LLM - CPU quantized checkpoint from Nomic AI
助手型大语言模型(LLM)—— 来自Nomic AI的CPU量化模型检查点
应用场景:
创建时间:
2023-03-30
相关数据集
rewoo/sotu_qa_2023
政治问答
语言模型
这是一个关于2023年国情咨文的问答基准数据集,特别适用于工具增强的语言模型(LMs)或增强语言模型(ALMs)来测试模型在回答私有文档问题上的能力。
Hugging Face
2023-05-22 更新
20
0
fine-tuned/jinaai_jina-embeddings-v2-base-es-6262024-yjwm-webapp
语言模型
西班牙文化
数据集“当代西班牙语言和文化”是一个生成的数据集,旨在支持开发特定领域的嵌入模型以用于检索任务。
Hugging Face
2024-06-26 更新
16
0
ahmetsalihK/5105456
自然语言处理
语言模型
--- dataset_info: features: - name: index dtype: int64 - name: instruction dtype: string - name: input dtype: string - name: output dtype: string - name: token_count dt
Hugging Face
2024-06-14 更新
12
0
Hybrid Human-LLM Corpus
语言模型
因果运动构造
本研究开发了一个结合人类和大型语言模型(LLM)的混合语料库,专注于罕见的语言现象——因果运动构造(CMC)。数据集包含765个经过手动验证的CMC实例,用于评估GPT、Gemini、Llama2和Mistral模型对CMC的理解。此外,还通过自动扩展创建了一个包含127,955个高可能性CMC实例的半自动数据集。这些数据集的构建旨在解决大型语言模型在处理复杂语言结构时的性能问题,特别是在非典型C
arXiv
2024-03-12 更新
17
0
tellarin-ai/llm-japanese-dataset-vanilla-aya-format
语言模型
数据调优
该数据集是从其原始v1.0.0格式转换而来,并在此以相同的CC-BY-SA 4.0许可证和条件下发布。它包含用于LLM构建/调整的日语指令类数据。数据集仅包含一个train分割,约有2.46M行数据。格式转换的细节包括如何将原始数据集中的instruction和input列合并,并在特定情况下添加前缀句子。转换后的数据集仅使用Aya格式指定的两列:inputs和targets。
Hugging Face
2024-01-31 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广