jinaai_jina-embeddings-v2-base-en-03092024-u59b-webapp
收藏资源简介:
该数据集名为'德语健康保险信息',旨在支持特定领域嵌入模型的发展,用于检索任务。数据集内容涵盖健康、保险和法规等主题,语言为德语。该数据集用于训练特定的嵌入模型,并提供了使用Hugging Face `datasets`库加载和使用该数据集的指导。
This dataset, named "German Health Insurance Information", aims to support the development of domain-specific embedding models for retrieval tasks. It covers topics including health, insurance and regulations, and is in German. The dataset is used for training targeted embedding models, and provides guidance on loading and utilizing the dataset via the Hugging Face `datasets` library.
jinaai_jina-embeddings-v2-base-en-03092024-u59b-webapp 数据集
数据集描述
"health insurance information in German language" 数据集是一个生成的数据集,旨在支持领域特定嵌入模型在检索任务中的开发。
相关模型
该数据集用于训练 jinaai_jina-embeddings-v2-base-en-03092024-u59b-webapp 模型。
如何使用
要使用此数据集进行模型训练或评估,可以使用 Hugging Face 的 datasets 库加载它,如下所示:
python from datasets import load_dataset
dataset = load_dataset("fine-tuned/jinaai_jina-embeddings-v2-base-en-03092024-u59b-webapp") print(dataset[test][0])




