fine-tuned/jinaai_jina-embeddings-v2-base-en-02092024-ww8e-webapp
收藏资源简介:
--- license: apache-2.0 task_categories: - feature-extraction - sentence-similarity language: - en tags: - sentence-transformers - feature-extraction - sentence-similarity - mteb - Diverse - Information - Retrieval - Documents - Queries pretty_name: general domain size_categories: - n<1K --- # jinaai_jina-embeddings-v2-base-en-02092024-ww8e-webapp Dataset ## Dataset Description The dataset "general domain" is a generated dataset designed to support the development of domain specific embedding models for retrieval tasks. ## Associated Model This dataset was used to train the [**jinaai_jina-embeddings-v2-base-en-02092024-ww8e-webapp**](https://huggingface.co/fine-tuned/jinaai_jina-embeddings-v2-base-en-02092024-ww8e-webapp) model. ## How to Use To use this dataset for model training or evaluation, you can load it using the Hugging Face `datasets` library as follows: ```python from datasets import load_dataset dataset = load_dataset("fine-tuned/jinaai_jina-embeddings-v2-base-en-02092024-ww8e-webapp") print(dataset['test'][0]) ```
许可证:Apache-2.0 任务类别:特征提取、句对相似性 语言:英语 标签:句子转换器(sentence-transformers)、特征提取、句对相似性、大规模文本嵌入基准(MTEB)、多样化、信息、检索、文档、查询 可读名称:通用领域 数据规模类别:样本数少于1000(n<1K) # jinaai_jina-embeddings-v2-base-en-02092024-ww8e-webapp 数据集 ## 数据集说明 本“通用领域”数据集为生成式数据集,旨在支撑面向检索任务的领域专属嵌入模型(embedding model)的研发工作。 ## 关联模型 本数据集曾用于训练**jinaai_jina-embeddings-v2-base-en-02092024-ww8e-webapp**模型,其模型链接为:https://huggingface.co/fine-tuned/jinaai_jina-embeddings-v2-base-en-02092024-ww8e-webapp。 ## 使用方法 若需将本数据集用于模型训练或评估,可通过Hugging Face的`datasets`库加载,示例代码如下: python from datasets import load_dataset dataset = load_dataset("fine-tuned/jinaai_jina-embeddings-v2-base-en-02092024-ww8e-webapp") print(dataset['test'][0])



