遇见数据集

maknee/wikipedia_qwen_8b

收藏
Hugging Face2025-10-08 更新2025-10-25 收录
官方服务:

资源简介:

这是一个包含500,000个文本样本及其高质量向量嵌入的数据集,使用Qwen/Qwen3-Embedding-8B模型从wikimedia/wikipedia生成,旨在用于向量数据库训练、相似性搜索和文本检索任务。

This dataset contains 500,000 text samples with high-quality vector embeddings generated using Qwen/Qwen3-Embedding-8B from the wikimedia/wikipedia dataset, designed for vector database training, similarity search, and text retrieval tasks.

提供机构:
maknee
二维码
社区交流群
二维码
科研交流群
商业服务