登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Retrieval efficiency with and without hash codes.
Retrieval efficiency with and without hash codes.
收藏
NIAID Data Ecosystem
2026-03-10 收录
哈希检索优化
近似最近邻搜索
数据链接:
https://figshare.com/articles/dataset/Retrieval_efficiency_with_and_without_hash_codes_/5275642
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Retrieval efficiency with and without hash codes.
应用场景:
创建时间:
2017-08-03
相关数据集
CANDY
近似最近邻搜索
数据处理
CANDY数据集由新加坡科技设计大学等机构创建,专注于连续近似最近邻搜索的动态数据摄取。该数据集包含多种应用领域的真实世界工作负载,如文本嵌入、图像处理和音频处理,以及一个新合成数据集WTE。创建过程中,数据集采用了先进的数据处理策略,如数据丢弃和微批处理,以模拟真实世界的动态数据摄取。CANDY数据集主要用于评估和优化近似最近邻算法在动态环境中的适应性和性能,旨在解决实时数据更新和分布变化带来的
arXiv
2024-06-28 更新
73
0
open-vdb/sift-128-euclidean
近似最近邻搜索
欧几里得距离
sift-128-euclidean数据集是一个用于基准测试和研究的公开数据集。它包含了训练集、测试集和邻居信息集三个部分。数据集的具体任务没有明确说明。训练集大小为122.057 MB,包含100万条记录;测试集大小为1.240 MB,包含1万条记录;邻居信息集大小为87.858 MB,包含1万条记录。所有数据集都遵循原始数据来源的许可和版权,地面真实部分遵循Apache 2.0许可。此数据集按
Hugging Face
2025-01-07 更新
13
0
GSearch_k16_s18000_n128_ef1600_optdens.tar.gz
图数据库
近似最近邻搜索
Graph database for HNSW and MinHash
DataCite Commons
2023-11-23 更新
9
0
unum-cloud/ann-wiki-1m
相似性搜索
近似最近邻搜索
该数据集包含用于近似最近邻搜索基准测试的100万维基百科样本的256维向量。数据集结构包括三个矩阵:base(用于构建索引的1M向量)、query(用于在索引中查找的100K向量)和truth(每个100K查询的10倍结果)。
Hugging Face
2023-04-30 更新
32
0
gaurav8297/navix
近似最近邻搜索
数据挖掘
Navix数据集包括四个大规模数据集,分别为Gist 1M、Tiny 5M、Wiki 15.4M和Arxiv 2.1M,用于近似最近邻搜索的基准测试。同时,提供了一个wiki_sample示例数据集,方便进行快速基准测试。
Hugging Face
2025-03-06 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广