DORABench
收藏数据链接:
官方服务:
资源简介:
DORABench is a benchmark artifact for evaluating dataset-oriented reasoning and analysis workflows across multiple data sources. The artifact includes benchmark data, metadata, indexes, validation reports, scoring outputs, and agent run results for the Australian Open Data and Hugging Face benchmark subsets. It is intended to support reproducibility of the accompanying evaluation pipeline, including inspection of source data, benchmark construction, execution traces, and final scoring results.
DORABench是一款用于评估多数据源场景下面向数据集的推理与分析工作流的基准测试工件。该工件包含澳大利亚开放数据与拥抱脸(Hugging Face)基准子集的基准数据、元数据、索引、验证报告、评分输出及AI智能体运行结果。本基准集旨在支持配套评估流水线的可复现性,可用于对源数据、基准构建流程、执行轨迹与最终评分结果开展检视工作。
创建时间:
2026-05-11




