登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Use of artificial intelligence in the library: Prospects and Challenges
Use of artificial intelligence in the library: Prospects and Challenges
收藏
Figshare
2025-06-24 更新
2026-04-28 收录
学术图书馆智能化
人工智能评估
数据链接:
https://figshare.com/articles/dataset/Use_of_artificial_intelligence_in_the_library_Prospects_and_Challenges/29389250
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
This article provides information on use of AI in academic libraries
应用场景:
创建时间:
2025-06-24
相关数据集
OmniEarth-Bench
地球系统科学
人工智能评估
OmniEarth-Bench是第一个全面覆盖地球科学六大圈层(大气圈、岩石圈、海洋圈、冰冻圈、生物圈和人类活动圈)及跨圈层交互的多模态基准数据集,包含一百个专家策划的评价维度。数据集利用卫星传感器和现场测量的观测数据,整合了29,779个标注,涵盖四个层次:感知、一般推理、科学知识推理和思维链(CoT)推理。
github
2025-05-30 更新
51
0
WITNESS’ Truly Innovative and Effective AI Detection (TRIED) Benchmark
人工智能评估
检测工具评估
WITNESS开发的“真正创新和有效的人工智能检测”(TRIED)基准是一个新的框架,用于评估检测工具的真正影响和创新能力。该数据集基于一线经验、欺骗性AI案例和全球咨询,旨在解决AI检测工具在现实世界场景中的局限性,如可解释性、公平性、可访问性和上下文相关性等方面的挑战。通过采用TRIED基准,利益相关者可以推动创新,保护公众信任,加强人工智能素养,并为更强大的全球信息可信度做出贡献。
arXiv
2025-04-30 更新
25
0
RUC-AIBOX/ORION
自然语言处理
人工智能评估
ORION是一个多语言基准,用于评估开放域推理在多样化网络相关领域的表现。该数据集包含310个问题,其中170个中文问题,140个英文问题,每个问题都配备了经过验证的答案、多样化的可接受变体和证据URL,以确保公平和灵活的评估。
Hugging Face
2025-05-23 更新
19
0
R2-AVSBench
自然语言处理
人工智能评估
R2-AVSBench是一个新的评估基准,设计用于包含更多具有语言多样性和推理密集性的参考。它旨在更好地评估模型在跨引用场景中的性能。该数据集由 Mohamed Bin Zayed University of Artificial Intelligence, National University of Singapore, University of Science and Technology
arXiv
2025-08-06 更新
40
0
ControlBench
控制工程
人工智能评估
ControlBench是由伊利诺伊大学厄巴纳-香槟分校等机构创建的数据集,包含147个本科控制工程问题,旨在评估大型语言模型如GPT-4、Claude 3 Opus和Gemini 1.0 Ultra在解决控制工程问题上的能力。该数据集涵盖了控制设计的广度、深度和复杂性,包括系统动力学、PID/loopshaping设计及稳定性/鲁棒性分析等。数据集的创建过程经过精心设计,确保每个问题都经过人工验
arXiv
2024-04-05 更新
22
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广