登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
hermes-function-calling-v1-all
hermes-function-calling-v1-all
收藏
AI_Studio
2026-01-09 更新
2026-06-11 收录
数据链接:
https://aistudio.baidu.com/datasetdetail/366237
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
hermes-function-calling-v1-all
Hermes函数调用v1全量数据集
应用场景:
提供机构:
皮都坦率的法夏
相关数据集
Aider-Polyglot
编程语言
机器学习评估
Aider的多语言基准测试基于Exercism的编码练习,包含225个在C++、Go、Java、JavaScript、Python和Rust中的高难度练习,旨在评估LLM在多种编程语言中的代码编辑能力。
AI_Studio
2025-09-01 更新
7
0
ZebraLogicBench
逻辑推理
人工智能模型
ZebraLogic 是一个专为评估大型语言模型(LLMs)逻辑推理能力而设计的基准测试集,聚焦于逻辑网格谜题(如著名的“斑马谜题”)。该评估集由 Allen Institute for AI 开发,旨在系统地测试模型在处理复杂约束满足问题(CSPs)时的表现。
AI_Studio
2025-08-28 更新
6
0
AIME_2024
数学竞赛
教育资源
该数据集包含2024年美国数学邀请赛(AIME)I和II的30道数学竞赛题目,每道题目附有问题陈述、详细解答和答案。
AI_Studio
2025-08-28 更新
5
0
SWE-bench_Verified
软件工程
自动化问题解决
SWE-bench Verified是SWE-bench测试集的一个子集,包含500个人工验证的样本,用于测试系统自动解决GitHub问题的能力。
AI_Studio
2025-08-28 更新
6
0
arc-agi-2
人工智能
AGI(通用人工智能)
ARC-AGI-2 于 2025 年 3 月 24 日发布。ARC-AGI 系列的第二版提高了人工智能的难度,同时保持了对人类来说相对容易的水平。它就像一个指向有用研究方向的指南针,一个测试小样本推理架构的试验场,一个加速 AGI 进程的工具。
AI_Studio
2025-08-28 更新
5
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广