登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Mind2Web-Live
Mind2Web-Live
收藏
OpenCSG
2024-07-19 更新
2026-01-19 收录
任务自动化
网页交互
数据链接:
https://opencsg.com/datasets/AIWizards/Mind2Web-Live?tab=summary
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Mind2Web-Live提供了一个用于Web任务的交互数据集。该数据集的核心定位是支持Web任务相关的研究。它采用CC-BY 4.0授权许可。
应用场景:
提供机构:
AIWizards
创建时间:
2024-07-19
相关数据集
DGM4
自然语言处理
该仓库提供了一系列功能,核心定位是自然语言处理任务。它采用 Apache 2.0 授权许可。
OpenCSG
2024-07-19 更新
24
0
binding_affinity
蛋白质-配体结合亲和力预测
药物发现
jglaser/binding_affinity 仓库提供蛋白质序列和配体SMILES的结合亲和力数据,共包含190万个独特的配对,适用于微调语言模型。数据来源于BindingDB、PDBbind-cn、BioLIP和BindingMOAD。该仓库提供预处理后的数据集,并支持用户手动进行预处理。用户可以加载预先分割的训练集和验证集,或者选择移除特定蛋白质序列的数据集。
OpenCSG
2024-07-19 更新
17
0
hatexplain
仇恨言论检测
可解释人工智能
Hatexplain是一个用于可解释仇恨言论检测的基准数据集,它涵盖了仇恨言论问题的多个方面。数据内容包括英文文本,规模为1万到10万条样本。每条帖子都从三个不同的角度进行标注:基本的3类分类(仇恨、冒犯或正常)、目标群体(帖子中仇恨/冒犯言论的受害者)以及理由(标注决策所依据的帖子部分)。数据采集自Twitter和Gab,经过了标准化处理,并通过众包方式进行标注。Hatexplain支持文本分类
OpenCSG
2024-07-19 更新
14
0
RyokoAI_Syosetu711K
自然语言处理
文本生成
Syosetu711K 仓库提供了一个包含约 71.17 万部日语小说的文本数据集,这些小说来源于“成为小说家吧”网站。该数据集主要用于文本生成模型的非监督训练,同时也支持文本分类等任务。数据集中每部小说都带有元数据,包括作者、标题、ID、小说长度、积分、质量评分、章节数、关键词、是否为 R15+ 作品、小说类型 ID 和通用小说类型 ID 等信息,方便用户进行筛选和评估。该数据集基于 Apach
OpenCSG
2024-07-19 更新
21
0
deal_or_no_dialog
对话系统
多议题谈判
Deal or No Deal Negotiator仓库提供了一个大型人机对话数据集,专注于多议题谈判任务。数据集中包含超过1万条英文对话样本,涵盖了对话内容、输入信息和输出结果等字段,可用于训练端到端谈判模型。该数据集的标注由众包完成,并采用CC-BY 4.0协议授权。
OpenCSG
2024-07-19 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广