登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
flan1m-alpaca-uncensored
flan1m-alpaca-uncensored
收藏
OpenCSG
2024-07-19 更新
2026-01-19 收录
数据链接:
https://opencsg.com/datasets/AIWizards/flan1m-alpaca-uncensored?tab=summary
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
本仓库旨在解决axolotl与dolphin之间的问题,主要功能由ehartford提供支持。遵循MIT许可协议。
应用场景:
提供机构:
AIWizards
创建时间:
2024-07-19
相关数据集
binding_affinity
蛋白质-配体结合亲和力预测
药物发现
jglaser/binding_affinity 仓库提供蛋白质序列和配体SMILES的结合亲和力数据,共包含190万个独特的配对,适用于微调语言模型。数据来源于BindingDB、PDBbind-cn、BioLIP和BindingMOAD。该仓库提供预处理后的数据集,并支持用户手动进行预处理。用户可以加载预先分割的训练集和验证集,或者选择移除特定蛋白质序列的数据集。
OpenCSG
2024-07-19 更新
17
0
consumer-finance-complaints
金融投诉分析
文本分类
consumer-finance-complaints 仓库提供了一个关于消费者金融产品和服务的投诉数据集,数据规模达到数百万条。这些数据由用户众包生成,主要用于文本分类任务,例如预测投诉相关的产品、子产品或标签(如老年人、军人)。数据集包含投诉文本、公司回应、消费者争议等多个字段,并已对个人身份信息进行匿名化处理。该数据集基于 Creative Commons Zero v1.0 Univers
OpenCSG
2024-07-19 更新
14
0
hebrew_sentiment
阿拉伯语情感分析
社交媒体挖掘
HebrewSentiment主要用于情感分析任务,它包含超过1万条从以色列总统Facebook页面收集的用户评论,并标注了情感极性(积极、消极、中立)。数据以TSV格式存储,包含希伯来语句子和情感标签两列。该仓库提供token和morph两种配置,并采用MIT许可。
OpenCSG
2024-07-19 更新
11
0
kelm
知识增强预训练
数据到文本生成
Corpus for Knowledge-Enhanced Language Model Pre-training (KELM) 专注于将知识图谱三元组(主语、关系、宾语)转换为自然语言句子,用于数据到文本的生成任务。该语料库包含约1800万个句子,涵盖约4500万个三元组和约1500个不同的关系,数据来源于英文维基百科及其相关的知识图谱。数据集包括训练集、验证集和测试集,并采用CC BY-SA
OpenCSG
2024-07-19 更新
14
0
hard
阿拉伯语
情感分析
HARD仓库主要面向阿拉伯语,包含从Booking.com收集的约10万条酒店评论文本,其中既有现代标准阿拉伯语,也有阿拉伯语方言。每条评论都带有一个1到5的评分标签,可用于多类别文本分类任务,例如情感分析。该仓库提供阿拉伯语酒店评论数据集,但授权许可等信息缺失。
OpenCSG
2024-07-19 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广