登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
adamo1139/basic_economics_questions_ts_test_4
adamo1139/basic_economics_questions_ts_test_4
收藏
Hugging Face
2023-09-29 更新
2024-03-04 收录
数据链接:
https://hf-mirror.com/datasets/adamo1139/basic_economics_questions_ts_test_4
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
应用场景:
提供机构:
adamo1139
原始信息汇总
数据集许可证
许可证类型
: Apache 2.0
相关数据集
adamo1139/PS_AD_Office365_03
PowerShell脚本
Office 365
Previous version with a subset of spicyboros 2.2 coding samples plus some a few other new PowerShell scripting samples. Some formatting fixes.
Hugging Face
2023-10-05 更新
20
0
adamo1139/misc
该存储库用于收集脚本和作者的非科学基准测试,具体数据集内容未在README中详细描述。
Hugging Face
2024-07-21 更新
14
0
adamo1139/rawrr_v2-1-stage2
自然语言处理
模型优化
这是rawrr_v2数据集的一个子集,选择了那些不是聊天补全的响应,而是实际的响应。建议在之前的DPO + SFT训练之后,重复训练这部分数据集,以提高未审查性,但避免使模型变得干燥。作者计划测试这一点,因此创建了这个仓库。
Hugging Face
2024-03-07 更新
11
0
adamo1139/4chan_archive_ShareGPT_fixed_newlines_unfiltered
在线论坛
对话生成
这是一个包含218,801,883个token(使用Mistral tokenizer)的数据集,数据来源于4chan。原始数据缺少换行和聊天结构,因此通过脚本引入了聊天结构,寻找回复链。接着,使用Hermes Llama 3.1 8B模型处理了2.5M个样本,其中包含大约3000个固定的提示token和动态添加的218M个token,输出了大约218M个token来生成这个数据集。作者计划进一步
Hugging Face
2024-10-11 更新
15
0
adamo1139/AEZAKMI_v1
语言模型
AI训练
该数据集基于airoboros 2.2.1,移除了orca和gptslop样本。使用该数据集训练的模型可能会比基础airoboros模型更容易产生幻觉,因为移除了许多让模型意识到自己不是人类而是AI且没有物理身体的样本。此外,使用该数据集训练的非llama模型应该很少或不会发出拒绝响应,并且听起来更像人类而不是无菌的GPT-4。llama 2基础模型可能不会表现出这些特性,因为它们是用gptslo
Hugging Face
2023-11-27 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广