登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Online Supplement 1
Online Supplement 1
收藏
Figshare
2020-02-11 更新
2026-04-28 收录
词向量优化
语言模型调优
数据链接:
https://figshare.com/articles/dataset/Online_Supplement_1/11836116
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Parameter tuning of word2vec model
应用场景:
创建时间:
2020-02-11
相关数据集
pinzhenchen/alpaca-cleaned-bg
语言模型调优
保加利亚语
该HF数据仓库包含了用于单语与多语指令调优研究的保加利亚Alpaca数据集。数据集是通过机器翻译从[yahma/alpaca-cleaned](https://huggingface.co/datasets/yahma/alpaca-cleaned)转换而来,主要用于保加利亚语的指令调优。数据集大约包含52K个实例,每个实例包含指令、输出和可选的输入字段。已知问题是机器翻译过程可能损坏了包含代码、
Hugging Face
2024-03-06 更新
86
0
Instruction Tuning with GPT-4
自然语言处理
语言模型调优
GPT-4使用羊驼提示生成英语教学后续数据,以微调LLM。
OpenDataLab
2026-07-12 更新
21
0
pinzhenchen/alpaca-cleaned-es
语言模型调优
西班牙语处理
该HF数据仓库包含用于单语与多语指令调优研究的西班牙语Alpaca数据集。数据集包含约52K个实例,每个实例包含指令、输出和可选的输入。数据集是通过机器翻译从yahma/alpaca-cleaned数据集翻译成西班牙语的。
Hugging Face
2024-03-06 更新
16
0
TIGER-Lab/WebInstructSub
问答系统
语言模型调优
WebInstruct数据集是MAmmoTH2项目的一部分,主要用于通过指令调优提升大语言模型(LLM)的性能。该数据集主要来源于StackExchange和Socratic等论坛,包含高质量的问答对。数据集构建过程包括从Common Crawl中召回文档、提取问答对并进行质量优化。数据集包含多个字段,如原始问题、原始答案、优化后的问题和答案等。数据集的大小和来源也在README中进行了详细说明。
Hugging Face
2024-10-27 更新
25
0
microsoft/orca-agentinstruct-1M-v1
指令生成
语言模型调优
该数据集是一个完全合成的指令对集合,使用AgentInstruct框架生成。它包含约100万条指令对,涵盖文本编辑、创意写作、编码、阅读理解等多种能力。数据集中的指令对是从网络上公开可用的原始文本内容中合成的。该数据集适用于任何基础大语言模型(LLM)的指令调优。AgentInstruct框架还生成了一个包含约2500万条指令对的超集,用于对Mistral-7b模型进行后训练,结果在多个基准测试中
Hugging Face
2024-11-01 更新
20
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广