登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Thermostatic/ShareGPT-InstructTranslation-EN-ES
Thermostatic/ShareGPT-InstructTranslation-EN-ES
收藏
Hugging Face
2024-07-08 更新
2024-07-22 收录
机器翻译
语言模型
数据链接:
https://hf-mirror.com/datasets/Thermostatic/ShareGPT-InstructTranslation-EN-ES
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: mit ---
许可证:MIT许可证
应用场景:
提供机构:
Thermostatic
相关数据集
homersimpson/opensubtitles_fr
机器翻译
语言数据
该数据集包含电影相关的元数据和翻译信息,具体包括电影的ID、年份、IMDb ID、字幕ID及其对应的语言(加泰罗尼亚语和法语)。数据集分为训练集、验证集和测试集,分别包含240000、30000和30000个示例。数据集的总下载大小为26004408字节,总大小为36369003字节。
Hugging Face
2023-12-05 更新
16
0
zenless-lab/alt
机器翻译
多语言文本
该数据集是一个包含英语和日语文本对的多语言数据集,适用于训练机器翻译模型。数据集包含多个配置版本,每个版本都有唯一的标识符、英语文本和日语文本,并且分为训练集和测试集。
Hugging Face
2024-12-20 更新
15
0
Kosp2e
机器翻译
语言学
Kosp2e(读作“kospi”)是一个语料库,可以将韩语语音以端到端的方式翻译成英文文本
OpenDataLab
2026-07-12 更新
13
0
GALE Phase 4 Arabic Weblog Parallel Sentences
机器翻译
平行语料库
Introduction GALE Phase 4 Arabic Weblog Parallel Sentences was developed by the Linguistic Data Consortium (LDC). Along with other corpora, the parallel text in this release comprised
DataCite Commons
2021-07-01 更新
16
0
tellarin-ai/llm-japanese-dataset-vanilla-aya-format
语言模型
数据调优
该数据集是从其原始v1.0.0格式转换而来,并在此以相同的CC-BY-SA 4.0许可证和条件下发布。它包含用于LLM构建/调整的日语指令类数据。数据集仅包含一个train分割,约有2.46M行数据。格式转换的细节包括如何将原始数据集中的instruction和input列合并,并在特定情况下添加前缀句子。转换后的数据集仅使用Aya格式指定的两列:inputs和targets。
Hugging Face
2024-01-31 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广