登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
thinkPy/synthetic-dataset_cultura-guarani_mistral-it-v0.3
thinkPy/synthetic-dataset_cultura-guarani_mistral-it-v0.3
收藏
Hugging Face
2024-05-23 更新
2024-06-12 收录
数据链接:
https://hf-mirror.com/datasets/thinkPy/synthetic-dataset_cultura-guarani_mistral-it-v0.3
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: cc-by-sa-4.0 ---
应用场景:
提供机构:
thinkPy
原始信息汇总
数据集许可证信息
许可证类型
: CC-BY-SA-4.0
相关数据集
thinkPy/synthetic-dataset_cultura-guarani_phi3-14B
文化研究
语言数据
--- license: cc-by-sa-4.0 dataset_info: features: - name: index dtype: int64 - name: referencias dtype: string - name: preguntas dtype: string - name: contexto seq
Hugging Face
2024-06-06 更新
18
0
thinkPy/eval-cultura-guarani_gua-a_v0.1-ft_mistral-7b
语言处理
机器翻译
--- license: cc-by-sa-4.0 dataset_info: features: - name: source dtype: string - name: references dtype: string - name: base_answer dtype: string - name: generated_answer dty
Hugging Face
2024-04-21 更新
12
0
thinkPy/synthetic-dataset_cultura-guarani_llama3-70B
瓜拉尼文化
自然语言处理
该数据集包含多个特征,如id、类型、上下文、问题、模型、国家、语言、时期、章节和参考文献。数据集分为一个训练集,包含33082个样本,总大小为88162807字节。下载大小为1621638字节。
Hugging Face
2024-06-17 更新
11
0
thinkPy/americasnlp_2025_guarani_analysis
低资源机器翻译
大语言模型性能评测
该数据集包含用于文本转换或编辑任务的数据,主要字段包括ID、源文本(Source)、变更描述(Change)和目标文本(Target)。数据集针对多个大语言模型(如SmolLM3-3B、Llama系列、Qwen系列等)提供了分词后的源文本和目标文本(Tokenized_Source和Tokenized_Target),以及对应的词元计数(Source_Token_Count和Target_Toke
Hugging Face
2026-05-30 更新
13
0
thinkPy/synthetic-dataset_cultura-guarani_llama3-8B-aux
语言处理
文化研究
--- license: cc-by-sa-4.0 dataset_info: features: - name: index dtype: int64 - name: referencias dtype: string - name: preguntas dtype: string - name: contexto seq
Hugging Face
2024-05-19 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广