登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
TokenBender/e5_FT_sentence_retrieval_task_Hindi
TokenBender/e5_FT_sentence_retrieval_task_Hindi
收藏
Hugging Face
2024-01-17 更新
2024-03-04 收录
模型微调
印地语处理
数据链接:
https://hf-mirror.com/datasets/TokenBender/e5_FT_sentence_retrieval_task_Hindi
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
应用场景:
提供机构:
TokenBender
原始信息汇总
数据集许可证
许可证类型
: Apache 2.0
相关数据集
sk-community/romanized_hindi
印地语处理
罗马化
Romanized Hindi数据集是一个包含印地语文本及其罗马化(拉丁脚本)表示的集合。该数据集通过结合多个来源创建,包括开放数据集、合成数据生成和基于规则的转写方法。数据集设计用于训练和评估印地语↔罗马语转写模型。
Hugging Face
2025-10-04 更新
12
0
finetuning_demo
自然语言处理
模型微调
该数据集包含一个名为'prompt'的字符串类型特征。数据集分为一个训练集,包含50个样本,占用21627字节。数据集的下载大小为8325字节,总大小为21627字节。配置文件中指定了默认配置,数据文件路径为data/train-*。
Hugging Face
2025-01-23 更新
7
0
TeichAI/gpt-5.1-codex-max-1000x
视觉语言模型
模型微调
这是一个使用GPT 5.1 Codex Max模型创建的推理数据集,推理深度设置为高。数据集旨在通过微调现有的开源LLMs来创建GPT 5.1 Codex Max的蒸馏版本。数据集中的提示是标准提示集的改编版本,旨在引发复杂的推理。数据集生成成本为23.51美元(USD),总令牌数(输入+输出)为2.39 M。
Hugging Face
2025-12-19 更新
7
0
TokenBender/sentence_retrieval_hindi_SFT
印地语句子检索
监督微调
--- license: apache-2.0 ---
Hugging Face
2024-01-28 更新
12
0
harshit03/finetune_dataset
自然语言处理
模型微调
--- dataset_info: features: - name: instruction dtype: string - name: output dtype: string splits: - name: train num_bytes: 4186564 num_examples: 1000 download_size: 224592
Hugging Face
2024-01-18 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广