遇见数据集

convaiinnovations/bilingual-coding-qa-dataset

收藏
Hugging Face2025-10-19 更新2025-10-25 收录
官方服务:

资源简介:

这是一个包含25,151个高质量的问题回答对的双语(英语-印地语)数据集,专注于编程概念,特别是Python、机器学习和AI。该数据集用于微调编码助手模型,包含超过700万的训练数据标记。

This is a comprehensive bilingual (English-Hindi) dataset containing 25,151 high-quality question-answer pairs focused on programming concepts, particularly Python, machine learning, and AI. The dataset is used for fine-tuning coding assistant models and contains over 7 million tokens of training data.

提供机构:
convaiinnovations
二维码
社区交流群
二维码
科研交流群
商业服务