数据链接:
官方服务:
资源简介:
300余种编程语言的代码片段,其中包括主流编程语言如:Java,JavaScript,PHP,Pyhton,C#,C,C++,Go,CSS,Shell,matlab等;
应用场景:
提供机构:
数据堂相关数据集
Vikhrmodels/Grounded-RAG-QA-RU
该数据集是基于13,000篇俄语维基百科文章构建的,使用了GPT-4-turbo-1106生成的合成问题和答案。数据集中的对话格式遵循HuggingFace的标准,包含文档、用户和助手三个角色。特别地,助手的角色在对话末尾重复出现,第一次出现时提供文档ID的JSON数组,第二次出现时提供对用户问题的完整回答。数据集旨在训练模型回答基于多个文档的复杂和简单问题,并学会拒绝那些无法在提供文档中找到答案
Hugging Face2024-07-04 更新340
stefan-it/autotrain-flair-hipe2022-de-hmbert
该数据集主要用于命名实体识别(NER)模型的微调,涉及多种语言和数据集,包括英语、德语、法语、芬兰语、瑞典语和荷兰语。数据集来源于HIPE-2020、HIPE-2022和Europeana等项目,涵盖了多种历史文献和新闻数据。
Hugging Face2023-09-04 更新150
LinkSoul/LLaSM-Audio-Instructions
--- license: apache-2.0 task_categories: - conversational language: - en - zh pretty_name: LLaSA-Audio-Instructions size_categories: - 100K<n<1M --- 数据集正在加紧处理中,我们会尽快更新,敬请期待。 The data set is being pro
Hugging Face2023-07-26 更新60
aremuadeolajr/NaijaRC
--- license: cc-by-nc-4.0 language: - ig - yo - ha size_categories: - n<1K multilinguality: - multilingual pretty_name: NaijaRC language_details: ibo, yor, hau tags: - naijarc task_categories: - multi
Hugging Face2024-05-07 更新220
GiantSteps/GiantStepsvatex_from_url
--- dataset_info: - config_name: vatex_test features: - name: videoID dtype: string - name: enCap list: string - name: url dtype: string splits: - name: test num_bytes: 517
Hugging Face2025-12-09 更新70



