遇见数据集

smoltalk_chinese

收藏
OpenCSG2024-12-30 更新2026-01-19 收录
官方服务:

资源简介:

smoltalk-chinese 是一个参考 SmolTalk 数据集构建的中文微调数据集,旨在为大型语言模型(LLM)的训练提供高质量的合成数据支持。该数据集全部由合成数据组成,涵盖超过70万条数据,专门设计用于提升中文大型语言模型在多种任务上的表现,增强模型的多功能性和适应性。

提供机构:
OpenCSG
创建时间:
2024-12-30
二维码
社区交流群
二维码
科研交流群
商业服务