遇见数据集

DeepLearning101/Corrector101zhTW

收藏
Hugging Face2024-04-29 更新2024-06-12 收录
官方服务:

资源简介:

该数据集包含多个用于繁体中文文本纠错的数据集和模型,包括ERNIE、MacBertMaskedLM、wikipedia-zh-20230720-filtered.json和Automatic Corpus Generation-zh。这些资源旨在帮助改进和优化中文文本的自动纠错能力。

提供机构:
DeepLearning101
原始信息汇总

数据集概述

数据集内容

  • ERNIE for Chinese Spelling Correction 繁體中文
  • MacBertMaskedLM For Chinese Spelling Correction 繁體中文
  • wikipedia-zh-20230720-filtered.json 繁體中文
  • Automatic Corpus Generation-zh 繁體中文

数据集属性

  • 许可证: MIT
  • 语言: 中文
  • 大小: 1M<n<10M
二维码
社区交流群
二维码
科研交流群
商业服务