官方服务:
资源简介:
:unav
应用场景:
相关数据集
Nexdata/200475_Sentences_Chinese_Text_Normalization_Data
--- license: cc-by-nc-nd-4.0 --- ## Description 200,475 Sentences - Chinese Text Normalization Data. Annotate the special symbols and Arabic numerals in the sentences as Chinese characters. For more
Hugging Face2024-04-16 更新830
D435_Chinese_Text_Normalization_Data
本套TN数据包括200,475句原始文本,每句标注文本中的特殊符号及数字的汉字读法。
OpenCSG2026-03-04 更新140
chatgpt-roles
ChatGPT Roles仓库提供了一系列预定义的角色,旨在用于文本生成任务。这些角色涵盖了故事创作、历史推演、艺术评论、问题解决、情感理解、科技预测、太空探索、环保倡导、健身指导、烹饪技巧等多个领域。数据集包含数千条样本,每个样本都定义了一个独特的ChatGPT角色,例如StorySmithGPT、TimeWarpGPT等,并描述了该角色擅长的技能和知识领域。这些角色定义可以用于指导ChatGP
Opencsg2024-07-19 更新70
bene-ges/en_gtn_vocab
该数据集是从Google文本规范化数据集中提取的词汇表,包含(semiotic_class, normalized, non-normalized, freq)元组。它通过一个特定的脚本生成,并可以用于快速文本规范化。
Hugging Face2023-08-04 更新330
thivux/text_norm
该数据集包含两个主要特征:src和tgt,均为字符串类型。数据集分为训练集、测试集和验证集,分别包含249602、1250和1243个样本。数据集的下载大小为546783222字节,总大小为1101033687字节。
Hugging Face2024-06-18 更新100



