官方服务:
资源简介:
Drug License Dataset for Redability
用于可读性分析的药品许可数据集(Drug License Dataset)
应用场景:
创建时间:
2026-01-06
相关数据集
crrodrvi/noticias_facil
该数据集设计用于将新闻文章段落分类为易读和难读两类。它包含4,128条记录,这些记录分别来自Planeta Fácil新闻文章(易读)和多种西班牙报纸(难读)。数据集被分为训练集、验证集和测试集。数据集包含两列:一列是新闻文章的文本,另一列是对应的标签,其中0表示难读新闻文章,1表示易读新闻文章。
Hugging Face2024-06-26 更新150
EnSiWiki-2020 corpus for textual complexity modelling
The EnSiWiki-2020 Corpus is designed for modeling textual complexity using paired articles from Simple English and standard English Wikipedia. It employs two key sampling methods: age-based ranking an
DataCite Commons2025-01-30 更新80
LiFR-Law. Corpus of Paraphrased Czech Administrative Texts with Reading Comprehension for Readability Studies
This is a corpus of Czech legal and administrative texts with measured reading comprehension and a subjective expert annotation of diverse textual properties based on the Hamburg Comprehensibility Con
SSH Open MarketPlace2025-07-04 更新60
ICF DataSet from ClinicalTrials.gov.xlsx
Transparency Matters: A Review of Readability in Clinical Trial Informed Consent Forms Background : Clinical research trials rely on informed consent forms (ICFs) to explain all aspect
DataCite Commons2024-02-02 更新110
cardiffnlp/TSAR2025_SharedTask_RCTS_Trial-Data
--- task_categories: - text-generation language: - en --- ### Citation ```bibtex @inproceedings{alva-manchego-etal-2025-findings, title = "Findings of the {TSAR} 2025 Shared Task on Readability-Co
Hugging Face2025-12-08 更新60



