遇见数据集

AnCora Catalan 2.0.0

收藏
NIAID Data Ecosystem2026-05-02 收录
数据链接:
官方服务:

资源简介:

AnCora Catalan 2.0.0 consists of 500,000 words. The corpus is annotated at different levels: Lemma and Part of Speech Syntactic constituents and functions Argument structure and thematic roles Semantic classes of the verb Nouns related to WordNet synsets Named Entities Coreference relations AnCora Catalan 2.0.0 is mainly based on journalist texts. For more information, click AnCora-corpus. The annotators of AnCora Catalan 2.0.0 are: Oriol Borrega, Isabel Briz, Núria Bufí, Montserrat Civit, María Jesús Díaz, Silvia Garcia, Raquel Hernández, Marina Lloberes, Raquel Marcos, Difda Monterde, Montserrat Nofre, Aina Peris, Lourdes Puiggròs, Marta Recasens, Bàrbara Soriano, Rita Zaragoza.

创建时间:
2024-07-29
二维码
社区交流群
二维码
科研交流群
商业服务