遇见数据集

ProNCI

收藏
OpenXLab2026-04-18 收录
官方服务:

资源简介:

我们发布了一个新的手动注释数据集PRONCI,该数据集由22.5k专有名词化合物及其自由形式的语义解释组成。PRONCI比先前的名词复合数据集大60倍,并且还包括以前未探索过的非组成示例。我们尝试使用各种神经模型来自动从专有名词化合物生成语义解释,从很少的提示到有监督的学习,以及对组成名词的不同程度的了解。我们发现,添加有针对性的知识,特别是关于普通名词的知识,会导致高达2.8% 的性能提升。最后,我们将模型生成的解释与现有的开放IE系统集成在一起,并以85% 的精度观察到产量的7.5% 增加。

提供机构:
OpenDataLab
创建时间:
2022-11-18
二维码
社区交流群
二维码
科研交流群
商业服务