遇见数据集

Datasets & utils for paper USING PRE-TRAINED MODELS TO PARTIALLY AUTOMATE CODE REVIEW ACTIVITIES

收藏
Zenodo2021-05-29 更新2026-05-25 收录
数据链接:
官方服务:

资源简介:

Raw and processed datasets &amp; Configurations files for Pre-training and Fine-Tuning T5 models <strong>Pre-Training dataset </strong>Obtained by mining Stack Overflow and CodeSearchNet data. <strong>Fine-Tuning dataset </strong>We will fine-tune our T5 small model on different datasets obtained by mining code review data from Gerrit and GitHub repositories. <strong>Fine-Tuning dataset v1 (Small)</strong> Same dataset used by Tufano et al., abstracted code and raw comments. <strong>Fine-Tuning dataset v2 (Small)</strong> Same dataset used by Tufano et al., not abstracted code and cleaned comments. <strong>Fine-Tuning dataset (Large) </strong>Our new Large dataset

提供机构:
Zenodo
创建时间:
2021-05-29
二维码
社区交流群
二维码
科研交流群
商业服务