cmpatino/news-bias-detection-dataset
收藏资源简介:
--- dataset_info: - config_name: all features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307148 dataset_size: 441127 - config_name: political-center features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 337164 num_examples: 1306 - name: validation num_bytes: 43718 num_examples: 167 - name: test num_bytes: 44679 num_examples: 167 download_size: 296363 dataset_size: 425561 - config_name: political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 337423 num_examples: 1306 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 297703 dataset_size: 427465 - config_name: political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 336840 num_examples: 1306 - name: validation num_bytes: 43083 num_examples: 165 - name: test num_bytes: 44723 num_examples: 166 download_size: 296047 dataset_size: 424646 - config_name: w=0.0_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.0_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307145 dataset_size: 441127 - config_name: w=0.0_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307145 dataset_size: 441127 - config_name: w=0.0_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307155 dataset_size: 441127 - config_name: w=0.0_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307146 dataset_size: 441127 - config_name: w=0.1_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.1_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307145 dataset_size: 441127 - config_name: w=0.1_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307145 dataset_size: 441127 - config_name: w=0.1_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307162 dataset_size: 441127 - config_name: w=0.1_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307146 dataset_size: 441127 - config_name: w=0.2_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307154 dataset_size: 441127 - config_name: w=0.2_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307145 dataset_size: 441127 - config_name: w=0.2_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307145 dataset_size: 441127 - config_name: w=0.2_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307153 dataset_size: 441127 - config_name: w=0.2_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307146 dataset_size: 441127 - config_name: w=0.3_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.3_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307147 dataset_size: 441127 - config_name: w=0.3_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.3_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307153 dataset_size: 441127 - config_name: w=0.3_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307149 dataset_size: 441127 - config_name: w=0.4_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.4_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307145 dataset_size: 441127 - config_name: w=0.4_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307157 dataset_size: 441127 - config_name: w=0.4_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.4_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307158 dataset_size: 441127 - config_name: w=0.5_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307153 dataset_size: 441127 - config_name: w=0.5_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307146 dataset_size: 441127 - config_name: w=0.5_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307155 dataset_size: 441127 - config_name: w=0.5_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.5_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.6_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307152 dataset_size: 441127 - config_name: w=0.6_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307146 dataset_size: 441127 - config_name: w=0.6_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307158 dataset_size: 441127 - config_name: w=0.6_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307146 dataset_size: 441127 - config_name: w=0.6_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307153 dataset_size: 441127 - config_name: w=0.7_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307152 dataset_size: 441127 - config_name: w=0.7_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307146 dataset_size: 441127 - config_name: w=0.7_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307165 dataset_size: 441127 - config_name: w=0.7_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307146 dataset_size: 441127 - config_name: w=0.7_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307153 dataset_size: 441127 - config_name: w=0.8_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.8_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307146 dataset_size: 441127 - config_name: w=0.8_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307165 dataset_size: 441127 - config_name: w=0.8_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307148 dataset_size: 441127 - config_name: w=0.8_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307156 dataset_size: 441127 - config_name: w=0.9_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=0.9_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307148 dataset_size: 441127 - config_name: w=0.9_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307163 dataset_size: 441127 - config_name: w=0.9_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307148 dataset_size: 441127 - config_name: w=0.9_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307159 dataset_size: 441127 - config_name: w=1.0_education-high_school_or_less features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307151 dataset_size: 441127 - config_name: w=1.0_max-political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307148 dataset_size: 441127 - config_name: w=1.0_max-political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307159 dataset_size: 441127 - config_name: w=1.0_political-left features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307148 dataset_size: 441127 - config_name: w=1.0_political-right features: - name: sentence_id dtype: string - name: text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 351085 num_examples: 1360 - name: validation num_bytes: 44328 num_examples: 170 - name: test num_bytes: 45714 num_examples: 170 download_size: 307159 dataset_size: 441127 configs: - config_name: all data_files: - split: train path: all/train-* - split: validation path: all/validation-* - split: test path: all/test-* - config_name: political-center data_files: - split: train path: political-center/train-* - split: validation path: political-center/validation-* - split: test path: political-center/test-* - config_name: political-left data_files: - split: train path: political-left/train-* - split: validation path: political-left/validation-* - split: test path: political-left/test-* - config_name: political-right data_files: - split: train path: political-right/train-* - split: validation path: political-right/validation-* - split: test path: political-right/test-* - config_name: w=0.0_education-high_school_or_less data_files: - split: train path: w=0.0_education-high_school_or_less/train-* - split: validation path: w=0.0_education-high_school_or_less/validation-* - split: test path: w=0.0_education-high_school_or_less/test-* - config_name: w=0.0_max-political-left data_files: - split: train path: w=0.0_max-political-left/train-* - split: validation path: w=0.0_max-political-left/validation-* - split: test path: w=0.0_max-political-left/test-* - config_name: w=0.0_max-political-right data_files: - split: train path: w=0.0_max-political-right/train-* - split: validation path: w=0.0_max-political-right/validation-* - split: test path: w=0.0_max-political-right/test-* - config_name: w=0.0_political-left data_files: - split: train path: w=0.0_political-left/train-* - split: validation path: w=0.0_political-left/validation-* - split: test path: w=0.0_political-left/test-* - config_name: w=0.0_political-right data_files: - split: train path: w=0.0_political-right/train-* - split: validation path: w=0.0_political-right/validation-* - split: test path: w=0.0_political-right/test-* - config_name: w=0.1_education-high_school_or_less data_files: - split: train path: w=0.1_education-high_school_or_less/train-* - split: validation path: w=0.1_education-high_school_or_less/validation-* - split: test path: w=0.1_education-high_school_or_less/test-* - config_name: w=0.1_max-political-left data_files: - split: train path: w=0.1_max-political-left/train-* - split: validation path: w=0.1_max-political-left/validation-* - split: test path: w=0.1_max-political-left/test-* - config_name: w=0.1_max-political-right data_files: - split: train path: w=0.1_max-political-right/train-* - split: validation path: w=0.1_max-political-right/validation-* - split: test path: w=0.1_max-political-right/test-* - config_name: w=0.1_political-left data_files: - split: train path: w=0.1_political-left/train-* - split: validation path: w=0.1_political-left/validation-* - split: test path: w=0.1_political-left/test-* - config_name: w=0.1_political-right data_files: - split: train path: w=0.1_political-right/train-* - split: validation path: w=0.1_political-right/validation-* - split: test path: w=0.1_political-right/test-* - config_name: w=0.2_education-high_school_or_less data_files: - split: train path: w=0.2_education-high_school_or_less/train-* - split: validation path: w=0.2_education-high_school_or_less/validation-* - split: test path: w=0.2_education-high_school_or_less/test-* - config_name: w=0.2_max-political-left data_files: - split: train path: w=0.2_max-political-left/train-* - split: validation path: w=0.2_max-political-left/validation-* - split: test path: w=0.2_max-political-left/test-* - config_name: w=0.2_max-political-right data_files: - split: train path: w=0.2_max-political-right/train-* - split: validation path: w=0.2_max-political-right/validation-* - split: test path: w=0.2_max-political-right/test-* - config_name: w=0.2_political-left data_files: - split: train path: w=0.2_political-left/train-* - split: validation path: w=0.2_political-left/validation-* - split: test path: w=0.2_political-left/test-* - config_name: w=0.2_political-right data_files: - split: train path: w=0.2_political-right/train-* - split: validation path: w=0.2_political-right/validation-* - split: test path: w=0.2_political-right/test-* - config_name: w=0.3_education-high_school_or_less data_files: - split: train path: w=0.3_education-high_school_or_less/train-* - split: validation path: w=0.3_education-high_school_or_less/validation-* - split: test path: w=0.3_education-high_school_or_less/test-* - config_name: w=0.3_max-political-left data_files: - split: train path: w=0.3_max-political-left/train-* - split: validation path: w=0.3_max-political-left/validation-* - split: test path: w=0.3_max-political-left/test-* - config_name: w=0.3_max-political-right data_files: - split: train path: w=0.3_max-political-right/train-* - split: validation path: w=0.3_max-political-right/validation-* - split: test path: w=0.3_max-political-right/test-* - config_name: w=0.3_political-left data_files: - split: train path: w=0.3_political-left/train-* - split: validation path: w=0.3_political-left/validation-* - split: test path: w=0.3_political-left/test-* - config_name: w=0.3_political-right data_files: - split: train path: w=0.3_political-right/train-* - split: validation path: w=0.3_political-right/validation-* - split: test path: w=0.3_political-right/test-* - config_name: w=0.4_education-high_school_or_less data_files: - split: train path: w=0.4_education-high_school_or_less/train-* - split: validation path: w=0.4_education-high_school_or_less/validation-* - split: test path: w=0.4_education-high_school_or_less/test-* - config_name: w=0.4_max-political-left data_files: - split: train path: w=0.4_max-political-left/train-* - split: validation path: w=0.4_max-political-left/validation-* - split: test path: w=0.4_max-political-left/test-* - config_name: w=0.4_max-political-right data_files: - split: train path: w=0.4_max-political-right/train-* - split: validation path: w=0.4_max-political-right/validation-* - split: test path: w=0.4_max-political-right/test-* - config_name: w=0.4_political-left data_files: - split: train path: w=0.4_political-left/train-* - split: validation path: w=0.4_political-left/validation-* - split: test path: w=0.4_political-left/test-* - config_name: w=0.4_political-right data_files: - split: train path: w=0.4_political-right/train-* - split: validation path: w=0.4_political-right/validation-* - split: test path: w=0.4_political-right/test-* - config_name: w=0.5_education-high_school_or_less data_files: - split: train path: w=0.5_education-high_school_or_less/train-* - split: validation path: w=0.5_education-high_school_or_less/validation-* - split: test path: w=0.5_education-high_school_or_less/test-* - config_name: w=0.5_max-political-left data_files: - split: train path: w=0.5_max-political-left/train-* - split: validation path: w=0.5_max-political-left/validation-* - split: test path: w=0.5_max-political-left/test-* - config_name: w=0.5_max-political-right data_files: - split: train path: w=0.5_max-political-right/train-* - split: validation path: w=0.5_max-political-right/validation-* - split: test path: w=0.5_max-political-right/test-* - config_name: w=0.5_political-left data_files: - split: train path: w=0.5_political-left/train-* - split: validation path: w=0.5_political-left/validation-* - split: test path: w=0.5_political-left/test-* - config_name: w=0.5_political-right data_files: - split: train path: w=0.5_political-right/train-* - split: validation path: w=0.5_political-right/validation-* - split: test path: w=0.5_political-right/test-* - config_name: w=0.6_education-high_school_or_less data_files: - split: train path: w=0.6_education-high_school_or_less/train-* - split: validation path: w=0.6_education-high_school_or_less/validation-* - split: test path: w=0.6_education-high_school_or_less/test-* - config_name: w=0.6_max-political-left data_files: - split: train path: w=0.6_max-political-left/train-* - split: validation path: w=0.6_max-political-left/validation-* - split: test path: w=0.6_max-political-left/test-* - config_name: w=0.6_max-political-right data_files: - split: train path: w=0.6_max-political-right/train-* - split: validation path: w=0.6_max-political-right/validation-* - split: test path: w=0.6_max-political-right/test-* - config_name: w=0.6_political-left data_files: - split: train path: w=0.6_political-left/train-* - split: validation path: w=0.6_political-left/validation-* - split: test path: w=0.6_political-left/test-* - config_name: w=0.6_political-right data_files: - split: train path: w=0.6_political-right/train-* - split: validation path: w=0.6_political-right/validation-* - split: test path: w=0.6_political-right/test-* - config_name: w=0.7_education-high_school_or_less data_files: - split: train path: w=0.7_education-high_school_or_less/train-* - split: validation path: w=0.7_education-high_school_or_less/validation-* - split: test path: w=0.7_education-high_school_or_less/test-* - config_name: w=0.7_max-political-left data_files: - split: train path: w=0.7_max-political-left/train-* - split: validation path: w=0.7_max-political-left/validation-* - split: test path: w=0.7_max-political-left/test-* - config_name: w=0.7_max-political-right data_files: - split: train path: w=0.7_max-political-right/train-* - split: validation path: w=0.7_max-political-right/validation-* - split: test path: w=0.7_max-political-right/test-* - config_name: w=0.7_political-left data_files: - split: train path: w=0.7_political-left/train-* - split: validation path: w=0.7_political-left/validation-* - split: test path: w=0.7_political-left/test-* - config_name: w=0.7_political-right data_files: - split: train path: w=0.7_political-right/train-* - split: validation path: w=0.7_political-right/validation-* - split: test path: w=0.7_political-right/test-* - config_name: w=0.8_education-high_school_or_less data_files: - split: train path: w=0.8_education-high_school_or_less/train-* - split: validation path: w=0.8_education-high_school_or_less/validation-* - split: test path: w=0.8_education-high_school_or_less/test-* - config_name: w=0.8_max-political-left data_files: - split: train path: w=0.8_max-political-left/train-* - split: validation path: w=0.8_max-political-left/validation-* - split: test path: w=0.8_max-political-left/test-* - config_name: w=0.8_max-political-right data_files: - split: train path: w=0.8_max-political-right/train-* - split: validation path: w=0.8_max-political-right/validation-* - split: test path: w=0.8_max-political-right/test-* - config_name: w=0.8_political-left data_files: - split: train path: w=0.8_political-left/train-* - split: validation path: w=0.8_political-left/validation-* - split: test path: w=0.8_political-left/test-* - config_name: w=0.8_political-right data_files: - split: train path: w=0.8_political-right/train-* - split: validation path: w=0.8_political-right/validation-* - split: test path: w=0.8_political-right/test-* - config_name: w=0.9_education-high_school_or_less data_files: - split: train path: w=0.9_education-high_school_or_less/train-* - split: validation path: w=0.9_education-high_school_or_less/validation-* - split: test path: w=0.9_education-high_school_or_less/test-* - config_name: w=0.9_max-political-left data_files: - split: train path: w=0.9_max-political-left/train-* - split: validation path: w=0.9_max-political-left/validation-* - split: test path: w=0.9_max-political-left/test-* - config_name: w=0.9_max-political-right data_files: - split: train path: w=0.9_max-political-right/train-* - split: validation path: w=0.9_max-political-right/validation-* - split: test path: w=0.9_max-political-right/test-* - config_name: w=0.9_political-left data_files: - split: train path: w=0.9_political-left/train-* - split: validation path: w=0.9_political-left/validation-* - split: test path: w=0.9_political-left/test-* - config_name: w=0.9_political-right data_files: - split: train path: w=0.9_political-right/train-* - split: validation path: w=0.9_political-right/validation-* - split: test path: w=0.9_political-right/test-* - config_name: w=1.0_education-high_school_or_less data_files: - split: train path: w=1.0_education-high_school_or_less/train-* - split: validation path: w=1.0_education-high_school_or_less/validation-* - split: test path: w=1.0_education-high_school_or_less/test-* - config_name: w=1.0_max-political-left data_files: - split: train path: w=1.0_max-political-left/train-* - split: validation path: w=1.0_max-political-left/validation-* - split: test path: w=1.0_max-political-left/test-* - config_name: w=1.0_max-political-right data_files: - split: train path: w=1.0_max-political-right/train-* - split: validation path: w=1.0_max-political-right/validation-* - split: test path: w=1.0_max-political-right/test-* - config_name: w=1.0_political-left data_files: - split: train path: w=1.0_political-left/train-* - split: validation path: w=1.0_political-left/validation-* - split: test path: w=1.0_political-left/test-* - config_name: w=1.0_political-right data_files: - split: train path: w=1.0_political-right/train-* - split: validation path: w=1.0_political-right/validation-* - split: test path: w=1.0_political-right/test-* ---
数据集信息如下: 该数据集包含多个配置分支,所有配置的特征字段均一致,包含3个字段:1. 句子ID(sentence_id):数据类型为字符串(string);2. 文本(text):数据类型为字符串(string);3. 标签(label):数据类型为64位整数(int64)。 各配置的详细参数如下: 1. 配置名称:全量(all): 数据划分:训练集(train)字节数351085,样本数1360;验证集(validation)字节数44328,样本数170;测试集(test)字节数45714,样本数170。 下载总大小307148字节,数据集存储总大小441127字节。 2. 配置名称:政治中间派(political-center): 数据划分:训练集字节数337164,样本数1306;验证集字节数43718,样本数167;测试集字节数44679,样本数167。 下载总大小296363字节,数据集存储总大小425561字节。 3. 配置名称:政治左翼(political-left): 数据划分:训练集字节数337423,样本数1306;验证集字节数44328,样本数170;测试集字节数45714,样本数170。 下载总大小297703字节,数据集存储总大小427465字节。 4. 配置名称:政治右翼(political-right): 数据划分:训练集字节数336840,样本数1306;验证集字节数43083,样本数165;测试集字节数44723,样本数166。 下载总大小296047字节,数据集存储总大小424646字节。 5. 配置名称:权重w=0.0_教育程度:高中及以下(w=0.0_education-high_school_or_less): 数据划分:训练集字节数351085,样本数1360;验证集字节数44328,样本数170;测试集字节数45714,样本数170。 下载总大小307151字节,数据集存储总大小441127字节。 6. 配置名称:权重w=0.0_最大政治左翼(w=0.0_max-political-left): 数据划分:训练集字节数351085,样本数1360;验证集字节数44328,样本数170;测试集字节数45714,样本数170。 下载总大小307145字节,数据集存储总大小441127字节。 7. 配置名称:权重w=0.0_最大政治右翼(w=0.0_max-political-right): 数据划分:训练集字节数351085,样本数1360;验证集字节数44328,样本数170;测试集字节数45714,样本数170。 下载总大小307145字节,数据集存储总大小441127字节。 8. 配置名称:权重w=0.0_政治左翼(w=0.0_political-left): 数据划分:训练集字节数351085,样本数1360;验证集字节数44328,样本数170;测试集字节数45714,样本数170。 下载总大小307155字节,数据集存储总大小441127字节。 9. 配置名称:权重w=0.0_政治右翼(w=0.0_political-right): 数据划分:训练集字节数351085,样本数1360;验证集字节数44328,样本数170;测试集字节数45714,样本数170。 下载总大小307146字节,数据集存储总大小441127字节。 其余权重从0.1至1.0的子配置,其特征字段、数据划分参数(训练集1360样本、字节数351085,验证集170样本、字节数44328,测试集170样本、字节数45714)与上述配置一致,仅配置名称、下载总大小与数据集存储总大小存在细微差异。 所有配置的数据文件路径规则统一为:训练集数据路径为`{配置名称}/train-*`,验证集数据路径为`{配置名称}/validation-*`,测试集数据路径为`{配置名称}/test-*`,其中`{配置名称}`为各配置的官方标识名称。



