遇见数据集

ryota39/janli_synthetic_rationale

收藏
Hugging Face2024-06-12 更新2024-06-15 收录
官方服务:

资源简介:

JaNLI synthetic rationale数据集是基于JaNLI(日本語の言語現象に基づく敵対的推論データセット)的回答判断根拠,通过语言模型(microsoft/Phi-3-medium-4k-instruct)生成的。每个样本包含4个判断根拠的候选文,生成参数经过调整以避免Greedy Search模式下判断根拠缺失的情况。

提供机构:
ryota39
原始信息汇总

JaNLI synthetic rationale 数据集

概述

特徴

  • 样本结构: 每个样本包含4个回答的判断根拠候補文。
  • 生成方法: 通过改变生成参数(do_sample=False)来输出4个判断根拠候補文。
  • 候補文选择: 作者尚未确定应采用哪个判断根拠候補文。

引用

@InProceedings{yanaka-EtAl:2021:blackbox, author = {Yanaka, Hitomi and Mineshima, Koji}, title = {Assessing the Generalization Capacity of Pre-trained Language Models through Japanese Adversarial Natural Language Inference}, booktitle = {Proceedings of the 2021 EMNLP Workshop BlackboxNLP: Analyzing and Interpreting Neural Networks for NLP (BlackboxNLP2021)}, url = {https://aclanthology.org/2021.blackboxnlp-1.26/}, year = {2021}, }

二维码
社区交流群
二维码
科研交流群
商业服务