TextCaps
收藏资源简介:
<p align="center" width="100%"> <img src="https://i.postimg.cc/g0QRgMVv/WX20240228-113337-2x.png" width="100%" height="80%"> </p> # Large-scale Multi-modality Models Evaluation Suite > Accelerating the development of large-scale multi-modality models (LMMs) with `lmms-eval` 🏠 [Homepage](https://lmms-lab.github.io/) | 📚 [Documentation](docs/README.md) | 🤗 [Huggingface Datasets](https://huggingface.co/lmms-lab) # This Dataset This is a formatted version of [TextCaps](https://textvqa.org/textcaps/). It is used in our `lmms-eval` pipeline to allow for one-click evaluations of large multi-modality models. ``` @inproceedings{sidorov2019textcaps, title={TextCaps: a Dataset for Image Captioningwith Reading Comprehension}, author={Sidorov, Oleksii and Hu, Ronghang and Rohrbach, Marcus and Singh, Amanpreet}, journal={European Conference on Computer Vision}, year={2020} } ```
<p align="center" width="100%"> <img src="https://i.postimg.cc/g0QRgMVv/WX20240228-113337-2x.png" width="100%" height="80%"> </p> # 大规模多模态模型评测套件 > 借助`lmms-eval`加速大规模多模态模型(Large-scale Multi-modality Models, LMMs)的研发 🏠 [主页](https://lmms-lab.github.io/) | 📚 [文档](docs/README.md) | 🤗 [Huggingface 数据集](https://huggingface.co/lmms-lab) # 本数据集 本数据集是[TextCaps](https://textvqa.org/textcaps/)的格式化版本,可集成至我们的`lmms-eval`评测流程中,实现大规模多模态模型的一键式评测。 @inproceedings{sidorov2019textcaps, title={TextCaps: 面向图像字幕生成与阅读理解的数据集}, author={Sidorov, Oleksii and Hu, Ronghang and Rohrbach, Marcus and Singh, Amanpreet}, journal={欧洲计算机视觉大会}, year={2020} }




