遇见数据集

dicta-il/dictalm2.0-quant-calib-dataset

收藏
Hugging Face2024-07-14 更新2024-07-22 收录
官方服务:

资源简介:

该数据集包含1024个文档,用于希伯来语-英语大语言模型(如DictaLM 2.0)的量化校准。其中512个文档为英文(来自FineWeb-EDU),另外512个文档为希伯来语(来自Wikipedia和OSCAR)。

The DictaLM 2.0 Quantization Calibration Dataset consists of 1024 documents for calibrating the quantization of Hebrew-English LLMs. It includes 512 English documents from FineWeb-EDU and 512 Hebrew documents from Wikipedia and OSCAR.

提供机构:
dicta-il
二维码
社区交流群
二维码
科研交流群
商业服务