遇见数据集

creativity

收藏
Opencsg2024-07-19 更新2025-05-03 收录
官方服务:

资源简介:

llm_creativity_benchmark旨在评估大型语言模型作为无审查创意写作助手的能力。它通过24个问题来考察模型的写作质量,问题分为安全/不安全以及故事/智能两类。该仓库提供了一系列模型推荐,并给出了在特定硬件上的推理速度。同时,它也提供了详细的模型测评结果,包括模型在写作风格、语法、信息 recall、审查规避等方面的表现。该仓库还详细介绍了测试方法,包括问题类型、提示方法、审查规避技巧和评分系统。

创建时间:
2024-07-19
二维码
社区交流群
二维码
科研交流群
商业服务