登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Textage Dataset
Textage Dataset
收藏
kaggle
2025-05-17 更新
2025-08-16 收录
语言年龄预测
LLM评估
数据链接:
https://www.kaggle.com/datasets/rushikeshhiray/textage-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Are LLM's good language age predictors ?
大语言模型是否是优秀的语言年龄预测指标?
应用场景:
创建时间:
2025-05-17
相关数据集
coseal/codal-bench
代码生成
LLM评估
CODAL-Bench是一个包含500个随机样本的基准测试,这些样本来自CodeUltraFeedback数据集。该基准测试包括多个封闭源大型语言模型(LLM)的响应,这些响应可以作为使用LLM-as-a-Judge评估其他LLM时的参考。涉及的LLM包括OpenAI的GPT-3.5-Turbo和GPT-4-Turbo,以及Anthropic的Claude-3-sonnet-20240229。此基
Hugging Face
2024-03-18 更新
18
0
mteb/llm-eval-news_classification
新闻分类
LLM评估
--- dataset_info: features: - name: text dtype: string - name: label dtype: class_label: names: '0': World '1': Sports '2': Business
Hugging Face
2026-03-08 更新
9
0
heihei/llm-psychometric-response-style
LLM评估
人格反应风格
--- license: cc-by-4.0 task_categories: - text-classification - tabular-classification language: - en tags: - llm-psychology - personality-assessment - response-style - psychometric -
Hugging Face
2026-04-01 更新
4
0
Nutanix/CPP-UNITTEST-BENCH
C++单元测试
LLM评估
该数据集包含了从GitHub上收集的C++代码片段及其对应的单元测试。它主要用于辅助自动化测试工具、代码质量分析以及用于测试生成的LLM模型的发展和评估。
Hugging Face
2024-11-24 更新
11
0
Khawn2u/Fixberry
字母计数任务
LLM评估
FixBerry是一个小型数据集,旨在训练模型正确计算单词中的字母数量。作者指出,即使是目前最好的大型语言模型(LLMs)在计算某些单词中的特定字母数量时也会失败,例如strawberry中的R数量。作者还提到,模型在处理某些单词时存在问题,如keeper和parallel,但在处理其他单词如pepper和peeper时却没有问题。作者怀疑这可能与分词(tokenization)有关,即模型可能每
Hugging Face
2024-10-13 更新
5
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广