登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
韩文图片问答对数据
韩文图片问答对数据
收藏
杭州数据交易所
2026-03-26 更新
2026-06-18 收录
韩文视觉问答
多模态模型训练
数据链接:
https://mall.hzdex.cn/data-exchange/111500400191492?from=/data-exchange
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
用于多模态大模型训练,提升语义理解、时序推理、视频生成、跨模态融合、时空特征提取等能力。
应用场景:
提供机构:
数据堂(北京)科技股份有限公司
创建时间:
2025-12-30
搜集汇总
数据集介绍
背景与挑战
背景概述
该数据集包含5万组韩文图片问答对,涵盖单图表、多图表及文档形式图表三类,数据总量为5-10GB。主要用于多模态大模型训练,以提升语义理解、时序推理、视频生成、跨模态融合和时空特征提取等能力。
以上内容由遇见数据集搜集并总结生成
相关数据集
高质量中文期刊论文数据集
自然语言处理
学术研究
“高质量中文期刊论文数据集”,可以用于中文大模型的训练。1)帮助中文大模型学习到更丰富的、更先进的人类专业性知识以及某些特定领域的专业术语,从而更好的解答用户提出的专业问题。2)训练中文大模型的论文生成能力,从而应对各种不同领域的研究论文需求。根据用户的论文书写要求(例如用户只需提供主题、要点等),大模型自动生成符合用户要求的内容专业、逻辑性强、语意连贯的高质量论文。
北京市数据知识产权
2024-05-08 更新
29
0
SEACrowd/mammoth_vl_sea_shard_4
视觉语言
多模态模型训练
--- license: apache-2.0 dataset_info: features: - name: ids dtype: string - name: lang dtype: string - name: images dtype: image - name: messages list: - name
Hugging Face
2025-12-05 更新
14
0
240小时印度印地语语音数据_朗读(手机)
印地语语音识别
语音数据
印度印地语语音数据_朗读(手机),基于给定的脚本朗读并模拟录制,覆盖经济,娱乐,新闻,口语等多个领域,内容丰富。此数据集标注了文本内容、时间戳等多种属性,由401名来自不同地域和文化背景的印度人参与录制,口音正宗,录音涵盖安静和噪音的不同环境,更贴合语音识别实际应用场,文本经过人工校对,准确率高,为语音识别相关研究及应用提供了丰富的资源,经多家AI公司验证:有助于模型面对真实世界的多样性时能够表现
国家数据集管理服务平台
2026-04-28 更新
6
0
food-visual-instructions
多模态模型训练
食品领域
# Adapting Multimodal Large Language Models to Domains via Post-Training (EMNLP 2025) This repos contains the **food visual instructions for post-training MLLMs** in our paper: [On Domain-Specific P
魔搭社区
2026-05-28 更新
20
0
359小时印度尼西亚印尼语语音数据_朗读(手机)
印尼语语音识别
多领域朗读语音数据
印度尼西亚印尼语语音数据_朗读(手机),基于给定的脚本朗读并模拟录制,涵盖经济、娱乐、新闻、口语、数字、字母等多类别,内容丰富。此数据集标注了文本内容、时间戳、噪音等多种属性,由496名来自不同地域和文化背景的印尼本地人参与录制,口音正宗,文本经过人工校对,准确率高,为语音识别相关研究及应用提供了丰富的资源,经多家AI公司验证:有助于模型面对真实世界的多样性时能够表现出色。我们严格遵循数据保护法规
国家数据集管理服务平台
2026-04-28 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广