five

汇总用材料-未公示-2021年门头沟区城管执法局双随机工作开展情况1-12月|城管执法数据集|双随机工作数据集

收藏
北京市公共数据开放平台2024-03-01 收录
城管执法
双随机工作
下载链接:
http://data.beijing.gov.cn/zyml/qjsw/mtgq/c8b55d484ad247c1a47654e9e89f3cd0.htm
下载链接
链接失效反馈
资源简介:
该数据是门头沟区提供的汇总用材料-未公示-2021年门头沟区城管执法局双随机工作开展情况1-12月信息,包括年度双随机工作开展情况等字段信息。
提供机构:
门头沟区
用户留言
有没有相关的论文或文献参考?
这个数据集是基于什么背景创建的?
数据集的作者是谁?
能帮我联系到这个数据集的作者吗?
这个数据集如何下载?
点击留言
数据主题
具身智能
数据集  4099个
机构  8个
大模型
数据集  439个
机构  10个
无人机
数据集  37个
机构  6个
指令微调
数据集  36个
机构  6个
蛋白质结构
数据集  50个
机构  8个
空间智能
数据集  21个
机构  5个
5,000+
优质数据集
54 个
任务类型
进入经典数据集
热门数据集

XS-Video

XS-Video数据集是由中国科学院自动化研究所MAIS实验室提出的一个大规模现实世界短视频传播数据集。该数据集收集了来自中国五大平台(抖音、快手、西瓜视频、今日头条、哔哩哔哩)的117720个短视频,包含381926个样本和535个话题,覆盖了从发布后的互动信息,如观看、点赞、分享、收藏、粉丝和评论等。数据集通过跨平台指标对齐方法,对视频的长期传播影响力进行评分,分为0到9级,旨在为短视频传播研究提供全面的互动信息和内容特征。

arXiv 收录

MNIST数据集

‌数据规模‌ ‌训练集‌:60,000 张手写数字图像(28×28 像素灰度图)及对应标签 34。 ‌测试集‌:10,000 张图像与标签,用于模型评估 68。 ‌数据来源‌ 由美国国家标准与技术研究院(NIST)收集,50% 样本来自高中生手写,50% 来自人口普查局工作人员 48。 经 Yann LeCun 团队标准化处理,成为机器学习基准数据集 1011。

阿里云天池 收录

Hospital Deterioration Dataset

这是一个高保真模拟医院队列数据集,包含10,000个模拟医院入院记录,每个记录跟踪最多72小时。数据集提供每小时的生命体征(心率、血压、呼吸频率等)和实验室数值(白细胞计数、乳酸、肌酐等),以及患者人口统计学信息和多种恶化结果标签。专门设计用于构建和基准测试早期预警系统和临床恶化风险模型的机器学习应用。

github 收录

威斯康星乳腺癌数据分析及自动诊断

数据集bc_data.csv:来自威斯康星乳腺癌数据库(Wisconsin Breast Cancer Database),主要记录了569个病例的32个属性。

阿里云天池 收录

Traditional-Chinese-Medicine-Dataset-SFT

该数据集是一个高质量的中医数据集,主要由非网络来源的内部数据构成,包含约1GB的中医各个领域临床案例、名家典籍、医学百科、名词解释等优质内容。数据集99%为简体中文内容,质量优异,信息密度可观。数据集适用于预训练或继续预训练用途,未来将继续发布针对SFT/IFT的多轮对话和问答数据集。数据集可以独立使用,但建议先使用配套的预训练数据集对模型进行继续预训练后,再使用该数据集进行进一步的指令微调。数据集还包含一定比例的中文常识、中文多轮对话数据以及古文/文言文<->现代文翻译数据,以避免灾难性遗忘并加强模型表现。

huggingface 收录