Udemy Courses Dataset|在线教育数据集|数据分析数据集
收藏Udemy Courses Dataset Analysis Tasks
数据集概述
本数据集包含了对Udemy课程数据的深入分析任务,使用Python进行数据分析。数据涵盖了Udemy上提供的各种课程,旨在从数据中提取有价值的见解。
分析任务
1. 学科探索
- 探索并统计Udemy数据集中不同学科的课程。
2. 免费与付费课程区分
- 区分并分类免费和付费课程以进行分析。
3. 顶级销售课程识别
- 根据特定标准识别并排名顶级销售的课程。
4. 按标准筛选
- 实施筛选器以根据学科、价格范围或其他标准隔离课程。
5. 按年份识别课程
- 识别并列出数据集中特定年份发布的课程。
开始使用
- 克隆此仓库。
- 选择一个任务进行工作。
- 使用Python命令进行分析和提取见解。
- 通过提供您的发现或解决方案来贡献。

THCHS-30
“THCHS30是由清华大学语音与语言技术中心(CSLT)发布的开放式汉语语音数据库。原始录音是2002年在清华大学国家重点实验室的朱晓燕教授的指导下,由王东完成的。清华大学计算机科学系智能与系统,原名“TCMSD”,意思是“清华连续普通话语音数据库”,时隔13年出版,由王东博士发起,并得到了教授的支持。朱小燕。我们希望为语音识别领域的新研究人员提供一个玩具数据库。因此,该数据库对学术用户完全免费。整个软件包包含建立中文语音识别所需的全套语音和语言资源系统。”
OpenDataLab 收录
中国1km分辨率逐月降水量数据集(1901-2024)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2024.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
Awesome AIGC Image Detection
这是一个新的AIGC图像检测基准,包含六个数据集和十种检测方法。每个数据集都基于相应的代码运行,并提供了运行代码和环境以及结果日志。
github 收录
Photovoltaic power plant data
包括经纬度、电源板模型、NWP等信息。
github 收录
China Air Quality Historical Data
该数据集包含了中国多个城市的空气质量历史数据,涵盖了PM2.5、PM10、SO2、NO2、CO、O3等污染物浓度以及空气质量指数(AQI)等信息。数据按小时记录,提供了详细的空气质量监测数据。
www.cnemc.cn 收录
