摘要: 目前阿里云大数据产品已经免费向全部用户开放了多种公用数据集.开放的数据类别包括:股票价格数据,房产信息,影视及其票房数据.
http://click.aliyun.com/m/40813/
目前阿里云 MaxCompute 大数据产品已经免费向全部用户开放了多种公用数据集.在此之前,获取,分析,下载自定义的大型分析数据集需要数小时乃至数天才能完成.
而现在阿里云的任何用户都可以通过基于大数据计算服务 MaxCompute 的数据工场 DataWorks 快速,便捷的分析这些公用数据集.
开通 MaxCompute & 数据工场的教程参考: https://help.aliyun.com/document_detail/27803.html
我们将股票价格,房产,影视等多种类型的数据免费开放给用户,使得大家免去了复杂的数据获取,上传,清洗等过程,可以直接进入数据分析阶段,通过这种数据开放形式,我们希望能以更快的速度实现更多的创新.
大家也可以通过数加体验馆( https://data.aliyun.com/experience )来使用这些数据,近距离的感受阿里云数加(大数据)产品;
目前我们开放的数据类别包括:股票价格数据,房产信息,影视及其票房数据.所有的数据均被存储在 MaxCompute 产品中的 public_data 项目中.以下,我们将对这些数据做更为详细的介绍,并简要说明如何通过 MaxCompute 及数据工场服务并分析这些数据.
获取权限
首选,需要用户以项目空间的 owner 或者管理员的身份,在自己的项目空间下,执行如下操作.执行完成后用户项目空间下的所有成员均可读取各公开数据集合:
add user ALIYUN$everyone;
执行该语句后即可执行查询:
特殊说明
公开数据集合对所有 MaxCompute 用户开放,这是通过 MaxCompute 特殊的授权机制实现的.在使用过程中,用户需要足以一下几点:
1. 所有数据均存储在一个名为 public_data 的项目空间中,但所有用户并未被加入到该空间下 (非项目空间成员).因此,用户需要跨项目空间访问数据,在数据工场中编辑 SQL 时,必须在表明前指定项目名称,例如:
Select * from public_data.ods_enterprise_share_basic where ds = '20170114';
由于是跨项目空间访问,所有用户在数据工场的 [数据管理] 中无法查找到公开数据集的表;
只有在执行 "Add User" 语句后,用户才有权限访问公开数据集.该语句可以再数据工场以及 MaxCompte 提供的客户端中执行;
下面我们将详细介绍目前开放的数据集合.
股票价格数据集
总体信息:每日更新 A 股股票相关数据.
ods_enterprise_share_basic 股票基本信息
数据样例:
ods_enterprise_share_quarter_cashflow 季度报表说明
数据样例:
ods_enterprise_share_quarter_growth 季度业务增长情况
数据样例:
ods_enterprise_share_quarter_operation 季度财务周转
数据样例:
ods_enterprise_share_quarter_profit 季度利润
数据样例:
ods_enterprise_share_quarter_report 季度报表
数据样例:
ods_enterprise_share_trade_h 股票价格
数据样例:
二手房产数据集
总体信息:二手房相关信息(注意:目前暂停更新).
dwd_prouduct_house_basic_info_out 信息说明
数据样例:
影视及票房数据集
总体信息:每日更新国内影视剧信息及票房数据信息 .
dwd_ product_ movie_ basic_ info
ods_product_movie_box 票房基本信息
数据样例:
基于公开数据集的实战
手把手,教你用 MaxCompute+OpenSearch 搭建分布式搜索引擎
购买 & 试用 MaxCompute,请加入扫码进钉钉群.公开数据集问题,请加入扫码进钉钉群.
来源: http://geek.csdn.net/news/detail/252602