全部版块 我的主页
论坛 数据科学与人工智能 数据分析与数据科学 数据分析师(CDA)专版
2917 1
2016-12-17
人才需求量非常大——数据分析师所需的技能和素质

仅仅在几年前,数据分析师还不是一个正式确定的职业,然而一眨眼的工夫,这个职业就已经被誉为“今后10年IT行业最重要的人才”了。

Google首席经济学家、加州大学伯克利分校教授哈尔·范里安(HalVarian,1947—)先生,在2008年10月与麦肯锡总监JamesManyika先生的对话中,曾经讲过下面一段话:“我总是说,在未来10年里,最有意思的工作将是统计学家。人们都认为我在开玩笑。但是,过去谁能想到电脑工程师会成为20世纪90年代最有趣的工作?在未来10年里,获取数据——以便能理解它、处理它、从中提取价值、使其形象化、传送它——的能力将成为一种极其重要的技能,不仅在专业层面上是这样,而且在教育层面(包括对中小学生、高中生和大学生的教育)也是如此。由于如今我们已真正拥有实质上免费的和无所不在的数据,因此,与此互补的稀缺要素是理解这些数据并从中提取价值的能力。”

范里安教授在当初的对话中使用的是statisticians(统计学家)一词,虽然当时他没有使用数据分析师这个词,但这里所指的,正是现在我们所讨论的数据分析师。

数据分析师家所需的技能

数据分析师这一职业并没有固定的定义,但大体上指的是这样的人才:

“所谓数据分析师,是指运用统计分析、机器学习、分布式处理等技术,从大量数据中提取出对业务有意义的信息,以易懂的形式传达给决策者,并创造出新的数据运用服务的人才。”

数据分析师所需的技能如下。

(1)计算机科学

一般来说,数据分析师大多要求具备编程、计算机科学相关的专业背景。简单来说,就是对处理大数据所必需的Hadoop、Mahout等大规模并行处理技术与机器学习相关的技能。

(2)数学、统计、数据挖掘等

除了数学、统计方面的素养之外,还需要具备使用SPSS、SAS等主流统计分析软件的技能。其中,面向统计分析的开源编程语言及其运行环境R最近备受瞩目。R的强项不仅在于其包含了丰富的统计分析库,而且具备将结果进行可视化的高品质图表生成功能,并可以通过简单的命令来运行。此外,它还具备称为CRAN(TheComprehensiveRArchiveNetwork)的包扩展机制,通过导入扩展包就可以使用标准状态下所不支持的函数和数据集。

(3)数据可视化(Visualization)

信息的质量很大程度上依赖于其表达方式。对数字罗列所组成的数据中所包含的意义进行分析,开发Web原型,使用外部API将图表、地图、Dashboard等其他服务统一起来,从而使分析结果可视化,这是对于数据分析师来说十分重要的技能之一。

将数据与设计相结合,让晦涩难懂的信息以易懂的形式进行图形化展现的信息图(Infographics)最近正受到越来越多的关注,这也是数据可视化的手法之一。

作为参考,下面节选了Facebook和Twitter的数据分析师招聘启事。对于现实中的企业需要怎样的技能,这则启事应该可以为大家提供一些更实际的体会。

Facebook招聘数据分析师

Facebook计划为数据科学团队招聘数据分析师。应聘该岗位的人,将担任软件工程师、量化研究员的工作。理想的候选人应对在线社交网络的研究有浓厚兴趣,能够找出创造最佳产品过程中所遇到的课题,并对解决这些课题拥有热情。

职务内容

  • 确定重要的产品课题,并与产品工程团队密切合作寻求解决方案
  • 通过对数据运用合适的统计技术来解决课题
  • 将结论传达给产品经理和工程师
  • 推进新数据的收集以及对现有数据源的改良
  • 对产品的实验结果进行分析和解读
  • 找到测量、实验的最佳实践方法,传达给产品工程团队

必要条件

  • 相关技术领域的硕士或博士学位,或者具备4年以上相关工作经验
  • 对使用定量手段解决分析性课题拥有丰富的经验
  • 能够轻松操作和分析来自各方的、复杂且大量的多维数据
  • 对实证性研究以及解决数据相关的难题拥有极大的热情
  • 能对各种精度级别的结果采用灵活的分析手段
  • 具备以实际、准确且可行的方法传达复杂定量分析的能力
  • 至少熟练掌握一种脚本语言,如Python、PHP等精通关系型数据库和SQL
  • 对R、MATLAB、SAS等分析工具具备专业知识
  • 具备处理大量数据集的经验,以及使用MapReduce、Hadoop、Hive等分布式计算工具的经验

来源:Facebook

Twitter招聘数据分析师(负责增加用户数量)

关于业务内容

Twitter计划招聘能够为增加Twitter用户数提供信息和方向、具备行动力和高超技能的人才。应聘者需要具备统计和建模方面的专业背景,以及大规模数据集处理方面的丰富经验。

我们期待应聘者所具有的判断力能够在多个层面上决定Twitter产品群的方向。

职责

  • 使用Hadoop、Pig编写MapReduce格式的数据分析
  • 能够针对临时数据挖掘流程和标准数据挖掘流程编写复杂的SQL查询
  • 能够使用SQL、Pig、脚本语言、统计软件包编写代码
  • 以口头及书面形式对分析结果进行总结并做出报告
  • 每天对数TB规模、10亿条以上事务级别的大规模结构化及非结构化数据进行处理

必要条件

  • 计算机科学、数学、统计学的硕士学位或者同等的经验
  • 2年以上数据分析经验
  • 大规模数据集及Hadoop等MapReduce架构方面的经验
  • 脚本语言及正则表达式等方面的经验
  • 对离散数学、统计、概率方面感兴趣
  • 将业务需求映射到工程系统方面的经验

来源:Twitter

数据分析师所需的素质

(1)沟通能力

即便从大数据中得到了有用的信息,但如果无法将其在业务上实现的话,其价值就会大打折扣。为此,面对缺乏数据分析知识的业务部门员工以及经营管理层,将数据分析的结果有效传达给他们的能力是非常重要的。

(2)创业精神(entrepreneuership)

以世界上尚不存在的数据为中心创造新型服务的创业精神,也是数据分析师所必需的一个重要素质。Google、Amazon、Facebook等通过数据催生出新型服务的企业,都是通过对庞大的数据到底能创造出怎样的服务进行艰苦的探索才获得成功的。

(3)好奇心

庞大的数据背后到底隐藏着什么,要找出答案需要很强的好奇心。除此之外,成功的数据分析师都有一个共同点,即并非局限于艺术、技术、医疗、自然科学等特定领域,而是对各个领域都拥有旺盛的好奇心。通过对不同领域数据的整合和分析,就有可能发现以前从未发现过的有价值的观点。

美国的数据分析师大多拥有丰富的从业经历,如实验物理学家、计算机化学家、海洋学家,甚至是神经外科医生等。也许有人认为这是人才流动性高的美国所特有的现象,但其实正如我们在第4章中所介绍的GREE一样,在日本也出现了一些积极招募不同职业背景人才的企业,这样的局面距离我们已经不再遥远。


二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

全部回复
2016-12-18 15:41:32
表面来讲,是由存储量级十分大,超出我们一般的数据处理能力。深入来看,大数据是整个人类走向彻底智能化的先驱概念。试想一下这样的场景,某天早上你被门铃吵醒,打开门一看是一枚帅的发炎的快递小哥,他温文尔雅,梨涡浅笑,完全是你幻想的类型,紧接着他说:尊敬的楼主,您好,我是XXX公司的,我们经过XXX分析(一种不会让你觉得隐私被侵犯的手段)得知您会在今日早上8点08分08秒这一时刻,体内的购物欲值超过Y%,而且您在未来的C小时D分Z秒内可能会需要一个这样的产品。说罢拿出你确实十分感兴趣的东西,这时你高兴的pay给了他。科技以人为本,我相信大数据绝对不会一直停留在炒概念的阶段,大数据的未来肯定可以改变人类生存模式,只不过目前由于技术水平的限制,大家都只是在外围占坑而已。目前来看,科技巨头谷歌在大数据方面至少领先世界十年。总而言之,大数据就是一个看的见的大金矿,想要淘金,自己就去制造铲子呗。
二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

相关推荐
栏目导航
热门文章
推荐文章

说点什么

分享

扫码加好友,拉您进群
各岗位、行业、专业交流群