全部版块 我的主页
论坛 休闲区 十二区 休闲灌水
12579 17
2018-09-10

在Booking当数据科学家是怎样一种体验

1.jpeg


作者 Nishikant Dhanuka

编译  Mika

本文为 CDA 数据分析师原创作品,转载需授权


Nishikant是分享了自己在Booking从数据科学家新手到大师的发展历程。


# 求职


在迪拜做了3年咨询类工作之后,我作为一名数据科学家加入了Booking 。从咨询转行为数据科学家是我职业生涯中的重大转变,现在看来我很高兴当初做了这一选择。


在面试时,我就对Booking的感觉特别好。我有机会与数据科学家交谈,面试官的背景非常多样,其中一位拥有天文学的博士学位,另一位是自己创业公司的首席技术官。


同时Booking的伙食特别好,这也是我选择Booking的原因之一。


# 入职


我还记得入职的第一天,同事问我”你对你的屏幕还满意吗?”这让我很意外,因为我以前工作时只配备了一台笔记本电脑。Booking之后给我配备了一台Mac、两个大屏幕以及其他一些酷炫的设备。


入职后不久,我参与的第一个入职项目涉及到分析大量文本,我需要从中得出业务见解。以前我只有结构化数据方面的经验,因此我对这个新挑战感到兴奋。我希望提高自己文本数据的水平,但不久之后我就遇到困难了,那就是Booking庞大的数据规模。


Booking每24小时售出150万个房间,同时有数百万人访问网站,这意味着数据科学家所接触的数据规模相当大。还好公司有使用Spark进行分布式计算的内部培训。通过培训,如今我能够在多台机器上运行分析。


# 项目


我的第二个项目是为合作网站构建推荐引擎。以前我只做过标准回归和分类模型,这是我第一次接触到协同过滤和分解机。


由于数据规模,我不得不用PySpark进行稀疏分布矩阵。在编写代码之后,我们进行了A / B测试,看这样是否会对我们的业务带来积极影响。这也是我第一次接触A / B测试,但幸运的是公司配有完备的实验工具和基础设施,从而让这一过程并不困难。通过多次迭代,我们顺利处理了冷启动问题,并成功完成了该项目。


2.jpeg

Booking的数据科学家在Analytics Fair上展示项目


接下来是大量的项目,每个项目都有不同的挑战,作为一名数据科学家我需要不断地学习。例如,其中一个项目需要我将业务问题表示为加权网络图,并进行相关分析; 在另一个项目中,我需要从简单的数据分析中得出有价值的见解。


就这样过了两年半,我目前是Booking的高级数据科学家。现在我致力于研究人工智能产品的机器翻译,并通过部署神经网络和深度学习解决方案构建全面的生产系统。虽然机器翻译最近取得了一些突破性进展,但我们仍然采用

“商业优先 ”的方法为客户提供帮助。


# 团队构成


下面我打算介绍下Booking团队内数据科学家的组织方式。


我们采用“嵌入式”结构,其中数据科学家与业务紧密相连。例如,我参与的团队中有开发人员、数据科学家、产品负责人和其他专家。团队结合所有的力量,将相关概念实施到具体产品。在日常运营中,我们遵循一定的准则:每日会议、回顾、待办事项、团队目标、KPI和OKR(目标和关键结果)。再加上每两周一次的会议,能够让团队稳步发展,并尽快学习。


正是与业务的紧密联系,Booking的数据科学家都有很强的沟通能力和商业意识,同时还有很强的专业技能。这些都是我们在面试求职者时要测试的基本技能。


# 出色的数据科学家


Booking共有120 多名数据科学家,而且社区在日益壮大。每位数据科学家都有不同的背景和工作强项。


有些人是数据科学新手,有些人则有丰富的工作经验; 有些人是贝叶斯派,有些人是频率学派; 有些人喜欢用R语言,有些人更喜欢用Python; 有些人喜欢用Vowpal Wabbit,有些人则喜欢使用Spark和H2O进行分布式计算。


这种多样性可以让大家彼此学习和进步。我们每周都会举行相关的聚会和会谈,当中我们会谈论最新的行业动向和研究论文,并用于解决Booking的实际问题。此外,公司还会定期举办相关技术培训,包括A / B测试、Git、Hive、Python、R、Spark、H2O、TensorFlow等内容。


3.jpeg

Booking数据科学社区每周会谈


在我看来,在Booking工作最大的财富就是出色的数据科学社区,在当中我每天都能学习新事物,并且十分开心。


# 面对的挑战


同时我们也有面对一些挑战。


首先,由于我们的数据科学社区发展得非常快,这也为分享知识带来了难度。为了解决这个问题,我们尝试了很多方法,比如针对专业的话题(比如自然语言处理),黑客马拉松等方面展开讨论,从而更好地分享知识。


让数据科学家参与业务也有其不利之处。有时在日常工作中我们会错过同事的相关反馈。为了解决这个问题,我们鼓励大家分享各自的成果,并与同事一起讨论他们的最新项目。我们也为新员工提供导师计划。


尽管我们已多次为数据科学社区做出贡献,但我们也希望将成果分享给外部世界。我们目前正在制定一些指导方案。


4.jpeg

Booking的数据科学家们在船上聚会


最后我想说,在Booking当数据科学家非常愉快,而且从来不会缺少机遇与挑战。


原文链接

https://towardsdatascience.com/diary-of-a-data-scientist-at-booking-com-924734c71417



二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

全部回复
2018-9-10 10:36:02
挺好的推荐!谢谢楼主{:2_31:}
二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

2018-9-10 12:38:54
谢谢推荐  学习
二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

2018-9-10 15:28:40
谢谢推荐  ~学习~
二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

2018-9-10 16:20:40
支持一下!
二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

2018-9-10 16:37:35
支持一下!
二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

点击查看更多内容…
相关推荐
栏目导航
热门文章
推荐文章

说点什么

分享

扫码加好友,拉您进群
各岗位、行业、专业交流群