京公网安备 11010802034615号
经营许可证编号:京B2-20210330
2020年3月,我接到一个电话,通知我将休假,直到另行通知--非正式地意味着我将得到学习的报酬。我知道我在休假期结束后被解雇的可能性很高,因为我没有积极工作的项目。
尽管我在工作中没有做太多关于数据的工作,但一想到不能做任何关于数据的有意义的工作,我就很困扰。尽管如此,我觉得我对下一步可能做什么的选择有限,因为我在工作中没有太多的实际经验。不要误解我,我一直在实习,但在我的时间里,我没有做任何事情来显著(甚至轻微)改善业务(至少在我看来是这样)。我处于一个非常低的位置,缺乏自信,怀疑自己的技能……对我来说,休假不能早点到来。
我做出的第一个具有变革性的决定是致力于成为一名面向未来的、不可抗拒的数据科学家。
当你承诺做某事时,一种来自内心的力量驱使着你。我每天醒来都在想我今天一定比昨天更好,这就是我的动力。然而,在这篇文章中,我将分享我在休假期间做的三件事,以确保我更接近我的目标。
当我解释机器学习中的理论概念时,我很舒服,但我不满意。
每当我在Kaggle上查看人们使用的解决方案时,我总是看到某种形式的提升、套袋或深度学习。提升和装袋,我有很好的理解,但深度学习对我来说是一个禁区。当我意识到这一点时,我决定报名参加Coursera的深度学习专业。
深度学习
从deeplearning.ai中学习深度学习。如果你想闯入人工智能(AI),这种专业化...
在本课程中,我学习了许多基本的深度学习架构和技术,以改进深度学习模型。
我在编程方面已经相当不错了,但每当我听到关于人们如何在这个领域建立职业生涯的播客时,有一件事总是让我感到突出。
推倒重来好获得深刻的理解!
我从来没有从头开始编写机器学习算法,这让我怀疑我是否真的知道发生了什么。
因此,我向自己提出了一个挑战,从头开始编写许多最流行的机器学习算法--对于那些长期关注我的帖子的人来说,你应该知道这是从头开始的算法系列。
算法从头开始-迈向数据科学
阅读《走向数据科学》中关于从头开始算法的写作。共享概念、想法和...的媒体出版物
此外,我认为提高我对关键数据科学框架的技能是很重要的,比如NumPy和Pandas,因此我还创建了Pytrix系列。
Pytrix系列-迈向数据科学
阅读《走向数据科学》中关于Pytrix系列的文章。共享概念、想法和代码的媒体出版物。
我决定把发帖的频率从每周一次增加到每周3次。这个变化迫使我做了两件重要的事情,我认为这对我的成长至关重要:
作为一名数据科学家,不断学习是必不可少的。我们都知道技术发展的有多快,所以要保持敏锐,我们必须磨利我们的斧头。然而,当你学习一个新的话题,意图将这些信息反哺给其他人时,尽管我没有做过这方面的研究,但我发现我以不同的方式吸收信息--我对我正在学习的东西进行更深入的思考,并试图在脑海中想象出来,这一切都有助于使学习成为一个无缝的过程。
最好的数据科学家并不是最聪明的。
软技能在大多数MOOCs都不教,你必须自己出去学习。
成为一名数据科学家的要求,例如知道如何编程、统计学、线性代数、微积分和其他关键的数据概念,往往会让有抱负的数据科学家消耗太多,以至于很容易忘记作为一名数据科学家最重要的部分……能够理解业务想要实现什么,然后使用数据来增加价值。
换句话说,一个好的数据科学家知道很多技术概念,但他们与伟大的数据科学家的区别在于,他们有能力接受一个技术概念,然后简化它,并以一种包容团队所有成员的方式交流它,而不管他们的技术水平如何。
“如果你不能简单地解释它,你就不够了解它”
在我个人看来,每一个数据科学家都是一个个人品牌。维基百科对Entrepreneurship的定义是价值的创造或提取-有效地说,这是作为一名数据科学家的本质。
人们通常只有当他们认为是时候让他们成为一个数据科学的角色时才开始联网,我认为这完全是胡说八道。
在你需要之前建立你的关系网。
在过去的8个月里,构建数据科学网络帮助我改进了5种方法:
协助
有些人在生活中走在你前面,我个人相信宇宙允许我们与这些人相遇,这样他们就可以引导你。让我们面对现实吧,在你的数据科学职业生涯中,你需要寻求帮助!
市场营销
一个强大的网络是一个伟大的试验场的想法。我在我的LinkedIn上进行了多次民意调查,这为我提供了即时反馈。此外,您还可以获得个人推荐。就目前情况来看,我从来没有申请过工作,因为我一直知道口碑的力量,我已经在许多领域利用它为我的优势--无论哪个领域。
向别人学习
你不可能知道数据科学中的所有东西(或者一般的生活),拥有不同的人脉会让你接触到新的东西。经验并不重要,如果你有一个良好的网络,你会学到一些新的东西。
交朋友
如果你问那些在我身边长大的人人工智能是什么,他们可能会用《黑镜》中的一些东西来回答。在这个领域没有朋友可能会很孤独,因为有时你会感到疲倦、没有动力,而你的非数据科学朋友可能无法理解你。与其他数据科学家建立联系会让你意识到你不是世界上唯一一个面临某种挑战的人,当我感到沮丧时,它肯定会让我重新振作起来。
人们知道您必须提供什么
把任何关系粘在一起的胶水都附着在每个人带到桌子上的东西的两边,就是这样。如果人们知道你是做什么的,把你介绍给别人就容易多了--这就是我在8月份获得自由职业的原因。
值得注意的一件关键事情是,我已经在这个领域有了很多接触,这是让我像现在这样进步的原因;我想说,我所做的改变我职业生涯轨迹的最重要的事情是承诺。承诺是一个长期的决定,每天提高自己只有在你的手中。对你的职业生涯负责,是发展你自己的开始。虽然我离我想要的数据科学职业生涯还很远,但我比昨天更近了,比8个月前更近了。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在大数据时代背景下,海量行业数据亟需通过专业化工具挖掘潜在价值,辅助企业业务决策、优化运营模式、规避经营风险。Python凭借 ...
2026-08-28SQL是数据分析领域最基础、最核心的工具,承担着取数、清洗、统计、分层、归因的全流程工作。不同于单纯的语法练习,实战化SQL数 ...
2026-08-28 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-08-28随着新零售模式的快速普及,零售行业从传统的“货品驱动”全面转向“用户驱动”。门店交易数据、线上消费记录、浏览轨迹、复购频 ...
2026-08-27在数据分析、爬虫采集、接口开发、数据归档等场景中,JSON与CSV是两种使用率最高的数据存储格式。JSON为键值对结构化格式,适配 ...
2026-08-27 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-08-27在数据分析工作中,时间序列是最常见的数据类型之一,订单时间、日志时间、交易时段、统计周期等数据均离不开时间处理。原始数据 ...
2026-08-26在数据分析与数据预处理工作中,原始数据普遍存在录入错误、系统故障、偶然极值等问题,极易产生异常数据。异常数据会严重干扰数 ...
2026-08-26 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-08-26在数理统计与数据分析领域,多因素方差分析与线性回归模型是研究变量关系、因素影响、数据差异规律的两大核心工具。二者均属于经 ...
2026-08-25数据分析的核心价值不在于数据计算与图表制作,而在于清晰、精准、有逻辑地输出结论、支撑业务决策。日常数据分析报告普遍存在结 ...
2026-08-25 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-08-25平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-08-24 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-08-21在数据分析与数据可视化工作中,直方图是展示数据分布特征、离散程度、集中区间的核心图表,能够直观呈现数值数据的频次分布规律 ...
2026-08-20在数据分析领域有一句核心准则:垃圾数据进,垃圾数据出。数据清洗是数据分析、数据建模、数据可视化之前的必经前置工序,也是保 ...
2026-08-20 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-08-20在Python数据分析与数据清洗工作中,Pandas是最核心的数据处理库,DataFrame是结构化数据的标准存储格式。在实时数据采集、循环 ...
2026-08-19