京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据创业的五点须知
大数据是当今最热门的科技词汇,同时也是最困难的创业项目。CSC对Infochimps的收购表明,那些无法顺利拿到第二轮融资的大数据创业公司面临着要么关张,要么被人收购的命运,例如Drawn to Scale、Ravel Data和Nodeable等,当然还有很多很多大家没有注意到的大数据创业公司。
Gigaom作者Derrick Harris近日就大数据创业公司的成长和融资问题撰文指出,大数据创业公司要想生存发展并赢得投资人的芳心必须注意一下几点:明智地选择你的战场和目标用户并围绕你的技术建立社区。大数据需要的不是啦啦队,而是实干家。Harris的观点可以归纳为五点,IT经理网摘译整理如下:
1.基础设施非常难
不仅开发基础设施技术产品很难,销售起来也很难,具体到大数据基础设施工具如Hadoop、NoSQL数据库和流处理系统则更是难上加难。客户需要大量培训和教育,付费用户需要大量支持和及时跟进的产品开发工作。
这意味着需要大量的资金支持,例如Greenplum在2010年获得1亿美元投资但仍然不足以完成所有工作,最终不得不选择卖给EMC。今天最出名的几家大数据创业公司融的钱更多,例如Cloudera。基础设施类的大数据创业公司通常需要数百万美元种子资金启动,但是A轮融资的道路异常艰辛。
新兴的大数据创业公司还必须与那些在客户那里已经有一些知名度甚至合作项目的公司竞争,例如Cloudera、Hortonworks、10gen、亚马逊AWS、IBM、Oracle等。
反观大数据应用创业则相对简单的多,无论面向垂直行业应用还是数据可视化这样的通用大数据应用都是如此。因为这些大数据应用的价值对于客户来说更为直观,距离业务也更近,进入企业IT系统的摩擦也更小。
2.云计算是朋友
无论你是销售大数据基础设施还是应用,云计算都是更有效的业务载体。选择云计算不仅仅是在云端托管,更重要的是通过云计算向客户提供服务。你将拥有更多控制权,同时在有限的资源上优化运行也会让你对产品的理解更加透彻。
云计算也降低了潜在用户试用产品的成本和门槛,从NewRelic到亚马逊AWS都从云计算+大数据模式中获益。
3.开发者是朋友
如果你主要从事大数据分析,例如ClearStory、Platfora或者CRM营销应用,数据分析师就是你的朋友。无论那种情况,最好的办法就是围绕以开发者和市场人员为主的目标受众进行开发和营销工作,CIO反而不是很好的目标受众!
专注CIO而非开发者往往会导致你在实际签约时碰到棘手问题。围绕开发者营销的战术被很多云计算创业公司和纯大数据软件公司所采用,例如Splunk和Tableau。
再比如Infochimps和Continuuity的产品类似(两者都被迫按落云头,迫降在用户数据中心),但Continuuity完全面向开发者,这意味着能积累更多技术粉丝。
4.将数据科学家推向前台中央
这既是市场也是销售策略,数据科学家才是能够展示数据和平台威力的人,他们也是会议上最受欢迎的演讲者。
但大数据科学家也需要慎重选择传播内容。如今大家都接受了Hadoop和NoSQL,所以没必要每次开会言必称4V之类的科普。至于如何配置和集成大数据系统也只能吸引小部分听众,除非你的项目规模超大。
Cloudera比竞争对手出名的原因有很多,但其中Jeff hammerbacher绝对是一位举足轻重的人物。不要空谈大数据大数据的价值和架构,站在听众的立场说说具体能做哪些分析,如何做。
5.开源有多重要,取决于你自己
几乎所有的大数据公司都依赖开源软件,有些是“借”来的,如Hadoop、Storm以及各种数据库,有些是自行开发的,有些则是混合模式,例如在HBase上增加的一些功能应用。这些开源项目如此流行是因为社区的力量。
开源绝不是看起来那么轻松,不是说你在Github上放点代码就谈得上回馈社区了。开源的目的是将使用相同代码的人聚拢成社区,并不断改进代码。这里与第三点中我们提到的吸引开发者有关。只有更多的用户和开发者对你产生兴趣了,在你的产品上花时间和精力了,才有可能最终掏钱。
不计其数的创业公司都将代码开源了,但那些真正能推动项目并建设社区的公司才能脱颖而出。例如Neo Technology的Neo4j、Concurrent的Casading以及10gen的MongoDB。甚至Twitter这样面向大众的公司都开源了Storm和Mesos等项目。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-10在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-10在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08在数据分析全流程中,数据质量是决定分析结论可靠性的核心前提,而异常值作为数据集中的“异类”,往往会干扰统计检验、模型训练 ...
2026-04-08在数字经济飞速发展的今天,数据已渗透到各行各业的核心场景,成为解读趋势、优化决策、创造价值的核心载体。而数据分析,作为挖 ...
2026-04-08在数据分析全流程中,数据处理是基础,图形可视化是核心呈现手段——前者负责将杂乱无章的原始数据转化为干净、规范、可分析的格 ...
2026-04-07在数据分析与统计推断中,p值是衡量假设检验结果显著性的核心指标,其本质是在原假设(通常为“无效应”“无差异”)成立的前提 ...
2026-04-07在数字经济深度渗透的今天,数据已成为企业生存发展的核心资产,企业的竞争本质已转变为数据利用能力的竞争。然而,大量来自生产 ...
2026-04-07Python凭借简洁的语法、丰富的生态库,成为算法开发、数据处理、机器学习等领域的首选语言。但受限于动态类型、解释性执行的特性 ...
2026-04-03在深度学习神经网络中,卷积操作是实现数据特征提取的核心引擎,更是让模型“看懂”数据、“解读”数据的关键所在。不同于传统机 ...
2026-04-03当数字化转型从企业的“战略口号”落地为“生存之战”,越来越多的企业意识到,转型的核心并非技术的堆砌,而是数据价值的深度挖 ...
2026-04-03在日常办公数据分析中,数据透视表凭借高效的汇总、分组功能,成为Excel、WPS等办公软件中最常用的数据分析工具之一。其中,“计 ...
2026-04-02在数字化交互的全场景中,用户的每一次操作都在生成动态的行为轨迹——电商用户的“浏览商品→点击详情→加入购物车”,内容APP ...
2026-04-02在数字化转型深度推进的今天,企业数据已成为驱动业务增长、构建核心竞争力的战略资产,而数据安全则是守护这份资产的“生命线” ...
2026-04-02在数据驱动决策的浪潮中,数据挖掘与数据分析是两个高频出现且极易被混淆的概念。有人将二者等同看待,认为“做数据分析就是做数 ...
2026-04-01