京公网安备 11010802034615号
经营许可证编号:京B2-20210330
没有这些,“大数据”怎敢称“大”
大数据,无所不在。一个流行词出现之后,很少有人究其深意。可能很多人听过大数据,却不见得理解其为何物。
概念上来说,度娘定义:
大数据(big data),指无法在一定时间范围内用常规软件工具进行捕捉、管理和处理的数据集合,是需要新处理模式才能具有更强的决策力、洞察发现力和流程优化能力的海量、高增长率和多样化的信息资产。
听起来比较抽象,简单来说,大数据有两者,一个是大数据的源公司,还有一个是大数据的处理公司。IT企业如果拥有大量用户,可能既是数据源,也是处理公司,但有些创新类企业可能是有处理能力,但并没有数据源,要向传统企业买数据源。
客官还可以随着富二根据五大特点来记忆。IBM提出,大数据有以下5V特点:
Volume(大量)
Velocity(高速)
Variety(多样)
Value(低价值密度)
Veracity(真实性)
和富二一样,客官很容易在脑海中浮现一些企业名,如IBM、亚马逊、甲骨文、谷歌、微软等老牌互联网企业。大数据公司,他可能来源于互联网科技企业的相关部门、或是被互联网/移动互联网企业收购的创新公司。
反观国内,拥有大数据能力的也有很多。BAT(百度、阿里巴巴、腾讯)、华为、中兴等老牌科技企业。
而作为金融企业,首先想到的是大数据应用于量化投资领域。目前最直接的做法是“拿来主义”——直接和拥有大数据的公司合作,将两者的成果合作应用到量化模型中,进行跨界合作。
富二简单数数,和富二家已经合作的大数据合作伙伴有:
蚂蚁金服X 富国基金=富国中证娱乐、富国中证医药
富国基金和蚂蚁金服签订协议,引入阿里大数据构造的行业景气因子,增强了“成长因子”,富国基金通过量化增强技术,在有效跟踪标的指数的同时力求超越指数表现。
客官在淘宝花的每一分钱,在阿里大数据都鲜明刻画,翻翻你的2016年支付宝账单,看你的花费主要在哪些方向!而阿里大数据,则被富国量化增强团队开发为指数增强因子,用在富国中证娱乐(161036)、富国中证医药(161035)等主题指数基金。
富国中证医药主题指数增强(161037)以中证医药主题指数为跟踪标的,该指数由165只成份股组成;通过首次引入来自阿里旗下“蚂蚁金服”的消费类统计型趋势特征数据,得到医药细分行业投研指标,再综合考察细分行业的景气度、基于个股在各个细分行业的暴露程度进行加权,得到阿里大数据因子。
海关数据X富国基金=富国高端制造
富国中证高端制造主题指数增强(161037)以中证高端制造主题指数为跟踪标的;通过首次引入国家权威机构发布和海关信息网提供的进出口贸易统计数据,得到进出口贸易大数据因子(注:进出口贸易统计数据仅是高端制造相关行业);
海关可以看作是一家数据源,而富二家量化部门是大数据处理部门,对大数据进行清洗,得到贸易竞争力、贸易结构等细分投研指标;
根据所得细分投研指标,综合考察行业竞争力水平和出口贸易景气度,得到进出口贸易行业景气因子得分和进出口贸易景气因子得分;
最后基于每个股票的行业分类,将上述两个因子得分以相关比例进行加权,得到进出口贸易大数据因子得分,应用至产品;
除了上述提到的企业,富二卖个小关子~ 目前,正有多家大数据公司和富二家洽谈合作,将大数据的相关信息应用到富二家相关产品之上~ 想知道是什么?不剧透、不明说,富二将在合适的时候一并为客官发布~
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据分析、业务监控、运营复盘等场景中,列值趋势计算是核心需求之一。无论是分析销售额的月度增长、用户活跃的变化趋势、库存 ...
2026-06-12在数字经济深度渗透的当下,消费者的购买行为已从过去的 “被动接受” 转变为 “主动决策”。流量红利消退、获客成本攀升、用户 ...
2026-06-12CDA三级认证是三个级别中的塔尖,全面考察数据战略、团队领导和复杂项目的综合能力。它所对应的《敏捷数据挖掘》教材,不再局限 ...
2026-06-12在游戏产业的商业逻辑中,付费玩家是支撑游戏生存与发展的核心支柱。行业普遍遵循 “二八定律”:20% 的付费玩家贡献了游戏 80% ...
2026-06-11【核心关键词】企业、定位、传统、产品、互联网、可视化、业务侧、数字化、结构化、数据分析、传统制造业、市场状态、发展空间 ...
2026-06-11 解读《CDA二级教材:量化策略分析(2025)》的全景结构与学习逻辑 ” CDA二级认证是企业招聘数据分析师时最常提及的证书门槛 ...
2026-06-11【核心关键词】药企、可视化、营销、分类、数据分析师、销售数据、业务人员、指导方向、分析报告、营销数据、营销医生 【专访摘 ...
2026-06-10在统计学分析、问卷调研、实验验证、业务复盘等场景中,卡方检验与 T 检验是应用最广泛的两类基础假设检验方法。前者专门处理分 ...
2026-06-10 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-06-10在MySQL数据库日常查询、数据统计、后台接口开发、数据导出等场景中,开发者经常需要查询数据表除某几列之外的所有字段。例如查 ...
2026-06-09在Python网络请求、爬虫开发、接口测试、数据抓取等实操场景中,requests库是最常用的第三方请求工具,而content属性是requests ...
2026-06-09 数据分析正在重塑每一个行业。CDA认证的三本官方教材,分别对应Level I、Level II、Level III,为你铺就从业务数据分析到数 ...
2026-06-09在数字财务、智慧财税、业财融合深度推进的当下,传统财务模式下数据标准混乱、业务流程碎片化、知识无法沉淀、系统互通性差等问 ...
2026-06-08随着数字经济深度渗透各行各业,数据正式成为继土地、劳动力、资本、技术之后的第五大生产要素,是企业数字化转型、精细化运营、 ...
2026-06-08 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-06-08【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-06-05任何一款产品从诞生、普及到最终退出市场,都会遵循一套固定的发展规律,这就是产品生命周期理论。在市场竞争日益激烈、产品迭代 ...
2026-06-04在Excel数据分析、办公统计、业务报表制作场景中,数据透视表是数据汇总、分类统计、快速复盘的核心工具,能够高效完成海量原始 ...
2026-06-04