
没有这些,“大数据”怎敢称“大”
大数据,无所不在。一个流行词出现之后,很少有人究其深意。可能很多人听过大数据,却不见得理解其为何物。
概念上来说,度娘定义:
大数据(big data),指无法在一定时间范围内用常规软件工具进行捕捉、管理和处理的数据集合,是需要新处理模式才能具有更强的决策力、洞察发现力和流程优化能力的海量、高增长率和多样化的信息资产。
听起来比较抽象,简单来说,大数据有两者,一个是大数据的源公司,还有一个是大数据的处理公司。IT企业如果拥有大量用户,可能既是数据源,也是处理公司,但有些创新类企业可能是有处理能力,但并没有数据源,要向传统企业买数据源。
客官还可以随着富二根据五大特点来记忆。IBM提出,大数据有以下5V特点:
Volume(大量)
Velocity(高速)
Variety(多样)
Value(低价值密度)
Veracity(真实性)
和富二一样,客官很容易在脑海中浮现一些企业名,如IBM、亚马逊、甲骨文、谷歌、微软等老牌互联网企业。大数据公司,他可能来源于互联网科技企业的相关部门、或是被互联网/移动互联网企业收购的创新公司。
反观国内,拥有大数据能力的也有很多。BAT(百度、阿里巴巴、腾讯)、华为、中兴等老牌科技企业。
而作为金融企业,首先想到的是大数据应用于量化投资领域。目前最直接的做法是“拿来主义”——直接和拥有大数据的公司合作,将两者的成果合作应用到量化模型中,进行跨界合作。
富二简单数数,和富二家已经合作的大数据合作伙伴有:
蚂蚁金服X 富国基金=富国中证娱乐、富国中证医药
富国基金和蚂蚁金服签订协议,引入阿里大数据构造的行业景气因子,增强了“成长因子”,富国基金通过量化增强技术,在有效跟踪标的指数的同时力求超越指数表现。
客官在淘宝花的每一分钱,在阿里大数据都鲜明刻画,翻翻你的2016年支付宝账单,看你的花费主要在哪些方向!而阿里大数据,则被富国量化增强团队开发为指数增强因子,用在富国中证娱乐(161036)、富国中证医药(161035)等主题指数基金。
富国中证医药主题指数增强(161037)以中证医药主题指数为跟踪标的,该指数由165只成份股组成;通过首次引入来自阿里旗下“蚂蚁金服”的消费类统计型趋势特征数据,得到医药细分行业投研指标,再综合考察细分行业的景气度、基于个股在各个细分行业的暴露程度进行加权,得到阿里大数据因子。
海关数据X富国基金=富国高端制造
富国中证高端制造主题指数增强(161037)以中证高端制造主题指数为跟踪标的;通过首次引入国家权威机构发布和海关信息网提供的进出口贸易统计数据,得到进出口贸易大数据因子(注:进出口贸易统计数据仅是高端制造相关行业);
海关可以看作是一家数据源,而富二家量化部门是大数据处理部门,对大数据进行清洗,得到贸易竞争力、贸易结构等细分投研指标;
根据所得细分投研指标,综合考察行业竞争力水平和出口贸易景气度,得到进出口贸易行业景气因子得分和进出口贸易景气因子得分;
最后基于每个股票的行业分类,将上述两个因子得分以相关比例进行加权,得到进出口贸易大数据因子得分,应用至产品;
除了上述提到的企业,富二卖个小关子~ 目前,正有多家大数据公司和富二家洽谈合作,将大数据的相关信息应用到富二家相关产品之上~ 想知道是什么?不剧透、不明说,富二将在合适的时候一并为客官发布~
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
Python HTTP 请求工具对比:urllib.request 与 requests 的核心差异与选择指南 在 Python 处理 HTTP 请求(如接口调用、数据爬取 ...
2025-09-12解决 pd.read_csv 读取长浮点数据的科学计数法问题 为帮助 Python 数据从业者解决pd.read_csv读取长浮点数据时的科学计数法问题 ...
2025-09-12CDA 数据分析师:业务数据分析步骤的落地者与价值优化者 业务数据分析是企业解决日常运营问题、提升执行效率的核心手段,其价值 ...
2025-09-12用 SQL 验证业务逻辑:从规则拆解到数据把关的实战指南 在业务系统落地过程中,“业务逻辑” 是连接 “需求设计” 与 “用户体验 ...
2025-09-11塔吉特百货孕妇营销案例:数据驱动下的精准零售革命与启示 在零售行业 “流量红利见顶” 的当下,精准营销成为企业突围的核心方 ...
2025-09-11CDA 数据分析师与战略 / 业务数据分析:概念辨析与协同价值 在数据驱动决策的体系中,“战略数据分析”“业务数据分析” 是企业 ...
2025-09-11Excel 数据聚类分析:从操作实践到业务价值挖掘 在数据分析场景中,聚类分析作为 “无监督分组” 的核心工具,能从杂乱数据中挖 ...
2025-09-10统计模型的核心目的:从数据解读到决策支撑的价值导向 统计模型作为数据分析的核心工具,并非简单的 “公式堆砌”,而是围绕特定 ...
2025-09-10CDA 数据分析师:商业数据分析实践的落地者与价值创造者 商业数据分析的价值,最终要在 “实践” 中体现 —— 脱离业务场景的分 ...
2025-09-10机器学习解决实际问题的核心关键:从业务到落地的全流程解析 在人工智能技术落地的浪潮中,机器学习作为核心工具,已广泛应用于 ...
2025-09-09SPSS 编码状态区域中 Unicode 的功能与价值解析 在 SPSS(Statistical Product and Service Solutions,统计产品与服务解决方案 ...
2025-09-09CDA 数据分析师:驾驭商业数据分析流程的核心力量 在商业决策从 “经验驱动” 向 “数据驱动” 转型的过程中,商业数据分析总体 ...
2025-09-09R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04