
精准医学时代,健康医疗大数据需要标准化
近年来,“精准医学”“大数据”已成为健康医疗行业的热词,健康医疗大数据产业也孕育着大市场,带来科技进步或价值转化。21日,在BT峰会的高端对话上,围绕“健康医疗大数据发展的机遇与挑战”这一主题,中国科学院院士贺林、美国医学信息学会主席道格拉斯·弗里斯玛、美国医学信息学院院士刘宏芳、北科生物董事长胡祥、神州数码医疗科技股份有限公司总裁史文钊,共同探讨生物医学大数据产业发展中的共享和转化、数据安全、标准建设、社会伦理等热点问题,预测我国健康医疗大数据的发展趋势。专家们表示,在精准医学时代,健康医疗大数据需要加快整合和标准化,才能更好地为预防疾病做贡献。
大数据经整合挖掘才有价值
随着云计算、大数据、人工智能等信息技术与生物技术融合发展,健康医疗大数据产业正成为生物材料与信息的最好体现。去年国务院《关于促进和规范健康医疗大数据应用发展的指导意见》的出台后,健康医疗大数据受到政府、医院、科研机构和学术界越来越多的重视。
什么样的数据才是健康医疗大数据?贺林说,健康医疗大数据与交通大数据、气候大数据有根本性的区别,“一个是活的,一个是死的。”然而,目前我国的健康医疗大数据全是孤岛型的,没有联系,也没有标准化,这些孤立的、没有标准化的大数据没有价值。在他看来,健康医疗大数据的含义是把同类的或者相关的数据整合在一起后,得到一个相关网络的位点,也就是能从相关性的数据中挖掘出有价值的内容为人类服务,“比如平均温度提高2 会带来哪些健康问题等。”
道格拉斯·弗里斯玛也表达了同样的观点。她表示,健康医疗大数据首先要有量,有非常强的流动性,还要有真实性。目前,健康医疗数据多种多样,但要成为大数据就需要收集和整合,并把这些数据进行分类和描述,因为只有准确的数据才能真正帮助了解病人的状况。“将不同类型的数据整合在一起,可以降低数据种类性,同时保证数据的真实性。”道格拉斯·弗里斯玛说。而且采集和整合健康医疗大数据的最终目的不是大数据本身,而是通过大数据来帮助治疗疾病,因为每个病人身上获取的数据很多,挖掘出这些数据的价值用于临床,诊治下一个病人的成功率就越来越高。
在美国,健康医疗大数据同样也存在数据的孤岛,“在研究的过程中,数据也是研究者所拥有的,很多人不愿意把数据拿出来分享,我们希望能打破,但难度很大。”因此,在道格拉斯·弗里斯玛看来,数据的整合仍是健康医疗大数据发展面临的一大挑战。不过,她也相信随着开放性科学不断的推动,及平台的日益增加,会让研究者公开他们的数据,最终形成有效的数据池。
大数据行业亟需建立标准
健康医疗大数据时代,大量医疗数据被源源不断采集。正如胡祥所说,目前医疗健康大数据的来源、产生源很多,如医院、医药公司等机构产生的医疗数据、各种基因组学的数据。对于整个健康医疗大数据行业来说,标准的制定也非常迫切。
“生命科学不仅是医学,还是生命基础科学研究,但各个机构之间从来没有一个统一标准,都是各做各的,最后出来的数据质量也不一样。”贺林说,有的不是大数据,小数据也说成大数据。
贺林表示,健康医疗大数据最后是要进行解读,但是如何去解读也没有统一化和标准化,“数学家在用数学的方法,统计学家用统计学的方法,生物学家要用遗传咨询的方法。”不同的解读方法,最后解读出来的结果也不一样。因此,在他看来,如何建立标准是健康医疗大数据行业要考虑的问题,“谁来制定标准,怎么样制定标准,比哪一步都重要。”
胡祥也表示,临床积累的健康医疗数据需要标准化,因为每个医生描述不一样,最后做数据分析和挖掘的结果也不一样。“未来重要的数据是组学数据,这些数据包括基因组、蛋白组、微生物组,最后读出来就是机器,可以高效识别,但这些数据的标准化与人类健康相关性很强。”胡祥说。
道格拉斯·弗里斯玛认为,中国有很大机会建立标准化统一平台,“中国既能造高铁,也能造医疗上的 高铁 。”
可用大数据训练人工智能
专家们非常看好健康医疗大数据在中国的应用前景。“随着各种传感器和可穿戴设备的应用,24小时持续采集的数据越来越多,如果把标准做好,方法学找到,用高效的方法把数据资源集中起来,我们的医疗健康大数据不会输给别人。”胡祥说。其次,目前我国正在推进医改,要解决医疗行业存在的一些问题,可以通过更先进的工具和技术来解决。更重要的是,目前我国的算法和计算能力正在快速进步的时候,能把核心数据高效的整理起来,以此为起点,可以通过这些数据快速地训练人工智能,推动人工智能的发展。
胡祥认为,在大健康医疗领域,人工智能才是未来的制高点。因此,下一步抢的是AI、人工智能。“训练人工智能的前提是要有数据训练算法,现在我们就是要挖掘数据,人工智能一旦成熟以后,可能会出现各种各样的可穿戴设备,再把采集的各种数据送上去以后,这些设备性能会高很多。”胡祥说。
“医疗健康大数据在国内很有发展前景。”刘宏芳表示,“大数据的发展要以人为本,通过大数据帮助普通老百姓分诊、预防疾病,目前中国有大量的人才,政府重视,企业不断创新,资本也不断投入。”她建议,未来中国健康医疗数据的收集要全方位,这也可以避免走很多弯路。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29CDA 数据分析与量化策略分析流程:协同落地数据驱动价值 在数据驱动决策的实践中,“流程” 是确保价值落地的核心骨架 ——CDA ...
2025-08-29CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-28CDA认证:数据时代的职业通行证 当海通证券的交易大厅里闪烁的屏幕实时跳动着市场数据,当苏州银行的数字金融部连夜部署新的风控 ...
2025-08-28PCU:游戏运营的 “实时晴雨表”—— 从数据监控到运营决策的落地指南 在游戏行业,DAU(日活跃用户)、MAU(月活跃用户)是衡量 ...
2025-08-28Excel 聚类分析:零代码实现数据分群,赋能中小团队业务决策 在数字化转型中,“数据分群” 是企业理解用户、优化运营的核心手段 ...
2025-08-28CDA 数据分析师:数字化时代数据思维的践行者与价值推动者 当数字经济成为全球经济增长的核心引擎,数据已从 “辅助性信息” 跃 ...
2025-08-28