京公网安备 11010802034615号
经营许可证编号:京B2-20210330
教育大数据市场前景广阔_数据分析师
美国高中生和大学生的糟糕表现——高中生退学率高达30%(平均每 26秒就有一个高中生退学),33%的大学生需要重修,46%的大学生无法正常毕业——在让教育部门忧心忡忡的同时,也让教育科技公司找到了淘金的机会。近些年来,许多教育科技公司纷纷开始抢滩大数据学习分析的市场,竞争极为激烈。
美国的一些企业已经成功地商业化运作教育中的大数据。全球最大的信息技术与业务解决方案公司IBM就与亚拉巴马州的莫白儿县公共学区进行大数据合作。结果显示,大数据对学校的工作具有重要作用。当IBM刚刚开始与这一学区合作时,除了学生成绩不好之外,该县还面临着辍学率已增加到48%的严峻情况。根据联邦政府的《不让一个孩子掉队法》(No Child Lift Behind,NCLB),学生成绩糟糕的地方政府将受到惩罚。为了应对这一巨大的挑战,该县此前已经在学生数据的基础上建立了一个辍学指示工具,并将其用于全县层面的决策。但IBM认为这仍不足以改善莫白儿县窘迫的现状,需要借助IBM的技术支持重新建立大数据,进而利用大数据分析来改善学区内所有学生的整体成绩。
在美国的教育大数据领域,除了处于领先地位的IBM,还有像“希维塔斯学习”(Civitas Learning)这样的新兴企业。“希维塔斯学习”是一家专门聚焦于运用预测性分析、机器学习从而提高学生成绩的年轻公司。该公司在高等教育领域建立起最大的跨校学习数据库。通过这些海量数据,能够看到学生的分数、出勤率、辍学率和保留率的主要趋势。通过使用100多万名学生的相关记录和700万个课程记录,这家公司的软件能够让用户探测性地知道导致辍学和学习成绩表现不良的警告性信号。此外,还允许用户发现那些导致无谓消耗的特定课程,并且看出哪些资源和干预是最成功的。
在加拿大,总部位于安大略省沃特卢的教育科技公司“渴望学习”(Desire 2 Learn)已经面向高等教育领域的学生,推出了基于他们自己过去的学习成绩数据预测并改善其未来学习成绩的大数据服务项目。这家公司的新产品名为“学生成功系统”(Student Success System)。“渴望学习”声称加拿大和美国的1000多万名高校学生正在使用其学习管理系统技术。“渴望学习”的产品通过监控学生阅读电子化的课程材料、提交电子版的作业、通过在线与同学交流、完成考试与测验,就能让其计算程序持续、系统地分析每个学生的教育数据。老师得到的不再是过去那种只展示学生分数与作业的结果,而是像阅读材料的时间长短等这样更为详细的重要信息,这样老师就能及时诊断问题的所在,提出改进的建议,并预测学生的期末考试成绩。
像美国的“梦盒学习”(DreamBox Learning)公司和“纽顿”(Knewton)公司这类领先性的开发者们,已经成功创造并发布了各自版本的利用大数据的适应性学习(adaptive learning)系统。在2012年国际消费电子展的高等教育技术峰会上,世界最大的教育出版公司培生集团(Pearson)与适应性学习领域里的先行者纽顿公司共同发布了主要由培生集团开发的适应性学习产品——“我的实验室/高手掌握”(MyLab/Mastering)。这款产品在将全球范围内向数百万名学生提供个性化的学习服务,向他们提供真实可信的学习数据,让学校通过这些数据提高学生的学习效果并降低教学成本。首款产品将在美国的数十万名学生中使用,包括数学、英语,以及写作等技能开发课。
纽顿的创办人、首席执行官何塞·费雷拉和培生高等教育分公司的总裁格雷格·托宾共同出席了“我的实验室/高手掌握”的发布会并介绍了合作的细节,讨论了高等教育的未来。托宾说:“个性化学习是未来教育的一个关键点。我们把纽顿的技术整合到‘我的实验室/高手掌握’这个产品中,是整个行业进入个性化教育新时代的引领风气之举”。费雷拉说:“从今年秋季起,培生的课程材料将在纽顿技术的支持下,开始适应性地满足每个学生独特的学习需求。学生能够生成大量有价值的数据,纽顿可以分析这些数据,以此确保学生以最有效、最高效的方式学习。这是教育的一个新的前沿领域”。按照已经达成的协议,这两家公司2013年将进一步扩大合作,把大学数学、大学统计学、大学一年级作文、经济学以及科学等领域纳入其产品中去。
此外,由总部设在美国纽约的麦格劳·希尔公司(McGraw-Hill)、总部设在英国伦敦的培生集团和其他出版公司共同开发的“课程精灵”系统(CourseSmart),也允许教授们通过让学生使用电子教科书来跟踪他们的学业进展,并向助教们显示学生的学习参与度和学习成绩等大量的数据信息,只是这一系统尚不具备预测的功能。CDA数据分析师培训官网
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据分析工作中,时间序列是最常见的数据类型之一,订单时间、日志时间、交易时段、统计周期等数据均离不开时间处理。原始数据 ...
2026-08-26在数据分析与数据预处理工作中,原始数据普遍存在录入错误、系统故障、偶然极值等问题,极易产生异常数据。异常数据会严重干扰数 ...
2026-08-26 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-08-26在数理统计与数据分析领域,多因素方差分析与线性回归模型是研究变量关系、因素影响、数据差异规律的两大核心工具。二者均属于经 ...
2026-08-25数据分析的核心价值不在于数据计算与图表制作,而在于清晰、精准、有逻辑地输出结论、支撑业务决策。日常数据分析报告普遍存在结 ...
2026-08-25 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-08-25平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-08-24 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-08-21在数据分析与数据可视化工作中,直方图是展示数据分布特征、离散程度、集中区间的核心图表,能够直观呈现数值数据的频次分布规律 ...
2026-08-20在数据分析领域有一句核心准则:垃圾数据进,垃圾数据出。数据清洗是数据分析、数据建模、数据可视化之前的必经前置工序,也是保 ...
2026-08-20 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-08-20在Python数据分析与数据清洗工作中,Pandas是最核心的数据处理库,DataFrame是结构化数据的标准存储格式。在实时数据采集、循环 ...
2026-08-19在零售行业大数据分析与精细化运营领域,纸尿裤旁摆放啤酒是最经典、最具代表性的商业案例。两种看似毫无关联的商品,一个是婴幼 ...
2026-08-19 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-08-19在数据分析、业务监控、质量检测与风险管控工作中,数据波动性是衡量数据稳定性、业务健康度、结果可信度的核心依据。数据波动代 ...
2026-08-18很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当导致 ...
2026-08-18在数据分析、业务评价、产品评级、用户分层与综合决策场景中,单一指标往往无法全面、客观地评价事物整体水平。现实中的评价对象 ...
2026-08-18在数理统计、假设检验、数据分析与机器学习领域中,卡方分布(χ²分布)是继正态分布、t分布之后最重要的连续型概率分布之一。 ...
2026-08-17