京公网安备 11010802034615号
经营许可证编号:京B2-20210330
STATA软件是一款国际上非常流行的优秀的统计软件,是众多研究机构和公司在数据分析中的首选软件,并被很多国家和国际组织指定为官方使用软件。
STATA强大的统计与计量分析功能、精致的绘图、简单易行的窗口操作、简练便捷的编程、强大的MATA矩阵运算、丰富的网络资源等功能使其成为世界上用户最多的软件之一,被高度评价为“数据分析的操作系统”,可以实现诸多的统计分析方法,如单元统计、多元统计等内容;还包括了许多经典和前沿的计量模型,如单方程回归模型、离散选择模型、分位数回归、时间序列分析、面板数据分析、蒙特卡洛模拟和自举法等。
有效提升论文发表与Stata应用技能
时间:初级:2018年1月13-16日 (四天)
讲师介绍:
连玉君,经济学博士,副教授。2007年7月毕业于西安交通大学金禾经济研究中心,现任教于中山大学岭南学院金融系。主讲课程为“金融计量”、“计量分析与Stata应用”、“实证金融”等。
已在《China Economic Review》、《经济研究》、《管理世界》、《经济学(季刊)》、《金融研究》、《统计研究》等期刊发表论文60余篇。连玉君副教授主持国家自然科学基金项目(2项)、教育部人文社科基金项目、广东自然科学基金项目等课题项目10余项。
目前已完成Panel VAR、Panel Threshold、Two-tier Stochastic Frontier等计量模型的Stata实现程序,并编写过几十个小程序,如xtbalance、winsor2、bdiff、hausmanxt、ttable3、hhi5等。
初级班课程大纲
|
专题名称 |
授课内容 |
|
第1讲(3小时) Stata简介 |
数据的导入和导出 执行指令和基本统计分析 do文件和log文件的使用 帮助文件的使用和外部命令的获取 一篇范例文档 |
|
第2讲(3小时) 数据处理 |
数据的横向合并和纵向追加 重复样本值、缺漏值和离群值的处理 基本统计量的呈现 基本统计分析(组间均值差异和中位数差异检验) 文字变量的处理 大型数据的处理范例(GTA数据库和工业企业数据库) |
|
第3讲(3小时) Stata程序 |
局域暂元和全局暂元(local, global) 控制语句(条件语句、循环语句) Stata中的各类函数 分组回归分析 范例:盈余管理程度的估算、现金持有调整系数的估算 |
|
第4讲(3小时) 普通最小二乘法 (OLS) |
线性回归模型估计方法(OLS) 假设检验和统计推断 Bootstrap、Jackknife及稳健性标准误的获取 虚拟变量 |
|
第5讲(3小时) 模型的设定和解释 |
交乘项和平方项的使用及解释 R2分解和贡献度分析 分组回归和组间系数差异检验 估计结果的呈现和分析 范文2篇 |
|
第6讲(3小时) 内生性问题及估计方法: IV-GMM 倍分法(DID, D-in-D) |
工具变量法(IV) 广义矩估计法(GMM)简介 内生性检验:是否存在内生性 过度识别检验:工具变量的合理性 倍分法(Difference in Difference)简介 PSM-DID 应用实例(介绍2篇论文) |
|
第7讲(3小时) 静态面板数据模型 |
静态面板模型:固定效应和随机效应 基于Bootstrap的Hausman检验 异方差和序列相关(Bootstrap、Cluster调整标准误) 包含内生变量的固定效应模型 实证分析中的常见问题 应用实例(介绍3篇论文) |
|
第8讲(3小时) 论文写作与发表专题 |
Endnote和Google Scholar的使用 论文的选题 如何梳理和评述文献 研究贡献的陈述 研究设计与论文的修改 修改报告的撰写 (与审稿人有效沟通) |
高级班课程大纲
|
第1讲(3小时) 动态面板模型 面板VAR模型 |
一阶差分GMM估计量(FD-GMM) 序列相关检验和过度识别检验(Sargan检验) 面板VAR模型简介 冲击反应函数 (IRF)、方差分解 (FEVD) 应用实例(介绍3篇论文) |
|
第2讲(3小时) 面板门槛模型 |
Bootstrap简介 截面门槛模型(Cross-sectional Threshold Model) 面板门槛模型(Panel Threshold Model) 应用实例(介绍2篇论文) |
|
第3讲(3小时) Logit模型 |
Logit模型简介 模型设定、估计方法和结果的解释 多元Logit模型 (Multinomial Logit) 有序Logit模型 (Ordered Logit) 应用实例(介绍2篇论文) |
|
第4讲(3小时) 内生性问题专题I: Heckman选择模型 处理效应模型 倾向得分匹配分析(PSM) |
Heckman选择模型(Heckman Selection Model) 处理效应模型(Treatment Effect Model) 倾向得分匹配分析(Propensity Score Matching, PSM) 配对方法:精确配对、半径匹配、最近邻匹配等 共同支撑假设和平行假设 应用实例(介绍2篇论文) |
|
第5讲(3小时) 内生性问题专题II: 合成控制法 (Synthetic control methods) |
合成控制法简介 精讲一篇经典论文(Stata实现过程):Abadie, A., A. Diamond, J. Hainmueller, 2010, Synthetic control methods for comparative case studies: Estimating the effect of california's tobacco control program, Journal of the American Statistical Association, 105 (490): 493-505. |
|
第6讲(3小时) 内生性问题专题III: 断点回归分析(RDD) |
Regression Discontinuity Design (RDD) 简介 范例:2篇文章 |
|
第7讲(3小时) 学术论文精讲 Faulkender and Wang (2006, JF) |
Faulkender, M., R. Wang, 2006, Corporate Financial Policy and the Value of Cash, Journal of Finance, 61 (4): 1957-1990.
|
|
第8讲(3小时) 课题标书的撰写 |
评审专家的习惯和偏好 关于选题和子课题的设定 研究基础、研究目标、研究内容、研究难点 特色和创新点的提炼 标书的结构和标书的修改 经验分享:一份中标的自科标书 |
1. 无论报初级班还是高级班,缴费成功后都享受如下优惠:
√ (a)赠送与所报课程相同的stata视频教程,
即报初级班送初级班视频,报高级班送高级班视频,报全程送【初级+高级+论文攻略】视频;
√ (b)5折优惠购买未赠送的其他Stata视频;
2,现场班老学员9折优惠;
6,优惠2,3,4,5不叠加。
PS:根据报名缴费顺序安排现场座位。
报名流程:
1. 点击“初级/高级/全程班报名”网上提交报名信息,报名时请留言报全程还是初级,高级~
2. 电话确认,订单缴费;
3. 缴费确认,开课前一周发送软件准备,电子版讲义;
联系方式:
魏老师
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在大数据时代背景下,海量行业数据亟需通过专业化工具挖掘潜在价值,辅助企业业务决策、优化运营模式、规避经营风险。Python凭借 ...
2026-08-28SQL是数据分析领域最基础、最核心的工具,承担着取数、清洗、统计、分层、归因的全流程工作。不同于单纯的语法练习,实战化SQL数 ...
2026-08-28 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-08-28随着新零售模式的快速普及,零售行业从传统的“货品驱动”全面转向“用户驱动”。门店交易数据、线上消费记录、浏览轨迹、复购频 ...
2026-08-27在数据分析、爬虫采集、接口开发、数据归档等场景中,JSON与CSV是两种使用率最高的数据存储格式。JSON为键值对结构化格式,适配 ...
2026-08-27 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-08-27在数据分析工作中,时间序列是最常见的数据类型之一,订单时间、日志时间、交易时段、统计周期等数据均离不开时间处理。原始数据 ...
2026-08-26在数据分析与数据预处理工作中,原始数据普遍存在录入错误、系统故障、偶然极值等问题,极易产生异常数据。异常数据会严重干扰数 ...
2026-08-26 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-08-26在数理统计与数据分析领域,多因素方差分析与线性回归模型是研究变量关系、因素影响、数据差异规律的两大核心工具。二者均属于经 ...
2026-08-25数据分析的核心价值不在于数据计算与图表制作,而在于清晰、精准、有逻辑地输出结论、支撑业务决策。日常数据分析报告普遍存在结 ...
2026-08-25 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-08-25平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-08-24 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-08-21在数据分析与数据可视化工作中,直方图是展示数据分布特征、离散程度、集中区间的核心图表,能够直观呈现数值数据的频次分布规律 ...
2026-08-20在数据分析领域有一句核心准则:垃圾数据进,垃圾数据出。数据清洗是数据分析、数据建模、数据可视化之前的必经前置工序,也是保 ...
2026-08-20 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-08-20在Python数据分析与数据清洗工作中,Pandas是最核心的数据处理库,DataFrame是结构化数据的标准存储格式。在实时数据采集、循环 ...
2026-08-19