如何 3 步装好 GTOOLS:Stata 大表聚合提速指南

📅 2026/8/21 19:26:20
如何 3 步装好 GTOOLS:Stata 大表聚合提速指南
如何 3 步装好 GTOOLSStata 大表聚合提速指南【免费下载链接】stata-gtoolsFaster implementation of Statas collapse, reshape, xtile, egen, isid, and more using C plugins项目地址: https://gitcode.com/gh_mirrors/st/stata-gtoolsGTOOLS 是 Stata 的 C 插件加速包把 collapse、reshape、egen、levelsof 等常用命令换成 g 前缀版本聚合与分箱最多提速 50 倍百万行明细的汇总不再等半天。为什么值得用速度是硬指标。官方基准里gcollapse比原生collapse快 4 到 100 倍Stata 17 之前gisid快 8 到 30 倍gquantiles快 10 到 30 倍gstats sum/tab快 10 到 50 倍。写法几乎不变。语法刻意对齐原生命令collapse换成gcollapse、reshape换成greshape旧脚本基本只需改个名字不用重学语法。为大表而生。几万行时差距不明显一到几百万、上千万行原来跑几小时的活能压到十几分钟。平台与门槛友好。免费、MIT 协议Windows / macOS / Linux 64 位均有预编译插件Stata 13 以上即可安装。快速上手3 步完成安装在 Stata 命令窗口粘贴两行第二条负责同步到最新稳定版ssc install gtools gtools, upgrade装完你就拥有了一组 g 开头的新命令gcollapse、gquantiles、hashsort等。第一条命令5 秒跑通 gcollapse用自带示例数据做第一次聚合感受一下按组汇总的速度sysuse auto, clear gcollapse (mean) mean_price price, by(make)74 行明细被压成 11 行品牌均价by()指定分组变量其余写法与原生collapse一致。真实场景百万行明细秒变汇总表做大面板或交易明细时最常做的就是按组出统计量。gcollapse支持mean、median、nunique、select#等一整套函数merge选项还能省掉存盘再合并的中间步骤gcollapse (mean) m x (nunique) u y, by( grp ) merge一行完成分组汇总并把结果直接并回原表。价格变量 1 行切出十分位分组回归前需要给连续变量分箱。gquantiles兼容xtile、pctile、_pctile三种写法还额外支持by()gquantiles p10 price, pctile nq(10)原生版本切多个分位数时很慢这里一行出结果。避坑与注意strL 长字符串先转普通字符串gcollapse等不支持它插件运行时界面会假死看磁盘与交换区活动判断是否缺内存Stata 17 MP 原生命令已提速替换前先跑 基准脚本 确认收益超过 21 亿行的数据超出插件接口上限退回原生命令还能搭配谁ftoolsgtools 的直接前身同思路的fcollapse、fegen命令gtools 比它更快且能混用字符与数值变量分组。reghdfe高维固定效应回归的标准选择gtools 自带的gregress目前是 beta、只输出系数和标准误常见组合是reghdfe 跑回归、gtools 做前置聚合分箱。装上 GTOOLS 后你的大表聚合、分箱、透视就能从小时级降到分钟级。想深入某个命令可读仓库里的 docs/usage/ 各命令说明与 docs/faqs.md 常见问题。【免费下载链接】stata-gtoolsFaster implementation of Statas collapse, reshape, xtile, egen, isid, and more using C plugins项目地址: https://gitcode.com/gh_mirrors/st/stata-gtools创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考