Skip to content
Data cleaning
- Data cleaning 1: Managing variables (rename, order, keep, and drop)
- Data cleaning 2: Labeling variables and values (label define, label values, numlabel, and uselabel)
- Data cleaning 3: Recoding / reverse-coding variable (clonevar, gen, replace, recode, and labrec)
- Data cleaning 4: Creating binary/dichotomous, ordinal, and interval variables (tab, egen)
- Data cleaning 5: Working with scales and creating summary variables (gen, egen, and alpha)
- Data cleaning 6: Exploring missing data and creating analytic sample (misstable, mdesc, and keep/drop if)
- Data cleaning 7: Working with string variables (destring, tostring, encode, and decode)
- Data cleaning 8: List up specific types of variables and drop all missing variables (findname command)
- Data Cleaning 9: Removing and Adding Prefix/Suffix of Variable Names
- Data Cleaning: How to Export and Import Stata Variable Labels into Do File
Describing the data
- Creating a Codebook (asdoc, htmlcb, wordcb, codebookout)
- Univariate Statistics: Frequency, Central Tendency, and Variability (tab, tabstat, sum, graph bar, hist, graph box)
- Collapse command for aggregating data per variable (mean, median, sd, and count)
- Creating M-1SD, M, M+1SD ordinal variables from continuous variables
- Multiple Imputation by Chained Equation (MICE)
Measurement and reliability