دوره آموزشی نرمافزار استتا (Stata) در سایت ایران آمار برای آشنایی بنیادی پژوهشگران با تحلیلهای آماری طراحی شده است. جلسهی سوم آمورش استتا با عنوان آمار توصیفی در استتا (stata) است و جلسه اول دوره آموزشی با عنوان معرفی محیط استتا به توصیف اجزای نرمافزار، نحوه استفاده از پنجرههای اصلی، و ارتباط میان فرمانها و دادهها اپرداخته شده است و در جلسهی دوم با عنوان وارد کردن داده در استتا، نحوهی وارد کردن داده ها در نرم افزار استتا از چند مسیر آموزش داده شده شده است.
برای برقراری ارتباط با گروه داده پردازی ایران آمار از طریق لینکهای زیر اقدام نمایید.
آمار توصیفی در استتا چیست؟
آمار توصیفی در استتا (Stata) به مجموعهای از روشها و دستورات گفته میشود که برای خلاصهسازی، توصیف و درک اولیه دادهها استفاده میشوند. قبل از انجام تحلیلهای پیشرفته مانند رگرسیون یا آزمون فرضیه، معمولاً ابتدا با استفاده از آمار توصیفی، ویژگیهای اصلی دادهها بررسی میشود. این گزارشات نمای کلی از هر متغیر را به پژوهشگر نشان میدهد و رنج و اطلاعت کلی از متغیرها را نمایش میدهد.
در نرمافزار Stata، آمار توصیفی به پژوهشگر کمک میکند تا اطلاعات مهمی مانند میانگین، میانه، انحراف معیار، حداقل و حداکثر مقادیر، توزیع دادهها و فراوانی متغیرها را به دست آورد. این اطلاعات باعث میشود تحلیلگر بتواند دید کلی و دقیقی از دادههای خود پیدا کند و مشکلات مثل دادههای پرت (Outliers) یا مقادیر گمشده (Missing Data) را شناسایی کند. دادههای پرت از انحراف معیار زیاد متغیر شناسایی و مقادیر گمشده از تعداد مشاهدات مشخص میگردند.
به طور کلی، آمار توصیفی در استتا برای پاسخ به پرسشهای زیر استفاده میشود:
دادهها چه ویژگیهایی دارند؟
میانگین و پراکندگی متغیرها چقدر است؟
توزیع مقادیر چگونه است؟
برای انجام آمار توصیفی در استتا، دستورات مختلفی وجود دارد که برخی از مهمترین آنها شامل summarize ، tabstat هستند. این دستورات با چند خط ساده، اطلاعات شاخصهای آماری مهمی درباره دادههای پژوهش به مخاطب نمایش میدهند. به همین دلیل، آمار توصیفی یکی از اولین و مهمترین مراحل تحلیل دادهها در تمام پژوهشها محسوب و مورد استفاده قرار میگیرد.
آمار توصیفی در استتا با دستور tabstat
در نرمافزار استتا Stata یکی از دستورات کاربردی برای محاسبه آمار توصیفی و ساخت جدول، دستور tabstat است. این دستور امکان محاسبه و نمایش چندین شاخص آماری را بهصورت همزمان فراهم میکند و نسبت به دستور summarize انعطافپذیری بیشتری در انتخاب نوع شاخصها دارد. به کمک دستور tabstat میتوان آمارههایی مانند میانگین، میانه، انحراف معیار، حداقل، حداکثر، واریانس و تعداد مشاهدات را برای یک یا چند متغیر محاسبه کرد.
یکی از مزیتهای مهم دستور tabstat این است که کاربر میتواند مشخص کند کدام شاخصهای آماری در خروجی نمایش داده شوند. به همین دلیل این دستور در تحلیلهای آماری، گزارشهای پژوهشی و تهیه جدولهای آماری برای پایاننامه و مقاله بسیار مورد استفاده قرار میگیرد.
ساختار کلی استفاده از این دستور در Stata به شکل زیر است:
tabstat variable
در این دستور آمار توصیفی در استتا، به جای variable نام متغیری قرار میگیرد که شاخصهای آمار توصیفی آن مورد بررسی قرار میگیرد. برای مثال اگر آمار توصیفی متغیر education (تحصیلات) مورد نیاز باشد، میتوان دستور زیر را اجرا کرد:
tabstat education

پس از اجرای این دستور آمار توصیفی در استتا، شاخص آماری میانگین مربوز به متغیر مورد نظر را در قالب یک جدول نمایش داده خواهد شد. این جدول شامل نام متغیر و میانگین متغیر است که در این پژوهش میانگین سطح تحصیلات 1.97 است. متغیر تحصیلات کدگذاری شده است و به تریب از صفر (کارشناسی) تا 3 (دکتری) مقادیر برای هر فرد قرار داده شده است.
در دستور tabstat همچنین میتوان مشخص کرد که چه آمارههایی در خروجی نمایش داده شوند. برای مثال اگر میانگین، میانه و انحراف معیار یک متغیر مورد نیاز باشد، از گزینه statistics استفاده خواهد شد مانند کد زیر برای بدست آوردن میانگین، میانه و انحراف معیار متغیر تحصیلات:
tabstat education, statistics(mean median sd)

در این حالت خروجی استتا فقط آمارههای انتخاب شده را نمایش خواهد داد. در این مثال برای سطح تحصیلات 3 شاخص آماری میانگین میانه و انحراف معیار گزارش شده است. یکی دیگر از قابلیتهای مهم دستور tabstat این است که میتوان آمار توصیفی چند متغیر را بهصورت همزمان محاسبه کرد. برای مثال:
tabstat age education sex , statistics(mean sd min max)

در این مثال، استتا شاخصهای میانگین، انحراف معیار، حداقل و حداکثر را برای سه متغیر مختلف نمایش میدهد.
آمار توصیفی در استتا با دستور summarize
از سادهترین و پرکاربردترین دستورات برای بررسی اولیه دادهها و آمار توصیفی در استتا stata، دستور summarize است. دستور summarize مجموعهای از شاخصهای مهم آماری را برای متغیرهای مورد نظر محاسبه میکند. در خروجی این دستور معمولاً اطلاعات تعداد مشاهدات، میانگین، انحراف معیار، حداقل مقدار و حداکثر مقدار متغیر نمایش داده میشود. برای اجرای این دستور کافی است نام متغیر مورد نظر را بعد از summarize وارد کنید. ساختار کلی آن به صورت زیر است:
summarize variable
برای مثال شاخصهای توصیفی مربوط به متغیرهای پژوهش را میتوان دستور زیر را در محیط استتا اجرا کرد. این دستور سه متغیر age (سن)، education (تحصیلات) و sex (جنسیت) را از نظر شاخصهای آماری اصلی مورد بررسی قرار داده است. در ادامه، هر متغیر به صورت جداگانه تفسیر میشود:
summarize age education sex

بر اساس خروجی مشاهده میشود که تعداد مشاهدات ثبتشده برای سن برابر با 385 نفر است. میانگین سن افراد برابر با 24.11 سال گزارش شده که نشان میدهد اغلب افراد نمونه در بازه سنی جوان قرار دارند. انحراف معیار برابر با 3.83 است. این مقدار نشان میدهد پراکندگی سن افراد نسبتاً محدود بوده و بیشتر افراد در فاصلهای نزدیک به میانگین قرار دارند. حداقل سن برابر با 18 سال و حداکثر آن 40 سال است. بنابراین دامنه تغییرات سن برابر است با 40 منهای 18 که برابر 22 است. این دامنه نشان میدهد که دادهها بازه نسبتاً مشخصی از سنین را پوشش میدهند.
تعداد مشاهدات برای متغیر تحصیلات 384 مورد است؛ یعنی یک مشاهده نسبت به متغیر سن کمتر ثبت شده است. این موضوع نشاندهنده وجود یک مقدار گمشده (Missing Value) در دادهها است. میانگین متغیر تحصیلات برابر با 1.96 است. با توجه به اینکه حداقل مقدار 1 و حداکثر مقدار 3 گزارش شده، این متغیر به صورت کدگذاریشده تعریف شده است ( 1 = کارشناسی، 2 = کارشناسی ارشد، 3 = دکتری). انحراف معیار برابر با 0.79 است که نشان میدهد پراکندگی سطح تحصیلات در نمونه متوسط است و تمرکز زیادی روی یک سطح خاص وجود ندارد.
تعداد مشاهدات ثبتشده برای متغیر جنسیت نیز 384 مورد است. این متغیر 0 و 1 تعریف شده که یک متغیر دوحالتی (Binary) است. میانگین این متغیر برابر با 0.53 است. در متغیرهای دوحالتی، میانگین در واقع نشاندهنده نسبت فراوانی مقدار «1» در نمونه است. بنابراین میتوان گفت حدود 53 درصد افراد نمونه مرد دارای کد 1 بودهاند. انحراف معیار برابر با 0.49 است که در متغیرهای دوحالتی معمولاً مقداری نزدیک به 0.5 دارد، بهویژه زمانی که توزیع دو گروه تقریباً متعادل باشد.
آمار توصیفی در استتا از طریق منو
کاربرانی که ترجیح میدهند بدون استفاده از دستورات متنی در محیط Stata کار کنند، میتوانند آمار توصیفی را بهسادگی از طریق منوهای نرمافزار اجرا کنند. این روش بهویژه برای افرادی مفید است که در ابتدای مسیر یادگیری قرار دارند و میخواهند بدون حفظ دستورات، به خروجیهای آماری دسترسی پیدا کنند. برای دسترسی به آمار توصیفی از طریق منو، مسیر زیر در استتا طی میشود:
Statistics → Summaries, tables, and tests → Summary and descriptive statistics → Summary statistics
با انتخاب این گزینه، پنجرهای نمایش داده میشود که امکان تعیین متغیرهای موردنظر را فراهم میکند. پس از انتخاب متغیرها و اجرای فرمان، استتا مجموعهای از شاخصهای مهم مانند میانگین، میانه، انحراف معیار، حداقل، حداکثر و تعداد مشاهدات را در قالب یک جدول خلاصه ارائه میدهد.

استفاده از منو برای بدست آوردن آمار توصیفی در استتا روشی قابلاعتماد و کاربرپسند برای آشنایی با تحلیلهای اولیه است و کمک میکند پژوهشگران تازهکار قبل از استفاده از دستورات متنی مانند summarize، با ساختار و محتوای خروجیهای آماری استتا بیشتر آشنا شوند. این قابلیت همچنین دسترسی سریع به نتایج را برای افرادی که به محیط گرافیکی علاقه دارند، سادهتر میکند.
جمعبندی و نکات تکمیلی درباره آمار توصیفی در استتا
آمار توصیفی در استتا (Stata) یکی از مهمترین بخشها قبل از شروع تحلیل و آنالیز داده است که در تمام پژوهشهای علمی و پایاننامهها استفاده میشود. پژوهشگر با استفاده از دستورات پایهای مانند summarize و tabstat یا مسیر منویی نرمافزار میتواند در کوتاهترین زمان، تصویری روشن از ویژگیهای اصلی دادهها به دست آورد. بررسی میانگین، میانه، انحراف معیار، حداقل و حداکثر مقادیر هر متغیر باعث میشود روندهای کلی در دادهها مشخص شود و پژوهشگر بتواند قبل از ورود به تحلیلهای پیچیدهتر، خطاهای احتمالی، دادههای پرت یا مقادیر گمشده را شناسایی کند.
نرمافزار استتا با ارائه ابزارهای دقیق و انعطافپذیر، یکی از بهترین گزینهها برای انجام آمار توصیفی و تحلیل دادهها محسوب میشود. هر کاربری که قصد دارد وارد دنیای تحلیل آماری شود—از دانشجویان تازهکار تا پژوهشگران حرفهای—میتواند با چند دستور ساده در استتا، کیفیت دادههای خود را ارزیابی کرده و مسیر تحلیل خود را با اطمینان بیشتری ادامه دهد.
اگر کاربر به دنبال یادگیری اصولی و گامبهگام تحلیل داده با Stata باشد، آموزش آمار توصیفی نقطه شروعی بسیار مهم است؛ زیرا پایه بسیاری از تحلیلهای پیشرفتهتر مانند رگرسیون، تحلیل واریانس و مدلسازیهای پیچیده بر مبنای همین شاخصهای اولیه قرار دارد. در نتیجه، تسلط بر مفهوم و اجرای آمار توصیفی در استتا باعث میشود پژوهشگر با دقت و اطمینان بیشتری نتایج علمی خود را تفسیر کند و گزارشهای معتبرتری ارائه دهد.
انجام پژوهش آماری
جهت سفارش پژوهش آماری از طریق لینکهای زیر با ما در ارتباط باشید


