چرا حجم نمونه مهم است؟
حجم نمونه مستقیماً بر دو چیز اثر میگذارد: دقت برآورد و توان آماری. نمونه کوچک باعث میشود اثرهای واقعی موجود در جامعه کشف نشوند؛ یعنی فرضیهای که درست است، رد شود.
از سوی دیگر نمونه بسیار بزرگ هم مسئله خودش را دارد: تفاوتهای ناچیز و بیاهمیت از نظر عملی، از نظر آماری معنادار میشوند. به همین دلیل تعیین حجم نمونه باید محاسبهشده باشد، نه بر اساس حدس یا عرف.
در جلسه دفاع، یکی از پرتکرارترین پرسشها این است که «حجم نمونه را چگونه تعیین کردید؟» پاسخ باید شامل روش محاسبه، مقادیر واردشده و منبع آن مقادیر باشد.
فرمول کوکران
فرمول کوکران برای برآورد یک نسبت در جامعه طراحی شده است؛ مثلاً درصد افرادی که یک محصول را میخرند یا از خدمتی رضایت دارند. این فرمول به چهار ورودی نیاز دارد:
- حجم جامعه (N): اگر جامعه محدود باشد.
- سطح اطمینان: معمولاً ۹۵ درصد که مقدار z آن ۱٫۹۶ است.
- دقت یا خطای مجاز (d): معمولاً ۰٫۰۵.
- نسبت p: نسبت مورد انتظار در جامعه. اگر برآوردی ندارید، مقدار ۰٫۵ را قرار دهید که بیشترین حجم نمونه و در نتیجه محافظهکارانهترین پاسخ را میدهد.
با سطح اطمینان ۹۵ درصد، دقت ۰٫۰۵ و p برابر ۰٫۵، برای جوامع بزرگ حجم نمونه به عدد ۳۸۴ نزدیک میشود؛ عددی که در بسیاری از پایاننامهها دیده میشود.
کوکران برای برآورد نسبت است. اگر هدف پژوهش شما آزمون فرضیه درباره تفاوت میانگینها یا آزمون یک مدل ساختاری است، کوکران روش مناسبی نیست؛ هرچند در عمل زیاد استفاده میشود.
جدول مورگان
جدول کرجسی و مورگان در واقع همان محاسبه کوکران برای جوامع محدود است که از پیش انجام و در قالب جدول ارائه شده. کافی است حجم جامعه را بدانید تا حجم نمونه را بخوانید:
| حجم جامعه | حجم نمونه |
|---|---|
| ۱۰۰ | ۸۰ |
| ۲۰۰ | ۱۳۲ |
| ۵۰۰ | ۲۱۷ |
| ۱۰۰۰ | ۲۷۸ |
| ۵۰۰۰ | ۳۵۷ |
| ۱۰۰۰۰۰ و بیشتر | حدود ۳۸۴ |
مزیت جدول مورگان سادگی آن است و برای پژوهشهای توصیفی و پیمایشی کفایت میکند. محدودیتش این است که به نوع تحلیل آماری، تعداد متغیرها و اندازه اثر مورد انتظار کاری ندارد.
تحلیل توان آماری
دقیقترین روش، محاسبه حجم نمونه بر اساس توان آماری است. در این روش چهار عامل به هم مرتبطاند و با داشتن سهتا، چهارمی محاسبه میشود:
- سطح معناداری (α): معمولاً ۰٫۰۵.
- توان (1−β): استاندارد رایج ۰٫۸ است.
- اندازه اثر مورد انتظار: از پژوهشهای پیشین یا مطالعه مقدماتی به دست میآید.
- حجم نمونه.
نرمافزار رایگان G*Power این محاسبه را برای انواع آزمونها انجام میدهد. برای نمونه، برای مقایسه دو گروه با آزمون تی مستقل، اندازه اثر متوسط (d = ۰٫۵)، توان ۰٫۸ و آلفای ۰٫۰۵، حدود ۱۲۸ نفر (۶۴ نفر در هر گروه) لازم است.
اگر اندازه اثر مورد انتظار را کوچک در نظر بگیرید، حجم نمونه بهسرعت بالا میرود. همین موضوع نشان میدهد چرا پژوهشهایی با نمونه ۳۰ نفری معمولاً نمیتوانند اثرهای واقعی را کشف کنند.
حجم نمونه در معادلات ساختاری
برای مدلهای ساختاری، قواعد جداگانهای مطرح شده است:
- قاعده ۱۰ برابر در PLS: نمونه دستکم ده برابر بیشترین تعداد مسیرهای ورودی به یک سازه باشد.
- نسبت به تعداد پارامترها در CB-SEM: بهازای هر پارامتر برآوردی بین ۵ تا ۱۰ نمونه.
- کف عملی: برای مدلهای کوواریانسمحور معمولاً حداقل ۲۰۰ نمونه توصیه میشود.
کدام روش را انتخاب کنیم؟
| نوع پژوهش | روش پیشنهادی |
|---|---|
| توصیفی و برآورد نسبت | کوکران یا جدول مورگان |
| مقایسه گروهها و آزمون فرضیه | تحلیل توان با G*Power |
| همبستگی و رگرسیون | تحلیل توان بر اساس تعداد پیشبینها |
| معادلات ساختاری | قواعد ویژه SEM بههمراه تحلیل توان |
در عمل توصیه میشود حجم نمونه محاسبهشده را حدود ۱۰ تا ۲۰ درصد افزایش دهید تا ریزش پاسخدهندگان و پرسشنامههای ناقص جبران شود.
جمعبندی
- حجم نمونه باید محاسبهشده و قابل دفاع باشد، نه بر اساس عرف.
- کوکران و مورگان برای پژوهشهای توصیفی مناسباند.
- برای آزمون فرضیه، تحلیل توان با G*Power دقیقترین روش است.
- توان ۰٫۸ و آلفای ۰٫۰۵ استاندارد رایج محاسبه است.
- برای جبران ریزش، حجم محاسبهشده را کمی افزایش دهید.