چرا حجم نمونه مهم است؟

حجم نمونه مستقیماً بر دو چیز اثر می‌گذارد: دقت برآورد و توان آماری. نمونه کوچک باعث می‌شود اثرهای واقعی موجود در جامعه کشف نشوند؛ یعنی فرضیه‌ای که درست است، رد شود.

از سوی دیگر نمونه بسیار بزرگ هم مسئله خودش را دارد: تفاوت‌های ناچیز و بی‌اهمیت از نظر عملی، از نظر آماری معنادار می‌شوند. به همین دلیل تعیین حجم نمونه باید محاسبه‌شده باشد، نه بر اساس حدس یا عرف.

در جلسه دفاع، یکی از پرتکرارترین پرسش‌ها این است که «حجم نمونه را چگونه تعیین کردید؟» پاسخ باید شامل روش محاسبه، مقادیر واردشده و منبع آن مقادیر باشد.

فرمول کوکران

فرمول کوکران برای برآورد یک نسبت در جامعه طراحی شده است؛ مثلاً درصد افرادی که یک محصول را می‌خرند یا از خدمتی رضایت دارند. این فرمول به چهار ورودی نیاز دارد:

  • حجم جامعه (N): اگر جامعه محدود باشد.
  • سطح اطمینان: معمولاً ۹۵ درصد که مقدار z آن ۱٫۹۶ است.
  • دقت یا خطای مجاز (d): معمولاً ۰٫۰۵.
  • نسبت p: نسبت مورد انتظار در جامعه. اگر برآوردی ندارید، مقدار ۰٫۵ را قرار دهید که بیشترین حجم نمونه و در نتیجه محافظه‌کارانه‌ترین پاسخ را می‌دهد.

با سطح اطمینان ۹۵ درصد، دقت ۰٫۰۵ و p برابر ۰٫۵، برای جوامع بزرگ حجم نمونه به عدد ۳۸۴ نزدیک می‌شود؛ عددی که در بسیاری از پایان‌نامه‌ها دیده می‌شود.

کوکران برای برآورد نسبت است. اگر هدف پژوهش شما آزمون فرضیه درباره تفاوت میانگین‌ها یا آزمون یک مدل ساختاری است، کوکران روش مناسبی نیست؛ هرچند در عمل زیاد استفاده می‌شود.

جدول مورگان

جدول کرجسی و مورگان در واقع همان محاسبه کوکران برای جوامع محدود است که از پیش انجام و در قالب جدول ارائه شده. کافی است حجم جامعه را بدانید تا حجم نمونه را بخوانید:

حجم جامعه حجم نمونه
۱۰۰ ۸۰
۲۰۰ ۱۳۲
۵۰۰ ۲۱۷
۱۰۰۰ ۲۷۸
۵۰۰۰ ۳۵۷
۱۰۰۰۰۰ و بیشتر حدود ۳۸۴

مزیت جدول مورگان سادگی آن است و برای پژوهش‌های توصیفی و پیمایشی کفایت می‌کند. محدودیتش این است که به نوع تحلیل آماری، تعداد متغیرها و اندازه اثر مورد انتظار کاری ندارد.

تحلیل توان آماری

دقیق‌ترین روش، محاسبه حجم نمونه بر اساس توان آماری است. در این روش چهار عامل به هم مرتبط‌اند و با داشتن سه‌تا، چهارمی محاسبه می‌شود:

  1. سطح معناداری (α): معمولاً ۰٫۰۵.
  2. توان (1−β): استاندارد رایج ۰٫۸ است.
  3. اندازه اثر مورد انتظار: از پژوهش‌های پیشین یا مطالعه مقدماتی به دست می‌آید.
  4. حجم نمونه.

نرم‌افزار رایگان G*Power این محاسبه را برای انواع آزمون‌ها انجام می‌دهد. برای نمونه، برای مقایسه دو گروه با آزمون تی مستقل، اندازه اثر متوسط (d = ۰٫۵)، توان ۰٫۸ و آلفای ۰٫۰۵، حدود ۱۲۸ نفر (۶۴ نفر در هر گروه) لازم است.

اگر اندازه اثر مورد انتظار را کوچک در نظر بگیرید، حجم نمونه به‌سرعت بالا می‌رود. همین موضوع نشان می‌دهد چرا پژوهش‌هایی با نمونه ۳۰ نفری معمولاً نمی‌توانند اثرهای واقعی را کشف کنند.

حجم نمونه در معادلات ساختاری

برای مدل‌های ساختاری، قواعد جداگانه‌ای مطرح شده است:

  • قاعده ۱۰ برابر در PLS: نمونه دست‌کم ده برابر بیشترین تعداد مسیرهای ورودی به یک سازه باشد.
  • نسبت به تعداد پارامترها در CB-SEM: به‌ازای هر پارامتر برآوردی بین ۵ تا ۱۰ نمونه.
  • کف عملی: برای مدل‌های کوواریانس‌محور معمولاً حداقل ۲۰۰ نمونه توصیه می‌شود.

کدام روش را انتخاب کنیم؟

نوع پژوهش روش پیشنهادی
توصیفی و برآورد نسبت کوکران یا جدول مورگان
مقایسه گروه‌ها و آزمون فرضیه تحلیل توان با G*Power
همبستگی و رگرسیون تحلیل توان بر اساس تعداد پیش‌بین‌ها
معادلات ساختاری قواعد ویژه SEM به‌همراه تحلیل توان

در عمل توصیه می‌شود حجم نمونه محاسبه‌شده را حدود ۱۰ تا ۲۰ درصد افزایش دهید تا ریزش پاسخ‌دهندگان و پرسشنامه‌های ناقص جبران شود.

جمع‌بندی

  • حجم نمونه باید محاسبه‌شده و قابل دفاع باشد، نه بر اساس عرف.
  • کوکران و مورگان برای پژوهش‌های توصیفی مناسب‌اند.
  • برای آزمون فرضیه، تحلیل توان با G*Power دقیق‌ترین روش است.
  • توان ۰٫۸ و آلفای ۰٫۰۵ استاندارد رایج محاسبه است.
  • برای جبران ریزش، حجم محاسبه‌شده را کمی افزایش دهید.