انتخاب درست آزمون
از سؤال پژوهش شروع میکنیم و پیش از هر محاسبه مطمئن میشویم این آزمون با داده و طراحی مطالعه سازگار است.
استقلال سطر و ستون جدول توافقی را با محاسبه دقیق احتمال جدولها بررسی میکند.
در این راهنما، آزمون دقیق فیشر ابتدا با زبان ساده و سپس با جزئیات فنی، مثال، اندازه اثر و شیوه گزارش بررسی میشود.
سؤال مناسب باید جامعه، متغیرها و نوع مقایسه یا رابطه را روشن کند.
- نمونه درست: آیا رخداد عارضه نادر در دو درمان متفاوت است، وقتی بعضی خانهها تعداد بسیار کمی دارند؟
- نمونه نامناسب: آیا میانگین پیامد دو گروه متفاوت است؟ فیشر فقط برای شمارشهای طبقهای است.
پیش از انتخاب آزمون این چهار تصمیم را بهترتیب کنترل کنید.
- ۱هدف پژوهش را به مقایسه، رابطه یا سنجش پایایی تبدیل کنید.
- ۲ساختار متغیرها را مشخص کنید: دو متغیر طبقهای؛ کاربرد کلاسیک جدول ۲×۲ با فراوانی واقعی است.
- ۳مستقل یا وابسته بودن مشاهدهها را از طراحی مطالعه تشخیص دهید.
- ۴مفروضهها و گزینههای جایگزین را پیش از دیدن مقدار p بررسی کنید.
دو متغیر طبقهای؛ کاربرد کلاسیک جدول ۲×۲ با فراوانی واقعی است.
واحد تحلیل میتواند فرد، محصول، شرکت یا رخداد باشد. تعریف آن باید در روش پژوهش نوشته شود و با هر سطر فایل داده تطابق داشته باشد.
- جدول ۲×۲ و نمونه کوچک است.
- فراوانیهای مورد انتظار برای تقریب مربع کای کماند.
- احتمال دقیق یا شرطی مدنظر است.
- داده زوجی دوحالتی است؛ مکنمار لازم است.
- ورودی فقط درصد است و تعداد واقعی ندارید.
- طرح نمونهگیری پیچیده یا خوشهای است.
آمادهسازی داده و مفروضهها
فایل داده را به شکل قابل تحلیل میسازیم، خطاهای کدگذاری را مییابیم و مفروضههای آزمون را کنترل میکنیم.
هر سطر یک واحد تحلیل و هر ستون یک متغیر است. نام ستونها کوتاه، یکتا و بدون سلول ادغامشده باشد.
- group: گروه
- outcome: رخداد/عدم رخداد
برای هر ستون، تعریف، مقیاس، کدهای مجاز و شیوه نمایش داده گمشده را ثبت کنید. جهت گویهها یا ترتیب گروهها باید پیش از تحلیل روشن باشد.
- شناسهها باید یکتا باشند.
- املای طبقات را یکسان کنید.
- کدهای ویژه مانند ۹۹ را از مقدار واقعی جدا نگه دارید.
تعداد و درصد داده گمشده را برای متغیرهای اصلی گزارش کنید. حذف خودکار سطرها میتواند حجم نمونه و ترکیب گروهها را تغییر دهد.
مفروضهها ویژگی طراحی و دادهاند و با یک آزمون جانبی بهتنهایی تأیید نمیشوند.
- استقلال مشاهدهها
- خانههای mutually exclusive
- ورودی بهصورت شمارش واقعی
- تعریف روشن جهت و حاشیههای جدول
جدول فراوانی، درصدهای سطری، صفر بودن خانهها و تعریف جهت نسبت شانس.
نمودار باید قبل از نتیجه آزمون دیده شود؛ یک مقدار پرت میتواند هم آماره و هم تفسیر علمی را تغییر دهد.
حجم نمونه را بر اساس اندازه اثر مورد انتظار، سطح خطا، توان و طراحی مطالعه تعیین کنید. معنیداری آزمون روی داده نهایی جای محاسبه توان پیشینی را نمیگیرد.
- ۱تعداد سطرها و شناسههای تکراری را کنترل کنید.
- ۲توصیف متغیرها و گروهها را ببینید.
- ۳داده گمشده و نقاط پرت را بررسی کنید.
- ۴مفروضههای مرتبط را ثبت کنید.
- ۵آزمون اصلی و تحلیل حساسیت را پیش از نتیجه مشخص کنید.
محاسبه و تفسیر نتیجه
با یک مثال، فرضها، آماره، مقدار p، اندازه اثر و محدودیتهای استنباط را مرحلهبهمرحله میخوانیم.
فرضها درباره جامعه آماری نوشته میشوند و باید پیش از مشاهده نتیجه روشن باشند.
سطر و ستون مستقلاند؛ در ۲×۲ نسبت شانس شرطی برابر یک است.
بین سطر و ستون ارتباط وجود دارد؛ نسبت شانس با یک متفاوت است.
درمان A: دو عارضه از ۱۲ نفر؛ درمان B: هشت عارضه از ۱۲ نفر. جدول ۲×۲ تشکیل میشود.
ابتدا آمار توصیفی، تعداد مشاهده معتبر و نمودار مناسب را تهیه کنید؛ سپس آزمون استنباطی را اجرا کنید.
p دقیق از مجموع احتمال جدولهای هماندازه یا افراطیتر تحت حاشیههای ثابت ساخته میشود؛ تعریف دوطرفه ممکن است بین نرمافزارها تفاوت ظریفی داشته باشد.
آزمون دقیق فیشر درجه آزادی گزارش نمیکند.
درجه آزادی باید همراه آماره گزارش شود، مگر روش انتخابی ذاتاً درجه آزادی کلاسیک نداشته باشد.
مقدار p احتمال مشاهده نتیجهای دستکم به این شدت است، به شرط درست بودن فرض صفر و مفروضههای تحلیل.
- p احتمال درست بودن فرض صفر نیست.
- p شدت یا اهمیت عملی نتیجه نیست.
- تصمیم علمی نباید فقط به عبور از مرز ۰٫۰۵ وابسته باشد.
شاخص پیشنهادی برای این تحلیل: نسبت شانس (OR) و فاصله اطمینان آن. اندازه اثر باید با زمینه تخصصی و فاصله اطمینان تفسیر شود.
برای جدول ۲×۲ پسآزمون لازم نیست؛ در جدول بزرگتر مقایسههای برنامهریزیشده نیازمند تعدیلاند.
تحلیل جایگزین یا حساسیت: مربع کای برای نمونه کافی؛ مکنمار برای زوجها؛ رگرسیون لجستیک دقیق یا penalized برای کنترل متغیرها.
معنیداری آماری بهتنهایی علت و معلول را ثابت نمیکند. طرح پژوهش، تقدم زمانی، انتخاب نمونه و متغیرهای مخدوشگر تعیین میکنند چه استنباطی مجاز است.
اجرا در نرمافزار و گزارش علمی
مسیر اجرا در ابزارهای رایج، کد بازتولیدپذیر و یک متن آماده برای گزارش نتیجه ارائه میشود.
- ۱جدول ۲×۲ شمارش واقعی را بسازید.
- ۲نسبت شانس را با ad/bc محاسبه کنید.
- ۳Excel تابع داخلی کامل برای p دقیق فیشر ندارد.
- ۴برای p دقیق از SPSS، R، Python یا نرمافزار آنلاین معتبر استفاده کنید.
- ۱Analyze ← Descriptive Statistics ← Crosstabs
- ۲دو متغیر را در Row و Column قرار دهید.
- ۳Statistics: Chi-square و Risk؛ Exact: Fisher را فعال کنید.
- ۴p دقیق، OR، فاصله اطمینان و درصدها را گزارش کنید.
نام ستونها را با فایل خود تطبیق دهید و خروجی، نسخه R و تصمیمهای پیشپردازش را ذخیره کنید.
tab <- table(data$group, data$outcome)
fit <- fisher.test(tab, conf.int = TRUE)
fitپیش از اجرا، آرایهها یا DataFrame را از نظر داده گمشده، نوع ستون و تعداد مشاهده کنترل کنید.
from scipy import stats
result = stats.fisher_exact([[2, 10], [8, 4]])
print(result.statistic, result.pvalue)مربع کای برای نمونه کافی؛ مکنمار برای زوجها؛ رگرسیون لجستیک دقیق یا penalized برای کنترل متغیرها.
اعداد و عبارتهای جایخالی را با خروجی واقعی جایگزین کنید و آمار توصیفی را کنار آزمون بیاورید.
بین نوع درمان و عارضه ارتباط مشاهده شد/نشد، Fisher’s exact p=…، OR=…، 95% CI […]؛ درصد عارضه در گروهها … و … بود.
- سؤال، جامعه و واحد تحلیل روشن است.
- فایل داده و کدگذاری کنترل شده است.
- مفروضهها و محدودیتها گزارش شدهاند.
- آماره، مقدار p و حجم نمونه درج شدهاند.
- اندازه اثر نسبت شانس (OR) و فاصله اطمینان آن گزارش شده است.
- فاصله اطمینان و آمار توصیفی آمدهاند.
- کد یا Syntax تحلیل نگهداری شده است.
- نتیجه فراتر از طراحی مطالعه تفسیر نشده است.
پاسخ کوتاه به ابهامهای رایج
آزمون دقیق فیشر چه زمانی مناسب است؟
جدول ۲×۲ و نمونه کوچک است. فراوانیهای مورد انتظار برای تقریب مربع کای کماند. احتمال دقیق یا شرطی مدنظر است.
مهمترین مفروضههای آزمون دقیق فیشر چیست؟
استقلال مشاهدهها؛ خانههای mutually exclusive؛ ورودی بهصورت شمارش واقعی؛ تعریف روشن جهت و حاشیههای جدول
آیا مقدار p شدت نتیجه را نشان میدهد؟
خیر. برای شدت نتیجه از نسبت شانس (OR) و فاصله اطمینان آن و فاصله اطمینان استفاده کنید.
اگر مفروضهها برقرار نباشند چه کنیم؟
مربع کای برای نمونه کافی؛ مکنمار برای زوجها؛ رگرسیون لجستیک دقیق یا penalized برای کنترل متغیرها.
در گزارش علمی چه بنویسیم؟
آمار توصیفی، آماره آزمون، حجم نمونه، مقدار p، اندازه اثر، فاصله اطمینان و محدودیتهای تحلیل را کنار هم گزارش کنید.
منابع علمی و مستندات نرمافزار
ارجاعهای داخل متن با شمارههای زیر تطبیق دارند.
آیا این راهنما برای تحلیل شما مفید بود؟
بازخورد شما به دقیقتر شدن نسخههای بعدی این مقاله کمک میکند.

