جامعه، نمونه و خطای معیار
چرا از چند ده نفر میتوان دربارهی هزاران نفر نتیجه گرفت
تفاوت جامعه و نمونه، میانگین و واریانس، و اینکه خطای معیار چگونه دقت برآورد ما را اندازه میگیرد.
1.1جامعه و نمونه
جامعهی آماری همهی واحدهایی است که نتیجهی پژوهش قرار است دربارهی آنها صدق کند، مثلا همهی بیماران مبتلا به یک بیماری خاص در کشور. نمونه زیرمجموعهای از جامعه است که واقعا آن را مشاهده و اندازهگیری میکنیم. هدف آمار استنباطی این است که از روی نمونه، دربارهی جامعه با میزان مشخصی از عدم قطعیت قضاوت کنیم.
پارامترها ویژگیهای جامعه هستند و معمولا با حروف یونانی نوشته میشوند: میانگین جامعه و انحراف معیار جامعه . آمارهها همان ویژگیها روی نمونه هستند: میانگین نمونه و انحراف معیار نمونه . آمارهها را میشناسیم، پارامترها را برآورد میکنیم.
1.2میانگین، واریانس و انحراف معیار
میانگین مرکز دادهها را نشان میدهد و واریانس پراکندگی آنها را. انحراف معیار جذر واریانس است و همان واحد دادهها را دارد، برای همین تفسیرش سادهتر است.
- 1دادهها: میلیمتر جیوه
- 2میانگین:
- 3مجموع مربعات انحراف:
- 4واریانس: و انحراف معیار
میانگین ۱۲۴ با انحراف معیار حدود ۴.۵؛ یعنی بیشتر افراد در فاصلهی حدود ۱۲۰ تا ۱۲۸ قرار دارند.
1.3توزیع نمونهگیری و خطای معیار
اگر مطالعه را بارها تکرار کنیم و هر بار میانگین نمونه را حساب کنیم، این میانگینها خودشان یک توزیع دارند که به آن توزیع نمونهگیری میگویند. انحراف معیار این توزیع، خطای معیار میانگین است و میگوید برآورد ما از چقدر میتواند از نمونهای به نمونهی دیگر جابهجا شود.
قضیهی حد مرکزی میگوید با بزرگ شدن ، توزیع نمونهگیری میانگین تقریبا نرمال میشود حتی اگر خود دادهها نرمال نباشند. همین قضیه پایهی فاصلههای اطمینان و آزمونهای فرض درس چهارم است.
- 1انحراف معیار مشاهدهشده
- 2با :
- 3با :
با چهار برابر شدن نمونه، خطای معیار از ۱.۹ به حدود ۰.۹۵ رسید. دقت دو برابر شد، نه چهار برابر.
خلاصهی درس
- پارامتر مال جامعه است و آماره مال نمونه؛ ما با آمارهها پارامترها را برآورد میکنیم.
- انحراف معیار پراکندگی افراد را نشان میدهد، خطای معیار دقت برآورد میانگین را.
- خطای معیار با جذر حجم نمونه کوچک میشود، پس دقت هزینهی مربعی دارد.