آمار و سواد داده (Statistics and Data Literacy)
همون چندتا ایدهای که لازم داری تا عددهای خبرها و گزارشها رو بخونی و گول نخوری، هر کدوم با یه نمودار متحرک که قدمبهقدم جلو میبری.
برای هر کسی که خبر و گزارش و تیتر سلامت میخونه و میخواد بدونه به کدوم عدد اعتماد کنه. نه فرمولی برای حفظ کردن داره، نه نرمافزاری: هر درس یه نمودار متحرک داره که قدمبهقدم جلو میبری و روی یه مثال کوچیک و ملموس ساخته شده. اول میبینی یه میانگین چی رو قایم میکنه و پراکندگی و منحنی زنگولهای بقیهش رو چطور نشون میدن، بعد میفهمی چطور نظرسنجی از هزار نفر میتونه حرف میلیونها نفر رو بزنه و چرا بالا رفتن همزمان دو چیز ثابت نمیکنه یکی باعث اون یکیه، و بعد با تلههای معروف آشنا میشی: نرخ پایهای که نادیده گرفته میشه، درصدی که با واحد درصد قاطی میشه، و نمودارهایی که محورشون بریده شده. آخرش مقدار p و یه پژوهش رو به زبون ساده میخونی و یه تیتر واقعی رو از یه چکلیست کوتاهِ خودت رد میکنی.
آخرش میتونی
- برای یه عدد واقعی بین میانگین، میانه و مد انتخاب کنی و بگی پراکندگی و منحنی زنگولهای چی بهش اضافه میکنن
- توضیح بدی چطور یه نمونهی تصادفی و حاشیهی خطاش باعث میشن نظرسنجی از حدود هزار نفر حرف یه کشور رو بزنه
- تلههای معروف رو تشخیص بدی: همبستگیای که جای علیت جا زده میشه، نرخ پایهی فراموششده، قاطی کردن درصد با واحد درصد، و نمودارهای گمراهکننده
- مقدار p و یه پژوهش رو به زبون ساده بخونی و یه تیتر خبری رو با یه فهرست کوتاه از سؤالها بسنجی
توصیف دادهها
- میانگین، میانه و مد: سه جور «معدل» (Mean, Median, Mode)
سه راه درست برای گفتن اینکه چی معمولیه، و اینکه چرا یه عدد خیلی بزرگ میتونه میانگین رو از جایی که بیشتر آدمها هستن خیلی دور کنه.
- پراکندگی: چیزی که میانگین نمیگه (Spread)
دو جا با میانگین دمای یکسان میتونن اصلاً شبیه هم نباشن؛ دامنه و انحراف معیار نشون میدن عددها چقدر از وسط دور میشن.
- منحنی زنگولهای (The Normal Curve)
چرا اینهمه اندازهگیری به شکل زنگوله روی هم جمع میشن، و قاعدهی ۶۸-۹۵-۹۹٫۷ که میگه یه عدد چقدر غیرعادیه.
از چند نفر به همه
- نمونهگیری: چشیدن سوپ (Sampling)
چطور یه نمونهی تصادفی کوچیک میتونه میلیونها نفر رو توصیف کنه، و چرا یه نمونهی خیلی بزرگ که غلط انتخاب شده نمیتونه.
- حاشیهی خطا: همون بهعلاوهمنهای (Margin of Error)
«۵۲ درصد، بهعلاوهمنهای ۳» واقعاً یعنی چی، چرا هزار نفر معمولاً کافیه، و کی جلو بودن تو یه نظرسنجی اصلاً جلو بودن نیست.
- همبستگی، علیت نیست (Correlation vs Causation)
با هم بالا رفتن دو چیز میتونه یعنی یکی باعث اون یکیه، یا برعکس، یا یه علت پنهان سوم، یا فقط تصادف؛ اینجا یاد میگیری چطور تشخیص بدی.
عددهایی که گمراه میکنن
- نرخ پایه: عددی که همه یادشون میره (Base Rates)
چرا جواب مثبت یه آزمایش «۹۰ درصد دقیق» هنوز میتونه یعنی احتمالاً سالمی؛ روی یه جدول هزارنفره حسابش میکنیم.
- درصد یا واحد درصد؟ خطر نسبی و مطلق (Percentage Points)
رفتن از ۲ درصد به ۳ درصد یه واحد درصده ولی ۵۰ درصد افزایش؛ یاد بگیر بفهمی تیتر از کدوم استفاده کرده و عددهای واقعی رو بخوای.
- نمودارهایی که گمراه میکنن (Misleading Charts)
محورهای بریده، مقیاسهای کشاومده، تاریخهای دستچین و تصویرهایی که از دو طرف بزرگ میشن: چطور یه عدد درست رو میشه طوری کشید که یه داستان غلط تعریف کنه.
خوندن شواهد
- مقدار p به زبون ساده (P-values)
مقدار p فقط یه سؤال میپرسه: اگه هیچ خبری نبود، این نتیجه چقدر عجیب بود؟ و جواب سؤالهایی که معمولاً فکر میکنن رو نمیده.
- خوندن یه پژوهش (Reading a Study)
کارآزمایی تصادفی، مطالعهی مشاهدهای و هرچی این وسطه: چی یه پژوهش رو محکم میکنه، و نشونههای هشدار تو گزارش شدنش.
- جمعبندی: خوندن یه تیتر (Reading a Headline)
یه تیتر واقعینما رو با کل این دوره از هم باز میکنیم: کدوم میانگین، چه نمونهای، چه نوع پژوهشی، نسبی یا مطلق، و چطور کشیده شده.
فقط نخونش، نگهش دار
پثوایز هر ایده رو درست قبل از اینکه فراموشش کنی با یه سؤال کوتاه برمیگردونه. رایگان روی اندروید و وب، به فارسی و انگلیسی.