חלק א: מחקר ונתונים · פרק 4
מהשאלה אל המחקר
כל ניתוח סטטיסטי מתחיל הרבה לפני התוכנה: בשאלה. בפרק הזה נעבור את מעגל המחקר, נלמד מה הופך שאלה לשאלת מחקרResearch question טובה, ונלמד לנסח השערות שאפשר לבדוק בנתונים.
"האם תוכנית קשיבות טובה לילדים?" האם זו שאלת מחקר?
היא נשמעת כמו שאלת מחקר, אבל כמעט אי אפשר לבדוק אותה כמו שהיא. טובה למה? לאילו ילדים? איך נדע? בסוף הפרק תדעו להפוך אותה לשאלה שאפשר לענות עליה, ולהשערה שאפשר לבדוק.
בסוף הפרק תוכלו
- לתאר את שישת השלבים של מעגל המחקר, ולהסביר למה הניתוח נבחר עוד בשלב התכנון.
- להבחין בין שאלה כללית לשאלת מחקר טובה.
- לנסח השערת מחקרResearch hypothesis והשערת אפסNull hypothesis, ולזהות את סוג ההשערה: הבדל, קשר, ניבוי או אינטראקציהInteraction.
- להבחין בין השערה חד־צדדיתOne-tailed hypothesis / test לדו־צדדית, ולדעת איך מנתחים כל אחת.
מעגל המחקר
שאלה ← השערות ← מערך ומדגם ← מדידה ואיסוף ← ניתוח ← דיווח ופרשנות, ומשם לשאלה הבאה. את הניתוח בוחרים כבר בשלב התכנון.
מחקר כמותי עובר שישה שלבים, תמיד באותו סדר:
- שאלת מחקר: מה רוצים לדעת.
- השערות: מה אנחנו מצפים למצוא, ולמה.
- מערך ומדגם: את מי חוקרים, ואיך: ניסויExperiment, או מחקר שבו רק מודדים (פרק 7).
- מדידה ואיסוף נתונים: באילו כלים, למשל שאלונים או מבחנים.
- ניתוח: המבחנים הסטטיסטיים, שהם רוב הספר הזה.
- דיווח ופרשנות: מה מצאנו, מה זה אומר, ומה עוד לא ידוע.
אחרי השלב השישי חוזרים להתחלה: כל מחקר טוב מסתיים בשאלות חדשות. לכן מדברים על מעגל המחקר.
ושימו לב לשלב החמישי. חוקר טוב יודע איזה ניתוח יריץ עוד לפני שאסף נתון אחד. סוג השאלה, המערך וסולמות המדידה כבר קובעים את הניתוח. ולמה זה חשוב? כי אם מנסים מספיק ניתוחים, משהו ייצא מובהק במקרה. מי שבוחר את הניתוח אחרי שראה את הנתונים, בוחר בלי לשים לב את הניתוח שנותן את התוצאה שרצה.
| שלב | במחקר של Tarrasch ו־Berger |
|---|---|
| שאלה | האם תוכנית קשיבות וחמלה משפרת את מצבם של תלמידים כשרק המורות מתאמנות (גישה עקיפה), וכשהמורות והתלמידים מתאמנים יחד (גישה משולבת)? ואיזו מהגישות טובה יותר? |
| השערות | בשתי התוכניות, ולא בקבוצת הביקורת, יעלו שביעות הרצון והקשיבות, וירדו החרדה, בעיות הקשב והתלונות הגופניות. בתוכנית המשולבת השיפור יהיה גדול יותר, והוא יישמר גם חצי שנה אחרי התוכנית. |
| מערך ומדגם | 200 תלמידים בכיתות ד׳ ו־ה׳, בשלושה בתי ספר: תוכנית עקיפה, תוכנית משולבת וביקורת. שלוש מדידות: לפני, אחרי, ומעקב. על המערך המדויק, ועל מה שהוא מאפשר להסיק, נדבר בפרק 7. |
| מדידה | שבעה שאלונים שכבר שימשו בעברית, ומדד התנהגותי אחד: האם התלמידים התנדבו לעזור. |
| ניתוח | במאמר: מודל ליניארי היררכי (פרק 36). בספר: מבחני t, ניתוח שונות וניתוח למדידות חוזרות (פרקים 21, 26, 27 ו־35).One-way ANOVA |
| דיווח | בסגנון APA (פרק 33). |
בדקו את עצמכם4 שאלות
1.מה השלב שבא מיד אחרי ניסוח ההשערות במעגל המחקר?
2.ההחלטה למדוד חרדה בשאלון של 8 פריטים, מ־1 עד 4, שייכת לאיזה שלב?
3.חוקר אסף נתונים על 40 משתנים, הריץ עשרות ניתוחים, ודיווח רק על הניתוח שיצא מובהק. מה הבעיה?
4.מחקר מצא שתוכנית הקשיבות הורידה את החרדה, אבל רק בכיתות ה׳. איך המחקר הזה ממשיך את מעגל המחקר?
שאלת מחקר טובה
שאלת מחקר טובה היא אמפירית (אפשר לענות עליה בנתונים), ממוקדת (לא רחבה מדי ולא צרה מדי), מגדירה את המשתנים ואת האוכלוסייה, ונשענת על מה שכבר ידוע.
שאלת הפתיחה, "האם תוכנית קשיבות טובה לילדים?", היא שאלה מעניינת. אבל כדי שתהיה שאלת מחקר, היא צריכה לעבור כמה מבחנים:
- אמפירית: אפשר לענות עליה באיסוף נתונים. "האם לילדים יש נשמה?" היא שאלה מעניינת, אבל לא אמפירית.
- לא כללית מדי: "מה משפיע על תלמידים?" רחבה כל כך שאי אפשר לתכנן לה מחקר.
- לא צרה מדי: "האם דני מכיתה ה׳2 נרגע אחרי תרגיל נשימה אחד?" עונה על שאלה של ילד אחד ברגע אחד. ממנה לא נלמד דבר על ילדים אחרים.
- מגדירה את המשתנים: במקום "טובה", אומרים מה מודדים: חרדה, קשיבות, שביעות רצון מהחיים.
- מגדירה את האוכלוסייה: במקום "ילדים", תלמידי בית ספר יסודי, כיתות ד׳ ו־ה׳.
- נשענת על ידע קודם: מחקרים קודמים ותיאוריה מסבירים למה מצפים למצוא משהו.
אחרי התיקון, שאלת הפתיחה הופכת ל: "האם תוכנית קשיבות בכיתה מפחיתה את החרדה של תלמידי כיתות ד׳ ו־ה׳?" זו שאלה שאפשר לתכנן לה מחקר.
בדקו את עצמכם3 שאלות
1."האם צריך לבטל את שיעורי הבית?" באיזה מבחן של שאלת מחקר טובה השאלה הזו נכשלת קודם כול?
2."האם תוכנית הקשיבות מפחיתה את החרדה?" מה חסר בשאלה הזו?
3.הפכו לשאלת מחקר טובה את השאלה: "האם הפסקות טובות לתלמידים?"
השערות: מה מצפים למצוא
השערת המחקר () אומרת שיש הבדל או קשר. השערת האפס () אומרת שאין. ההשערות הן תמיד על האוכלוסייה, ובודקים דווקא את השערת האפס.
השערה היא תשובה צפויה לשאלת המחקר, שמבוססת על תיאוריה או על מחקרים קודמים. לכל שאלה יש שתי השערות:
- השערת המחקר, : מה שהחוקר מצפה למצוא. למשל: "החרדה בכיתות התוכנית נמוכה מהחרדה בכיתות הביקורת."
- השערת האפס, : ההפך. "אין הבדל", או "אין קשר". "העולם כמנהגו נוהג". אני קורא לה "השערת סבתא": שום דבר לא השתנה, הכול נשאר כמו שהיה.
שני דברים מפתיעים בהשערות. הראשון: ההשערות הן תמיד על האוכלוסייה, אף פעם לא על המדגם. על המדגם אין מה לשער: אנחנו פשוט רואים אותו. לכן ההשערות נכתבות בסמלים של האוכלוסייה, כמו , הממוצע באוכלוסייה.
השני: בודקים דווקא את השערת האפס. מניחים שאין הבדל, ושואלים: האם הנתונים שלנו סבירים בעולם כזה? אם הם מאוד לא סבירים, דוחים את השערת האפס. את ההיגיון הזה נלמד לעומק בפרק 18. כאן מספיק לדעת לנסח את שתי ההשערות.
ומכאן גם הזהירות במילים. מה שהחוקרים רוצים לומר לעולם הוא "השערת המחקר נכונה: התוכנית עובדת". אבל את זה אי אפשר לומר, לא מעשית ולא פילוסופית. אפשר רק להפריך: לומר שהשערת האפס כנראה לא נכונה, ברמת ביטחוןConfidence level מסוימת. ולכן כשכותרת בעיתון אומרת "חוקרים הוכיחו", היא אומרת יותר ממה שמחקר יכול לומר. וגם בכיוון ההפוך: כשהתוצאה לא מובהקת, לא "מקבלים" את השערת האפס. אומרים שלא דחינו אותה.
כמעט כל שאלה סטטיסטית שייכת לאחת משתי משפחות: האם יש הבדל בין קבוצות, או האם יש קשר בין משתנים. ואחת מהן מכילה את השנייה. "האם בנות חרדות יותר מבנים?" היא שאלת הבדל. אבל אפשר לנסח אותה גם כך: "האם יש קשר בין מגדר לחרדה?" שאלת הקשר כללית יותר. ולכן נגלה בהמשך הספר שכל משפחת ניתוחי השונות, שבודקים הבדלים, היא בעצם חלק ממשפחת הרגרסיה, שבודקת קשרים (פרק 30).
ארבעה סוגי השערות
סוג ההשערה, יחד עם סולם המדידה של המשתנים (פרק 6), קובע את הניתוח. זו בעצם מפת הדרכים של הספר:
| סוג | דוגמה מהמחקר שלנו | הניתוח |
|---|---|---|
| הבדל | החרדה אחרי התוכנית נמוכה בתוכנית המשולבת מבקבוצת הביקורת | מבחן t, ניתוח שונות (פרקים 21, 26) |
| קשר | ככל שהתלמידים חשים שהמורה זמינה ומקבלת, ההרגשה שלהם בכיתה טובה יותר | מתאם (פרקים 15, 24) |
| ניבוי | הקשיבות והחרדה מנבאות את שביעות הרצון מהחיים | רגרסיה (פרקים 28, 29) |
| אינטראקציה | התוכנית מורידה את החרדה יותר אצל בנות מאצל בנים | ניתוח שונות דו־כיווני, מיתון (פרקים 27, 32)Two-way ANOVA |
בדקו את עצמכם4 שאלות
1."התוכנית המשולבת מעלה את הקשיבות יותר בכיתות ד׳ מאשר בכיתות ה׳." מה סוג ההשערה?
2.במדגם, ממוצע החרדה של 104 הבנות הוא 2.39, ושל 96 הבנים 2.07. איזה מהמשפטים הבאים הוא השערה?
3.התוצאה במחקר לא הייתה מובהקת. מה נכון לכתוב?
4.כתבו בסמלים את H0 ואת H1 לשאלה: "האם יש הבדל בקשיבות בין תלמידי כיתה ד׳ לתלמידי כיתה ה׳?"
חד־צדדית או דו־צדדית?
השערה עם כיוון ("נמוכה מ", "משפרת", "מגדילה") היא חד־צדדית. השערה בלי כיוון ("שונה", "משפיעה", "יש קשר") היא דו־צדדית. ובניתוח, ברירת המחדל היא דו־צדדי.
השערה דו־צדדית אומרת רק שיש הבדל, בלי לומר לאיזה כיוון: "החרדה של בנות שונה מזו של בנים." השערה חד־צדדית אומרת גם את הכיוון: "החרדה של בנות גבוהה מזו של בנים."
איך מזהים? לפי המילים. "משפר", "מגדיל", "מקטין", "גבוה מ", "נמוך מ": חד־צדדית. "שונה", "משפיע", "משנה", "יש קשר": דו־צדדית.
בהשערה חד־צדדית, השערת האפס כוללת גם את הכיוון ההפוך. אם השערת המחקר היא שהתוכנית מורידה חרדה, אז השערת האפס היא שהיא לא מורידה: או שאין הבדל, או שהחרדה דווקא עולה.
השערה עם כיוון, ניתוח דו־צדדי
רוב ההשערות במחקר הן עם כיוון: אף אחד לא בונה תוכנית קשיבות כדי לבדוק אם היא "משנה" את החרדה. ובכל זאת, בספר, כמו ברוב המאמרים, מנתחים דו־צדדי, אלא אם יש סיבה טובה מאוד שלא. למה? כי כשמאמר מדווח ניתוח חד־צדדי, הקוראים חושדים שהתוצאה הייתה גבולית, ושהחוקרים עברו לחד־צדדי רק כדי להגיע למובהקות. ניתוח חד־צדדי מתאים רק כשהכיוון נקבע מראש, לפני איסוף הנתונים, ותוצאה בכיוון ההפוך באמת לא מעניינת אף אחד.
בבדיקת השערות קובעים מראש סף, בדרך כלל 5%, לתוצאות "קיצוניות מדי". בניתוח דו־צדדי ה־5% מתחלקים לשני הצדדים: 2.5% בכל צד. בניתוח חד־צדדי כל ה־5% נמצאים בצד אחד, ולכן קל יותר להגיע אליהם בכיוון הזה. בפועל, ערך pp-value החד־צדדי הוא חצי מהדו־צדדי. תוצאה עם p = .08 דו־צדדי הופכת ל־p = .04 חד־צדדי, וזה בדיוק הפיתוי. נראה את זה במספרים בפרק 18.
ובספרים אחרים: יש ספרים שכותבים את השערת האפס בניתוח חד־צדדי בקיצור, עם סימן שוויון (μ = 70), ולא עם ≥ או ≤. הכוונה זהה: הבדיקה נעשית מול ערך הגבול.
לכל השערה: האם היא חד־צדדית או דו־צדדית? מה סוגה? וכתבו את השערת האפס במילים.
- יש הבדל בחרדה בין בנים לבנות.
- ככל שהתלמידים חרדים יותר, שביעות הרצון שלהם מהחיים נמוכה יותר.
- בעיות הקשב של התלמידים פוחתות מלפני התוכנית לאחריה.
בדיקת התשובה
- דו־צדדית, השערת הבדל. H0: אין הבדל בחרדה בין בנים לבנות.
- חד־צדדית (הכיוון: שלילי), השערת קשר. H0: אין קשר בין חרדה לשביעות רצון, או שהקשר חיוביPositive relationship.
- חד־צדדית, השערת הבדל באותם תלמידים, לפני ואחרי. H0: בעיות הקשב לא פוחתות: לא משתנות, או גדלות.
בדקו את עצמכם4 שאלות
1."תוכנית הקשיבות משנה את שביעות הרצון מהחיים." חד־צדדית או דו־צדדית?
2.השערת המחקר: "ככל שהתלמידים חשים שהמורה זמינה יותר, ההרגשה שלהם בכיתה טובה יותר." מהי השערת האפס?
3.בניתוח דו־צדדי התקבל p = .12, והתוצאה בכיוון שחזו. מה יהיה p בניתוח חד־צדדי?
4.כתבו בסמלים את H1 ואת H0 להשערה: "התוכנית המשולבת מעלה את הקשיבות, לעומת קבוצת הביקורת."
בתוכנה: איפה בוחרים חד־צדדי או דו־צדדי
עוד לא נריץ מבחנים, אבל כדאי לדעת כבר עכשיו שבכל תוכנה ברירת המחדל היא דו־צדדי, ושצריך לבחור במפורש אם רוצים אחרת.
בפונקציות של מבחנים יש ארגומנט בשם tails: 1 לחד־צדדי, 2 לדו־צדדי. למשל =T.TEST(A2:A31, B2:B31, 2, 2). הארגומנט השלישי, 2, הוא "דו־צדדי".
מגרסה 27, טבלאות המבחנים מציגות שתי עמודות: One-Sided p ו־Two-Sided p. קוראים את העמודה שמתאימה להחלטה שקיבלתם מראש. בגרסאות ישנות יותר יש רק Sig. (2-tailed), הדו־צדדי.
בחלון המבחן יש אפשרות Alt. Hypothesis עם שלוש בחירות: שונה (≠), גדול מ (>), וקטן מ (<). ברירת המחדל היא ≠, דו־צדדי. JASP מציין מתחת לטבלה איזו השערה נבדקה.
בדקו את עצמכם3 שאלות
1.באקסל כתוב =T.TEST(A2:A31, B2:B31, 1, 2). מה אומר המספר 1?
tails: 1 לחד־צדדי, 2 לדו־צדדי. כאן נבחר חד־צדדי, וזה לא ברירת המחדל של הספר.1.ב־SPSS 29 הרצתם מבחן t. החלטתם מראש על השערה חד־צדדית, והתוצאה בכיוון שחזיתם. איזו עמודה בטבלת המבחן קוראים?
1.ב־JASP, באפשרות Alt. Hypothesis, סימנתם > Test value. איזה ניתוח בחרתם?
2.טבלת המבחן מציגה p חד־צדדי של .03 ו־p דו־צדדי של .06. החלטתם מראש על ניתוח דו־צדדי. איזה ערך מדווחים?
3.ב־JASP לא שיניתם דבר באפשרות Alt. Hypothesis. איזו השערה נבדקה?
3.בפונקציה T.TEST באקסל, מה כותבים בארגומנט tails לניתוח דו־צדדי, ברירת המחדל של הספר?
3.ב־SPSS 29 הרצתם מבחן t בלי לשנות שום הגדרה. מה תראו בטבלת המבחן?
טעויות נפוצות
- השערה על המדגם. "ממוצע המדגם יהיה נמוך מ־120" אינה השערה: את המדגם רואים. השערה היא על μ.
- בוחרים את הניתוח אחרי שרואים את הנתונים. הניתוח נקבע בתכנון.
- עוברים לחד־צדדי כי התוצאה "כמעט" מובהקת. הכיוון נקבע לפני האיסוף, לא אחריו.
- שוכחים שהשערת האפס החד־צדדית כוללת את הכיוון ההפוך.
בדקו את עצמכם
סיכום
- מעגל המחקר: שאלה, השערות, מערך ומדגם, מדידה, ניתוח, דיווח. הניתוח נבחר בתכנון.
- שאלה טובה: אמפירית, ממוקדת, עם משתנים ואוכלוסייה מוגדרים.
- H1 ו־H0: על האוכלוסייה. בודקים את H0.
- ארבעה סוגים: הבדל, קשר, ניבוי, אינטראקציה. כל סוג מוביל לניתוח אחר.
- חד־צדדית או דו־צדדית לפי המילים. ובניתוח, דו־צדדי כברירת מחדל.
מונחים חדשים
בפרק הבא: המשתנים. מה הם, איזה תפקיד יש לכל משתנה בשאלת המחקר, ומתי מותר לומר שמשהו "גורם" למשהו אחר.