epony כתב:טוב מסכן שלי, אני אחסוך לך את תיאוריות הקונספירציה ואת ההתלהמות וההעלבות, ואני אפנה אותך ספציפית למחקרים הרלוונטיים
...
אה, ועוד משהו לסיום לגבי התלונות חסרות הבסיס שלך לגבי מיעוט תצפיות בחלק מהקישורים:
- המינימום להסקה סטטיסטית ברמת מובהקות מקובלת הוא 30 תצפיות. לומדים את זה בשיעור הראשון על מדגמים, בערך חודש וחצי לתוך קורס המבוא לסטטיסטיקה בכל תואר ראשון שכולל קורס כזה (שזה כמעט כל תואר שנלמד היום באוניברסיטה, מלבד אולי משפטים ומדעי הרוח...)
- בנוסף, אם יש 7 נסיינים, אבל מבצעים 10 איטרציות, אזי אוספים 70 תצפיות (לדוגמה: http://www.nousaine.com/pdfs/To%20Tweak%20or%20Not.pdf) - למותר לציין שבמקרה כזה התוצאות בהחלט מאפשרות הסקה סטטיסטית ברמת מובהקות מקובלת
- יתר על כן, האמור לעיל רלוונטי לגבי הסקה מדגימה בודדת, אבל מקובל לערוך מטה-אנליזות המאגדות מחקרים רבים הנשענים על מתודולוגיות דומות ולסכום את סך התוצאות שלהם. אם נעשה זאת על כל המבחנים הקטנים מתוך 48 הקישורים לעיל, נקבל אלפי תצפיות ונוכל להסיק ברמת ביטחון גבוהה לגבי מהימנות ומובהקות הפערים שבין מבחנים עיוורים ו/או מבחני ABX, לבין מבחנים סובייקטיביים.
- חשוב לציין שלמרות שמבחינה סטטיסטית מגיעים למובהקות מקובלת של התוצאות החל מ-30 תצפיות, אפשר להתחיל לבצע תחזיות סבירות החל מ-5 תצפיות ומעלה, וטובות החל מ-10 תצפיות...
מן הסתם יכולת גם לדלג ישר למסקנות של הפוסט המקורי, ולא להפסיד יותר מדי:
...
די מגעילה כל הסביבה פה, לא בדיוק לעניין לדיון מדעי, החל ב"מסכן שלי", וכל הסגנון המתנשא, דרך זה שאנשים פה יודעים בדיוק מה מטרותי ואם אני כן/לא זקוק להוכחות, וכלה בזה שכבר הפכו אותנו ל"יריבים" ומנסים לסכסך.
אז בסתימת אף אולי אפשר להמשיך, אבל כדאי שנתחיל לפחות במה מוסכם ומה לא, כדי להגיע לאיזשהו בסיס משותף לדיון.
ראשית, מוסכם שמינימום סביר למדגם הוא סדר גודל של 30 משתתפים. עם זאת, אם אותם משתתפים לא הוכיחו עצמם כבעלי יכולת הבחנה, אין טעם להמשיך ולחפור בעוד ועוד דגימות שמבוססות עליהם.
לפיכך, ניסויים עם פחות מ-30 משתתפים נראים לי לא רלוואנטיים, לא משנה כמה שאלות שאלו אותם, ואיך מתקשקשים עם הסטאטיסטיקות כדי לסחוט מהם יותר ממה שהם מסוגלים לתת.
בנוסף, מבחנים עם מתודולוגיות בעייתיות הם גרועים אפילו יותר ממבחנים תקינים עם מעט משתתפים, שכן הם עלולים להוביל למסקנות בעייתיות עד לא-לעניין בכלל.
למשל באחד הניסויים רצו לעקוף את העניין שהמשתתפים מרגישים בבחינה, ואז שאלו אותם לא אם יש/אין הבדלים, אלא איזה מערכת הם מעדיפים. זה נראה תמים ואפילו חכם, אלא שבהחלט ייתכן מצב שבו מישהו מבחין בהבדלים, ומעדיף דבר אחד במערכת ראשונה ואחר בשנייה, כך שאין לו העדפה, אבל זה נספר כאילו הוא לא מבחין!
בטוח שאפשר לעשות מטא-אנאליזות כמה שרוצים, אבל אם עושים את זה על מחקרים דפוקים, מקבלים מטא/מגה שטויות.
מוסכם שייש אנשים שמוטים קשות ע"י סוגסטיות למיניהן במבחנים נראים (לא עיוורים), ורבים מהם מנפחים את ההבדלים הקטנים ביותר, אם הם בכלל קיימים, לכדי "יום ולילה" ו"אי אפשר להשוות", ובשמחה יתארו לך איך במערכת אחת הכל ערפל ובשנייה אפשר לשמוע במדוייק את ההחזרים מכיסא 14 בשורה 19 באולם. מבחינתי הייה עדיף בכלל לא לכלול כאלה.
======================
בשלב זה של הכתיבה נרדמתי

, וכשהתעוררתי, מצאתי תגובות בסגנון הבא:
epony כתב:זה לא בשבילו, זה בשבילי... עכשיו שיכללתי תגובה לכל מי שיבקש לחפור בנושא הזה שוב (ושנינו יודעים שזה רק עניין של זמן...)

...
tnsilver כתב:סבלנות... סבלנות... החג עוד לא הסתיים, המילה האחרונה עוד לא נאמרה, ההשפלה השנונה האחרונה עוד לא יצאה אל הפועל, ארון התרופות פתוח לרווחה, הבקבוקונים ריקים ותגובה - בוא תבוא.
...
נראה לי שזה מראה באופן חדמשמעי מהי מהות ה"דיון המדעי" כאן, ואם מי יש לי עסק.
עכשיו כבר ברור מעל לכל ספק סביר של"יריבי" (נכון מילולית, מסתבר), אין עניין בהוכחות ו/או בדיון, אלא בביריונות ובהשפלות.
אני בכל זאת משאיר את מה שהתחלתי לכתוב, רק כדי להראות שסיבת עזיבתי אינה בריחה מפני הטיעונים (שברובם רדודים לחלוטין), אלא חוסר רצון להתעסק אתכם.
בבחילה עמוקה (גם אם היא "תעלה לי" בהרחקה -- לא כל כך מצער, בהתחשב בנסיבות),
עמיר