מנסה לגבש החלטה, NAS או דיסקים בודדים
- Amir64
-
- גורו

- תגובות: 10913
- הצטרף: אוגוסט 2012
- נתן תודות: 215 פעמים
- קיבל תודות: 1941 פעמים
@Nemesis
בכל מקרה דיסקים רגילים למחשב ול- NAS
הם ברמה של 14^1/10 Non-recoverable read errors.
זה הרבה פחות אמין מ- 15^1/10, ובטח מ- 16^1/10
בכל מקרה דיסקים רגילים למחשב ול- NAS
הם ברמה של 14^1/10 Non-recoverable read errors.
זה הרבה פחות אמין מ- 15^1/10, ובטח מ- 16^1/10
אם זה מעניין אתכם קצת מספרים מעשיים של חברת backblaze לאחסון מידע, שמפיקה דו"ח רבעוני ושנתי על שרידות הדיסקים שהם משתמשים:
https://www.backblaze.com/blog/hard-dri ... r-q1-2018/
במקור נזכרתי בגלל כתבה של עפר מלפני שנתיים:
https://www.hometheater.co.il/article07153.html
https://www.backblaze.com/blog/hard-dri ... r-q1-2018/
במקור נזכרתי בגלל כתבה של עפר מלפני שנתיים:
https://www.hometheater.co.il/article07153.html
- IamEzio
- גורו מחשוב/לינוקס

- תגובות: 6835
- הצטרף: יולי 2010
- מיקום: באר שבע
- נתן תודות: 108 פעמים
- קיבל תודות: 502 פעמים
@rm1
·
כתבתי כבר לא מעט פעמים, כל הבדיקות האלו של Backblaze לא שוות את הביטים שמאחסנים אותם.
הם משתמשים בכוננים ביתיים שלא מיועדים לתנאי העבודה הזאת, הם משווים כוננים מסדרות שונות לגמרי שמיועדות לשימושים שונים לגמרי, קבוצות הנתונים שלהם גם בגדלים שונים, זה טוב ויפה שהם חוסכים עלויות של דיסקים קשיחים, אבל שלא יציגו את ה'נתונים' שלהם כמדוייקים או משקפים משהו מעבר להזייה של לבנות DATA CENTER ולהשתמש בMix הזוי של כוננים לא קשורים למציאות..
https://www.hometheater.co.il/vp2421992#2421992
·
כתבתי כבר לא מעט פעמים, כל הבדיקות האלו של Backblaze לא שוות את הביטים שמאחסנים אותם.
הם משתמשים בכוננים ביתיים שלא מיועדים לתנאי העבודה הזאת, הם משווים כוננים מסדרות שונות לגמרי שמיועדות לשימושים שונים לגמרי, קבוצות הנתונים שלהם גם בגדלים שונים, זה טוב ויפה שהם חוסכים עלויות של דיסקים קשיחים, אבל שלא יציגו את ה'נתונים' שלהם כמדוייקים או משקפים משהו מעבר להזייה של לבנות DATA CENTER ולהשתמש בMix הזוי של כוננים לא קשורים למציאות..
https://www.hometheater.co.il/vp2421992#2421992
- ziv_r
- עורך ראשי HTmag

- תגובות: 46318
- הצטרף: ינואר 2005
- נתן תודות: 1965 פעמים
- קיבל תודות: 5065 פעמים
IamEzio,
Backblaze נתנו הסברים מאוד משכנעים לסיבה שלהם להשתמש בכוננים כאלו. מעבר לזה, הם אחת מחברות ה- Online Bakcup הידידותיות ומאלו שצמחו בצורה גבוהה מאוד ב- 11~ שנים שהם קיימים, הם חיים ונושמים Storage. סביר להניח שהם יודעים מה הם עושים.
Backblaze נתנו הסברים מאוד משכנעים לסיבה שלהם להשתמש בכוננים כאלו. מעבר לזה, הם אחת מחברות ה- Online Bakcup הידידותיות ומאלו שצמחו בצורה גבוהה מאוד ב- 11~ שנים שהם קיימים, הם חיים ונושמים Storage. סביר להניח שהם יודעים מה הם עושים.
למיטב הבנתי אילו נתונים אחרים לגמרי ממה שאנחנו מדברים עליו כאן: אצל Backblaze מדובר על drive failures שקשה לי להאמין שהם מתכוונים ל-URE אחד בודד. הרי בכל פתרון חוץ מבניה מחדש של RAID5/6 ברגע שיש URE פשוט מסמנים את ה-bad sector ואפשר להשתמש בשאר הדיסק בלי בעיה. כמובן שבמיוחד משתמש ביתי שאין לו גיבוי עדכני צריך לראות את זה כנורת אזהרה שאולי הדיסק בדרך לקבר אבל נתקלתי בדיסקים שעוד חיו חיים ארוכים עם מספר מועט של bad sectors.
ממה שאני מבין ברגע שדיסק אחד ב-RAID5 מת ויש אפילו URE אחד בודד באחד הדיסק האחרים אז התהליך נכשל באופן גורף. מומלץ לעשות דברים כמו scrub תקופתי בדיוק בשביל לגלות את ה-URE מבעוד מועד ולמפות אותם כך שהם לא יכשילו תהליך של שיחזור. יש הרבה מידע על זה באינטרנט, לדוגמא:
https://holtstrom.com/michael/blog/post ... lures.html
לגבי RAID 6 אני לא בטוח אבל לכל הפחות זה אומר שאתה צריך 2 URE בשביל להכשיל את התהליך, בתקווה רק 2 URE על אותו "בלוק" של מידע יכשילו את התהליך. בכל מקרה ל-RAID 6 יש בעיות אחרות כמו זה שיכול לקחת זמן מאד ארוך בשביל להתאושש מקריסה (עשרות שעות ויותר).
ממה שאני מבין ברגע שדיסק אחד ב-RAID5 מת ויש אפילו URE אחד בודד באחד הדיסק האחרים אז התהליך נכשל באופן גורף. מומלץ לעשות דברים כמו scrub תקופתי בדיוק בשביל לגלות את ה-URE מבעוד מועד ולמפות אותם כך שהם לא יכשילו תהליך של שיחזור. יש הרבה מידע על זה באינטרנט, לדוגמא:
https://holtstrom.com/michael/blog/post ... lures.html
לגבי RAID 6 אני לא בטוח אבל לכל הפחות זה אומר שאתה צריך 2 URE בשביל להכשיל את התהליך, בתקווה רק 2 URE על אותו "בלוק" של מידע יכשילו את התהליך. בכל מקרה ל-RAID 6 יש בעיות אחרות כמו זה שיכול לקחת זמן מאד ארוך בשביל להתאושש מקריסה (עשרות שעות ויותר).
- Amir64
-
- גורו

- תגובות: 10913
- הצטרף: אוגוסט 2012
- נתן תודות: 215 פעמים
- קיבל תודות: 1941 פעמים
ההסברים שלהם לגבי הסיבות לשימוש בדיסקים לא מתאימים למשימה, לא הופך את הסטטיסטיקה שלהם לאמינה.ziv_r כתב:IamEzio,
Backblaze נתנו הסברים מאוד משכנעים לסיבה שלהם להשתמש בכוננים כאלו....
זה שזה כדאי להם כלכלית, לא אומר שזה גם מייצר סטטיסטיקה אמינה על איכות הדיסקים.
הרי יכולים להיות הרבה דיסקים תקולים, שאם היו עובדים בסביבה לה נועדו, היו ממשיכים לעבוד עוד שנים ללא תקלה.
-
spacedude
- חבר מביא חבר

- תגובות: 3505
- הצטרף: פברואר 2005
- מיקום: מזכרת בתיה
- נתן תודות: 176 פעמים
- קיבל תודות: 160 פעמים
·Gico כתב:מה לגבי פתרון DAS שכולל סוג כלשהו של יתירות, ושיתוף ברשת באמצעות SMB?
המחשב הזה יצטרך לעבוד כל הזמן, אבל לא תהיה מגבלת מהירות רשת לצרכן העיקרי....
אני חושש שלאט לאט אני מתחיל לרדת מזה,
אני עובד עם 18 דיסקים קשיחים ויוצא שאחת לכמה זמן אחד הולך.
גם בנאס זה רק עניין של זמן עד שאחד יפול, עם כשל של דיסק בודד יש סבירות לא נמוכה שכל המערך יפול,
אפילו שהחומרים לא קריטיים עוגמת הנפש לאבד מעל 30 טרה של חומר במכה אחת לא שווה את זה.
אני חושב שאני אמשיך לעבוד באותה צורה.
עם דיסקים של 4טרה ככה שברגע שאיבדתי 4טרה זה לא סוף העולם.
שחר
- ziv_r
- עורך ראשי HTmag

- תגובות: 46318
- הצטרף: ינואר 2005
- נתן תודות: 1965 פעמים
- קיבל תודות: 5065 פעמים
Amir64,
למה שזה לא ייצר סטטיסטיקה אמינה? כיצד אתה יודע שהיא לא אמינה? אתה רואה סטטיסטיקה אחרת אמינה יותר שנעשתה על נפח כזה גבוה של כוננים?
שים לב לפרק "Enterprise versus Consumer Hard Drives" בדוח האחרון שלהם:
https://www.backblaze.com/blog/hard-dri ... or-q2-2018
אחרון, אין קשר בין הדוח הזה לבין נושא השרשור.
למה שזה לא ייצר סטטיסטיקה אמינה? כיצד אתה יודע שהיא לא אמינה? אתה רואה סטטיסטיקה אחרת אמינה יותר שנעשתה על נפח כזה גבוה של כוננים?
שים לב לפרק "Enterprise versus Consumer Hard Drives" בדוח האחרון שלהם:
https://www.backblaze.com/blog/hard-dri ... or-q2-2018
אחרון, אין קשר בין הדוח הזה לבין נושא השרשור.
- Amir64
-
- גורו

- תגובות: 10913
- הצטרף: אוגוסט 2012
- נתן תודות: 215 פעמים
- קיבל תודות: 1941 פעמים
כתבתי בשורה האחרונה למה.ziv_r כתב:Amir64,
למה שזה לא ייצר סטטיסטיקה אמינה? כיצד אתה יודע שהיא לא אמינה? אתה רואה סטטיסטיקה אחרת אמינה יותר שנעשתה על נפח כזה גבוה של כוננים?
שים לב לפרק "Enterprise versus Consumer Hard Drives" בדוח האחרון שלהם:
https://www.backblaze.com/blog/hard-dri ... or-q2-2018
אחרון, אין קשר בין הדוח הזה לבין נושא השרשור....
ואת זה לא אומר אני, אלא חוקרים שבדקו את המתודולוגיות של החברה.
אני עם מספר דומה של דיסקים (19), ועם 50TB של Data, וגם לי יכאב לאבד נתונים של דיסק כלשהו.spacedude כתב:·......
אני חושש שלאט לאט אני מתחיל לרדת מזה,
אני עובד עם 18 דיסקים קשיחים ויוצא שאחת לכמה זמן אחד הולך.
גם בנאס זה רק עניין של זמן עד שאחד יפול, עם כשל של דיסק בודד יש סבירות לא נמוכה שכל המערך יפול,
אפילו שהחומרים לא קריטיים עוגמת הנפש לאבד מעל 30 טרה של חומר במכה אחת לא שווה את זה.
אני חושב שאני אמשיך לעבוד באותה צורה.
עם דיסקים של 4טרה ככה שברגע שאיבדתי 4טרה זה לא סוף העולם....
יש אפשרויות להגן על מערך נתונים בלי לסכן את כולו כפי ש-RAID5 או RAID6 עושים.
הצעתי דרך אחת, אך אני די בטוח שאינה היחידה. מודה שאיני מכיר אחרות כי לא הזדקקתי לחפש כאלה.
·rm1 כתב:@spacedude
·
נראה לי שיש לי פתרון בשבילך שגם יפתור את המהירות וגם את הדרישה לגישה ממחשבים אחרים
מה דעתך להריץ VMware Workstation או VirtualBox על המחשב הראשי שלך?
כבר יש לך מחשב חזק עם הרבה פורטים של SATA שרובם לא בשימוש.
חבר להם דיסקים פנימיים ותנתב אותם למכונה וירטואלית שתרוץ על אותו המחשב.
למכונה הווירטואלית אתה יכול להגדיר חיבור רשת וירטואלי שמגיע ל 10G ואפילו יותר כי הוא חיבור תוכנתי ולא פיזי.
על המכונה אפשר להריץ כל דבר OpenMediaVault / FreeNas / xpenology וכו
מהירות הגישה מהמחשב הראשי ל NAS תהיה מקסימלית ומוגבלת רק בקונפיגורצית הדיסקים שתבחר ב NAS.
אני בקונפיגורציה דומה עם שני מכונות וירטואליות מגיע לקצבים של מעל 200MB בכתיבה וקריאה.
אם חשוב לך החומר תגדיר RAID6 גם עם דיסק אחד תקול ובשני יש RE עדיין תוכל להתגבר כי יש גיבוי כפול ואז להחליף את הדיסק הנוסף עם ה RE או שה NAS פשוט יסמן אותו כשטח לא תקין וימפה לו שטח חדש.
באופן כללי אם אתה רוצה מהירות אולטימטיבית לצורך עריכה תתקין כונן NVMe SSD בחיבור על הלוח או ככרטיס PCIe.
הכוננים האלה מגיעים למהירויות של מעל 1200MB.
אתה יכול להשתמש בו ככונן עבודה ולהעביר בסוף ל NAS....
@spacedude
שקלת?
אל תרים ידיים בגלל הבילבולים על נפילות דיסקים אחרי 14^10 או 16^10
אתה יכול להרים את הקונפיגורציה שהצעתי ללא הוצאות מיותרות בתוך זמן קצר יחסית
ולבדוק בעצמך איך זה עובד.
אתה יכול גם לפרק דיסקים חיצוניים ולהכניס אותם לתוך המחשב הקיים (בפנים זה דיסק SATA רגיל).
- molvy
- חבר במועדון HT

- תגובות: 7037
- הצטרף: מרץ 2010
- נתן תודות: 1274 פעמים
- קיבל תודות: 1460 פעמים
לא קראתי את כל השרשור אבל אתן לך את שתי הסנט שלי
יש לי NAS עם 12 דיסקים של 4 טרה כל אחד מחוברים ב RAID 5
במשך חצי שנה האחרונה 2 דיסקים הפסיקו לעבוד כל אחד בהפרש של חדשיים אחד מהשני
כל פעם החלפתי דיסק אחד
החלפה של הדיסק הדפוק בדיסק חדש עבר בלי שום בעיות.
כאמור החלפתי פעמיים דיסקים
כך שאני די מרוצה מהתפקוד של ה NAS בחיבור של RAID 5
יש לי NAS עם 12 דיסקים של 4 טרה כל אחד מחוברים ב RAID 5
במשך חצי שנה האחרונה 2 דיסקים הפסיקו לעבוד כל אחד בהפרש של חדשיים אחד מהשני
כל פעם החלפתי דיסק אחד
החלפה של הדיסק הדפוק בדיסק חדש עבר בלי שום בעיות.
כאמור החלפתי פעמיים דיסקים
כך שאני די מרוצה מהתפקוד של ה NAS בחיבור של RAID 5
- Amir64
-
- גורו

- תגובות: 10913
- הצטרף: אוגוסט 2012
- נתן תודות: 215 פעמים
- קיבל תודות: 1941 פעמים
@molvy
כי בדיסקים עד 4TB הסיכוי לשגיאה עדיין לא גדול מידי.
כשמגיעים לדיסקים 6TB ויותר, הסיכוי לשגיאה בזמן rebuild עולה משמעותית.
לא כשל וודאי, אבל לא סיכוי שאפשר להתעלם ממנו.
לחלק מהאנשים rebuild יושלם בהצלחה, לחלק לא.
כי בדיסקים עד 4TB הסיכוי לשגיאה עדיין לא גדול מידי.
כשמגיעים לדיסקים 6TB ויותר, הסיכוי לשגיאה בזמן rebuild עולה משמעותית.
לא כשל וודאי, אבל לא סיכוי שאפשר להתעלם ממנו.
לחלק מהאנשים rebuild יושלם בהצלחה, לחלק לא.
כאמור, הסבירות היא כנראה לא אקראית לחלוטין לשגיאת קריאה. זה לא מתיישב עם מה שקורה בפועל.
אגב, אם משתמשים למשל ב raidz ולא ב raid, שגיאת קריאה לא תגרום להפסקת הבניה של כל המערך, אלא מידע מסויים יושחת.
זה יכול להיות metadata קריטי שיכול לגרום להשחתה של volume שלם במערך (למרות שלרוב יש שני עותקים) או סתם קובץ אחד קטן שנדפק.
אם כבר מדברים על RAID6, תאורטית במקרה והבקר נתקל ב ure הוא אמור להשלים את את המידע מה parity הנוסף שקיים. אין סיבה לזרוק את הדיסק מהמערך בשל Ure כאשר יש parity נוסף. כך למעשה הסבירות לכשל ב raid 6 תלויה ב ure על אותו סקטור בדיוק ביותר מכונן אחד בזמן בניה מחדש של המערך. לחלופין נפילה של 2 כוננים ועוד ure.
זה בתאוריה. בפועל תלוי במימוש של הבקר, אבל זה יהיה הזוי. לחלוטין אם זה לא כך. ב raidz2 זה מתנהל כפי שאמרתי והסיכוי לכשל קטן מאוד.
אגב, אם משתמשים למשל ב raidz ולא ב raid, שגיאת קריאה לא תגרום להפסקת הבניה של כל המערך, אלא מידע מסויים יושחת.
זה יכול להיות metadata קריטי שיכול לגרום להשחתה של volume שלם במערך (למרות שלרוב יש שני עותקים) או סתם קובץ אחד קטן שנדפק.
אם כבר מדברים על RAID6, תאורטית במקרה והבקר נתקל ב ure הוא אמור להשלים את את המידע מה parity הנוסף שקיים. אין סיבה לזרוק את הדיסק מהמערך בשל Ure כאשר יש parity נוסף. כך למעשה הסבירות לכשל ב raid 6 תלויה ב ure על אותו סקטור בדיוק ביותר מכונן אחד בזמן בניה מחדש של המערך. לחלופין נפילה של 2 כוננים ועוד ure.
זה בתאוריה. בפועל תלוי במימוש של הבקר, אבל זה יהיה הזוי. לחלוטין אם זה לא כך. ב raidz2 זה מתנהל כפי שאמרתי והסיכוי לכשל קטן מאוד.
