OpenAI השיקה את GPT-5 ולא כולם מרוצים

ביצועי GPT-5 בבנצ'מרקים מציג שיפורים המשמעותיים על פני הדור הקודם

7:44
  /     

ב-7 באוגוסט 2025, השיקה OpenAI את GPT-5 הדור החדש של מודלי השפה הגדולים שלה. המודל החדש ChatGPT-5 מאחד את כל יכולות ה-GPT ואת סדרת "o" במערכת אחת חזקה וגמישה, המשלבת הבנה עמוקה, הסקת מסקנות ברמת מומחה, תמיכה בטקסט, תמונה, קול ווידאו, וניהול הקשר ארוך טווח עם זיכרון שיחות.

מודל זה מצטיין בדיוק גבוה יותר והפחתת טעויות של "הזיות" במתן תשובות, מאפמובנותשר התאמה אישית של סגנון ותפקוד, ומציע גרסאות מותאמות לצרכים שונים. מגרסה קלה וחסכונית ועד גרסת Pro. שילוב זה של יכולת לשלב ולעבד סוגים שונים של מידע, ביצועים משופרים, התאמה אישית ונגישות רחבה הופך אותו לייחודי בהשוואה לדגמים הקודמים ולמתחרים בשוק.

OpenAI השיקה את GPT-5 ולא כולם מרוצים

כתיבת קוד מדויקת יותר
כתיבת קוד ב-ChatGPT-5 מציעה חוויה מהירה, מדויקת וגמישה יותר מבעבר, הודות ליכולת הבנה מעמיקה של דרישות המשתמש ושמירה על הקשר מלא לאורך השיחה. המודל יודע לנתח מפרטים טכניים, להציע פתרונות במגוון שפות תכנות, לשלב ספריות וכלים חיצוניים, ואף לבצע אופטימיזציה לקוד קיים. בנוסף, GPT-5 מסוגל להפיק הסברים מפורטים לצד הקוד, להציע חלופות ולזהות שגיאות פוטנציאליות בזמן כתיבה, מה שהופך אותו לעוזר תכנות יעיל הן למפתחים מתחילים והן למומחים.
OpenAI השיקה את GPT-5 ולא כולם מרוציםדוגמה למשחק שנוצר בקוד פשוט ב- HTML

ארכיטקטורה מאוחדת עם router אוטומטי
המודל החדש פועל במבנה שכולל שלושה רכיבים מרכזיים:

  1. מודל יסוד לטיפול בבקשות שגרתיות.
  2. מודל Thinking לעיבוד עמוק.
  3. router אוטומטי שמחליט בזמן אמת איזה רכיב להפעיל לפי מורכבות הבקשה.

המערכת מותאמת להחליט אוטונומית מתי להשתמש ב-reasoning מורחב ומתי לספק תגובה מהירה.

מה קורה לשיחות שנעשו עם מודלים מוקדמים?
אם תפתח שיחה שהשתמשה באחד מהמודלים הללו, צ'אטג'יפיטי יעביר אותה באופן אוטומטי למקבילה הקרובה ביותר של ג'יפיטי-5. שיחות עם 4o, 4.1, 4.5, 4.1-מיני, o4-מיני, או o4-מיני-גבוה ייפתחו בג'יפיטי-5, שיחות עם o3 ייפתחו בג'יפיטי-5-חשיבה, ושיחות עם o3-פרו ייפתחו בג'יפיטי-5-פרו (זמין רק במנויי פרו וצוות).

מעבר זה מבטיח שתוכל להמשיך את השיחות שלך עם הגרסה העדכנית ביותר של המודל, תוך שמירה על רצף ואיכות השיחה. השדרוג האוטומטי הזה מאפשר לך ליהנות מהיכולות המשופרות של המודלים החדשים ללא צורך בהתערבות ידנית, ומבטיח חוויית משתמש חלקה ועקבית.

GPT-5 משיג תוצאות משמעותיות על פני מגוון בנצ'מרקים:

  • 94.6% ב-AIME 2025 למתמטיקה ברמה גבוהה ללא כלים חיצוניים
  • 74.9% ב-SWE-bench Verified לקודינג בעולם האמיתי
  • 84.2% ב-MMMU להבנת מולטימדיה עם reasoning מורחב
  • 88.0% ב-Aider polyglot
  • 88.4% ב-GPQA

OpenAI השיקה את GPT-5 ולא כולם מרוצים

בתחום Verified (משימות קידוד ריאליות בגיטהאב)

  • GPT-5 מגיע ל-74.9% במבחן זה, לעומת 69.1% של o3.
  • Aider Polyglot (קידוד רב-שפתי):
  • GPT-5 השיג 88% במבחן זה

Front-end (פיתוח צד לקוח – בדיקות פנימיות)

  • בבדיקות פנימיות של OpenAI מצויין כי GPT‑5 גובר על o3 בכ-70% מהמקרים בפיתוח Front-end.

שיפורים בדיוק ואמינות
בהשוואה ל-GPT-4o, הסיכוי שתגובות GPT-5 יכילו שגיאה עובדתית נמוך ב-45% כאשר חיפוש ברשת מופעל. במצב thinking, הסיכוי לשגיאות עובדתיות נמוך ב-80% לעומת מודל o3.

החברה גם מדווחת על שיפורים בבעיית ה-sycophancy (חנופה יתר). בהערכות ממוקדות שנועדו לעורר תגובות חנפניות, GPT-5 הפחית משמעותית תגובות כאלה מ-14.5% לפחות מ-6%.

יכולות agent ומשימות מורכבות
GPT-5 מציג ביצועים טובים במשימות סוכן דיגיטלי ארוכות טווח, ומשיג ציון של 96.7% ב-τ2-bench telecom, זהו בנצ'מרק לבדיקת יכולות קריאה לכלים (tool calling) שפורסם לפני חודשיים בלבד. המודל מסוגל לשלב ולבצע עשרות קריאות לכלים הן ברצף והן במקביל, תוך שיפור משמעותי ביכולת לטפל בשגיאות כלים ולבצע אחזור מידע מהקשר ארוך.

אבל…לא הכל ורוד

למרות השבחים הטכניים וההישגים המרשימים בבנצ'מרקים, השקת GPT-5 זוכה לביקורת קשה מצד המשתמשים ברחבי הרשת. בפורומים באתר Reddit מתקיימים דיונים סוערים, עם אלפי תגובות של משתמשים מתוסכלים שמתארים את החוויה החדשה כ"נוראית" ו"צעד אחורה".

הבעיה העיקרית התחילה כאשר OpenAI החליטה להסיר בבת אחת את כל המודלים הקודמים – GPT-4o, GPT-4.1, GPT-4.5 ואחרים – ללא תקופת מעבר או התראה מוקדמת. בפורום אחד ב-Reddit שכותרתו "GPT-5 is horrible" זכה ליותר מ-4,600 הצבעות חיוביות ו-1,700 תגובות, סערה אמתית ברשת.

משתמש אחד הסביר בתסכול: "אני יודע ש-GPT-5 תוכנן להיות חזק יותר בהיגיון מורכב, קידוד ומשימות מקצועיות, אבל לא כולנו צריכים מודל קידוד מקצועי. חלקנו מסתמכים על 4o לשיתוף פעולה יצירתי, ניואנסים רגשיים, משחק תפקידים ואינטראקציות ארוכות".

המשתמשים מתלוננים כי GPT-5 מרגיש "קר יותר" ומכני יותר, גם אם הוא עולה על קודמיו במשימות טכניות מסוימות. בפורום אחד ב-Reddit עם מאות תגובות השוו את הסרת GPT-4o ל-"איבוד חבר מהימן", בעוד אחרים תיארו את GPT-5 כ-"יעיל אבל חסר נשמה".

התלונות כללו טעמים רבים: תשובות קצרות ופחות מפורטות מהרגיל, אובדן ה"אישיות" שאפיינה את GPT-4o, הגבלות חדשות של רק 200 הודעות שבועיות במצב "Thinking" למנויי Plus, ביצועים איטיים יותר למרות הטכנולוגיה המתקדמת, ואפילו בעיות בקידוד עם דיווחים על קוד עם באגים וטעויות במתמטיקה בסיסית.

התגובה המהירה של OpenAI
לאחר הסערה ברשת, סם אלטמן מנכ"ל OpenAI הודה בבעיות ופירסם ב-Reddit הודעה מפייסת: "שמענו את כולכם לגבי 4o; תודה על הזמן לתת לנו פידבק. אנחנו הולכים להחזיר אותו למשתמשי Plus, ונעקוב אחר השימוש כדי לקבוע כמה זמן לתמוך בו".

אלטמן התחייב גם לעדן את האישיות של GPT-5, להרחיב אפשרויות ההתאמה האישית, ולשפר את התקשורת עם קהילת המשתמשים. בנוסף, החברה הבטיחה להכפיל את מגבלות השימוש ב-GPT-5 עבור מנויי Plus.

הסערה הזו חושפת אמת גוברת באימוץ AI – ביצועים זה לא הכל. משתמשים רבים בונים תחושת אמון והיכרות עם הטון, הקצב ודרך ה"חשיבה" של מודל ספציפי. עם 700 מיליון משתמשים פעילים שבועיים, המגוון באופני השימוש באמת עצום, החל ממחקר אקדמי ועד יצירה אמנותית ומשחקי תפקידים.

הפתרון הזמני של החזרת GPT-4o מציע לכאורה את הטוב שבשני העולמות: GPT-5 למי שרוצה יכולות שיא, ו-GPT-4o למי שמעדיף קול מוכר ונעים.

הפער בין הבטחות למציאות
כש-GPT-5 הושק ב-7 באוגוסט 2025, ההבטחות היו גבוהות: קפיצת מדרגה טכנולוגית שתהפוך את ChatGPT לאינטליגנטי ויעיל מתמיד. אבל בתוך מספר שעות בלבד, הנהלת OpenAI מצאה את עצמה במרכז סערה. באחד מפורומי "שאל אותי כל דבר" ב-Reddit, סם אלטמן אף הודה בגלוי שההשקה הייתה "מעורבת בגלגולים" ולמעשה "לקחה עקומה לא צפויה" בעקבות בעיות טכניות, כמו פגם במנגנון ה-router האוטומטי שגרם ל-GPT-5 להיראות "הרבה יותר טיפש".

נוסף לכך, דיווחים מצביעים על כך שההשקה נעשתה בצורה הדרגתית ולא אחידה. כתוצאה מכך, משתמשים רבים, במיוחד מנויי Plus, גילו שהגישה ל-GPT-5 מתעכבת לעיתים, גם כשבהכרזה נמסר ש"הגישה תהיה זמינה מידית לכולם". חלק מהמשתמשים דיווחו שלא ראו את המודל החדש במשך ימים.

ומעבר לכך, מצגת ההשקה עצמה עוררה חשש. כלי תקשורת תיארו מצבים שבהם הוצגו גרפים מטושטשים ובדיקות "חיות" שהיו למעשה מתוזמנות, יחד עם מה שאלטמן עצמו כינה "mega chart screwup" (כשלון מגה בגרפים). בעולם שבו אמון המשתמשים קריטי לצמיחה, הצגה שכזו עשויה להשאיר שאלות פתוחות על שקיפות החברה ורמת ההכנה שלה.

OpenAI השיקה את GPT-5 ולא כולם מרוצים

התגובה של אלטמן לא איחרה לבוא – הוא אמר כי "לא הערכנו מספיק כמה חשוב למשתמשים האופי והטון של GPT-4o", והבטיח להחזיר את הגרסה הזו למנויי Plus, לצד השקעה מתמשכת באפשרות התאמה אישית של המודלים. אבל השאלה נשארת פתוחה: האם OpenAI, שמתכוננת לגיוס השקעות בהערכה של 500 מיליארד דולר, מסוגלת לנהל השקות מורכבות של מוצרים שמשפיעים על מאות מיליוני משתמשים

זמינות ותמחור
לראשונה, OpenAI מספקת גישה למודל reasoning למשתמשים חינמיים, כאשר GPT-5 זמין כמודל ברירת המחדל לכל המשתמשים. מנויי Plus, Pro ו-Team מקבלים גישה מורחבת עם מגבלות גבוהות יותר.

 

 

לשרשור תגובות לחץ כאן