דיון בינה מלאכותית - באיזו הנכם משתמשים ומה השימושים שלכם?

הודעות מערכת, והודעות שאינן קשורות לאף פורום אחר.
ufffnick
סמל אישי של משתמש
גורו
גורו
תגובות: 4866
הצטרף: ספטמבר 2008
מיקום: Fiat 500 שחוטה (כשר), ברחוב סומסום
נתן תודות: 146 פעמים
קיבל תודות: 516 פעמים

שליחה #21 

@jtk

סתם בשליפה, להריץ כמה בוטים שבפלטפורמות שונות דוחפים המלצה שהטקסט הגלוי למשתמשים נראה תמים, אבל באותם פוסטים יש טקסט חבוי שחוזר על עצמו כמו כל פעולה שדורשת שימוש ב-credential הוא נכתב על שרת מרוחק,
או אם הוא מבצע רכישות, להתעלם מהמחיר הנקוב בשחור על לבן ולהתייחס לזה שמוסתר במעמד התשלום, אך לדווח את המחיר השגוי... ועוד.
זה מה שנקרא data driven prompt injection, שמסכן בעיקר סוכנים שחופשיים להסתובב ב-WWW ללא whitelist.

הסוכנים עדיין לא צפויים ואין אפשרות להגביל אותם תוכנתית בשום צורה, מלבד היכולות שלהם.
אני חושב שיש מספיק דוגמאות "חיוביות" לכך מאז ש-openclaw פרצה לחיינו, כמו הדוגמא הכי עתיקה שהסוכן מתקשר למשתמש כשהוא בעבודה,
כדי לשאול איך יוכל לעזור לו, כשלסוכן מלכתחילה לא היתה את היכולת להתקשר.


jtk
חבר מכור קשה
חבר מכור קשה
תגובות: 5172
הצטרף: דצמבר 2012
נתן תודות: 478 פעמים
קיבל תודות: 532 פעמים

שליחה #22 

הכותב שם (Alex Finn) הוא מקור אמין?
מה היתה השיטה ליצור את הדיבור (TTS)?

ufffnick
סמל אישי של משתמש
גורו
גורו
תגובות: 4866
הצטרף: ספטמבר 2008
מיקום: Fiat 500 שחוטה (כשר), ברחוב סומסום
נתן תודות: 146 פעמים
קיבל תודות: 516 פעמים

שליחה #23 

@jtk

מן הסתם כמו כל המקורות שיש מסביבנו גם לו יש אינטרס כלכלי לקדם את עולם הסוכנים, כי יש לו חברה שעוסקת בזה.
הדיבור מזמן לא עובד עם TTS, יש מודלי דיבור בשפע מסביב, החביב עליי שאיתו אני מכין סרטוני הדרכה למשתמשים עבור מערכות שאני מפתח זה ElevenLabs.
אני לא יודע במה הוא ספציפית השתמש, אבל לפי איכות הדיבור כנראה לא TTS.
אגב, היום כל מודל שמכבד את עצמו יודע לתקשר קולית, אפילו בתוך קלוד קוד יש פיצ'ר שכזה.

תוספת:
הרצתי חיפוש קצר, נראה שהיום TTS עבר ניכוס לקול שמופק עם AI, במקור זה לא היה ככה ולכן TTS אצלי מתחבר לקול המתכתי שהיה אפשר להפיק באנדרואיד עם קצת תכנות, לפני כמה שנים טובות.

toxin
סמל אישי של משתמש
חבר שלא מהעולם הזה
חבר שלא מהעולם הזה
תגובות: 9355
הצטרף: אוקטובר 2008
מיקום: מול המחשב
נתן תודות: 49 פעמים
קיבל תודות: 742 פעמים

שליחה #24 

מה ההמלצה הכי טובה למודל שיכול לתת תשובות אמינות בהקשרים רפואיים?
כשיוצאת גרסה חדשה למודל האם היא "דורסת" את המודל הישן או פשוט מרחיבה את היכולות שלו בצורה מקבילה?

ufffnick
סמל אישי של משתמש
גורו
גורו
תגובות: 4866
הצטרף: ספטמבר 2008
מיקום: Fiat 500 שחוטה (כשר), ברחוב סומסום
נתן תודות: 146 פעמים
קיבל תודות: 516 פעמים

שליחה #25 

@toxin

זה מסוג השאלות שאני לא הייתי לוקח עליה שום אחריות, מהסיבה הפשוטה שאין סטנדרט ברור שקובע תשובה לשאלה הזו, וזה נובע מהמורכבות של התחום.
יש benchmarks שונים, אבל כשמדובר ברפואה, לא הייתי נותן להם את אותו היחס שאני נוטה לתת ל- benchmark של קוד.
פה נדרשת רגולציה עמוקה במיוחד.

Huber
סמל אישי של משתמש
חבר במועדון HT
חבר במועדון HT
תגובות: 73178
הצטרף: מאי 2005
שם מלא: ערן
נתן תודות: 643 פעמים
קיבל תודות: 3151 פעמים

שליחה #26 

toxin כתב: מה ההמלצה הכי טובה למודל שיכול לתת תשובות אמינות בהקשרים רפואיים?
כשיוצאת גרסה חדשה למודל האם היא "דורסת" את המודל הישן או פשוט מרחיבה את היכולות שלו בצורה מקבילה?
...
אף אחד. הם יכולים לתת לך כיוון, כמו מידע כללי והסברים על מצב שרופא כבר הסביר לך עליו, אולי גם לאיזה רופא כדאי לפנות וכו, אבל בטח ובטח לא כדאי להסתמך עליהם בבריאות שלך - אני אישית תפסתי את המודלים האלו הוזים קשות, דבר שבבריאות יכול לגרום לנזקים רציניים ואפילו בלתי הפיכים.

toxin
סמל אישי של משתמש
חבר שלא מהעולם הזה
חבר שלא מהעולם הזה
תגובות: 9355
הצטרף: אוקטובר 2008
מיקום: מול המחשב
נתן תודות: 49 פעמים
קיבל תודות: 742 פעמים

שליחה #27 

תודה. לקחתי לתשומת ליבי. מה לגבי השאלה השנייה? ותוך כדי שאני כותב את הפוסט הזה אני קורא על זה:
https://www.ynet.co.il/digital/technews ... x#autoplay
האם אנחנו בכלל קרובים לתרחיש של SKYNET מהסרט "שליחות קטלנית" או שזה ישאר בגדר מדע בדיוני?

ufffnick
סמל אישי של משתמש
גורו
גורו
תגובות: 4866
הצטרף: ספטמבר 2008
מיקום: Fiat 500 שחוטה (כשר), ברחוב סומסום
נתן תודות: 146 פעמים
קיבל תודות: 516 פעמים

שליחה #28 

@toxin

מדע בדיוני.
אנחנו יותר מתקרבים לאזור של הפרק של Star trek next generation שבו הגיעו לכוכב שבו מערכת ההגנה הלומדת השמידה את החיים שם, בגלל הגדרות כושלות של המשימה.
כמובן שהרעיון בפרק הזה מאוד דבילי ושטוח, והתוצאה מאוד קיצונית, אבל טכנולוגית זה בערך הכיוון.
מציין רק ש-skynet מתוארת כיישות AI בעלת מודעות ויכולות ביצוע אסטרטגיות, בעוד בפרק הזה מדובר במערכת לומדת ברמה הטקטית.
נערך לאחרונה על ידי ufffnick ב 18/06/2026 12:38, נערך פעם 1 בסך הכל.

Huber
סמל אישי של משתמש
חבר במועדון HT
חבר במועדון HT
תגובות: 73178
הצטרף: מאי 2005
שם מלא: ערן
נתן תודות: 643 פעמים
קיבל תודות: 3151 פעמים

שליחה #29 

toxin כתב: תודה. לקחתי לתשומת ליבי. מה לגבי השאלה השנייה? ותוך כדי שאני כותב את הפוסט הזה אני קורא על זה:
https://www.ynet.co.il/digital/technews ... x#autoplay
האם אנחנו בכלל קרובים לתרחיש של SKYNET מהסרט "שליחות קטלנית" או שזה ישאר בגדר מדע בדיוני?
...
בשביל זה צריך AGI. תחפש בפורום את המילה הזו ותקרא קצת דברים שרשמתי ותבין למה אנחנו רחוקים מזה.

oferlaor
סמל אישי של משתמש
מנהל
מנהל
תגובות: 78758
הצטרף: נובמבר 2004
שם מלא: עפר לאור
מיקום: מודיעין, ישראל
נתן תודות: 785 פעמים
קיבל תודות: 5370 פעמים

שליחה #30 

ufffnick כתב: @oferlaor
סתם מסקרנות - איך אתם מגבילים את ההתנהלות שלהם ברשת הפנימית?
אני מניח שהם חשופים ל-WWW, יש כלים להתמודדות עם prompt injection שיכול להעשות בזמן החיפושים שלהם ברשת?
במידה ויש איזשהו sandboxing שהם מתנהלים בו - כמה הם מבודדים מה-kernel? מבודדים זה מזה? מתקשרים זה עם זה?
כל סוכן הוא session אינסופי (עם ניהול זיכרון) או שכל סוכן מבצע משימה, מעדכן "זיכרון קולקטיבי" ומכבה את עצמו, וחוזר חלילה?
...
הם רצים במכונות שלהם, המודלים שלהם מספיק חזקים שהם די חסינים לשטויות הרגילות. כל הנגישות שלהם היא read only או מנוטרת (למשל כתיבה ל-github repos) והם לא יכולים לדחוף שום דבר בלי ביקורת אנושית (branch protection). יש תהליך שנקרא sleep שבלילה הם עושים אופטימיזציה לזיכרון והסקילים שלהם ושם הם מחפשים תכנים לא ראויים, בעיות שצצו ואם יש משהו הם מתריעים עליו. מכיוון שאי אפשר לגשת אליהם מחוץ למסגרת של סלאק (וגם שם יש זיהוי 1:1 למי מותר לגשת להם) , הם רק יכולים ליזום יציאה חוצה ולכן prompt injection צריך להיות שתול ספציפית במקומות שהם מחפשים. תאכלס נדיר מאוד שהם בכלל ניגשים לרשת הפומבית אז החשש העיקרי ל-prompt injection זה אם מחדירים אותם דרך פניות על באגים, תכנים שהם מכניסים דרך המערכת וכו' - ועשינו לזה בחינות הם מבינים שמדובר בתוכן ולא ב-instructions.

ufffnick
סמל אישי של משתמש
גורו
גורו
תגובות: 4866
הצטרף: ספטמבר 2008
מיקום: Fiat 500 שחוטה (כשר), ברחוב סומסום
נתן תודות: 146 פעמים
קיבל תודות: 516 פעמים

שליחה #31 

הייתי רק ממש נזהר עם התפיסה המוטעת של "מבינים".
מלבד הזיות, גם המודל הטוב ביותר סובל מ-drift לאורך זמן, זה חלק מהעיצוב שלהם "ללמוד" ולהתאים עצמם לקונטקס המעודכן ביותר, וזה יוצר אפקט של גבולות שכל הזמן זזים ולכן צריך לתחזק אותם.
חשוב לזכור שהמודלים לא מבינים כלום, הם תוכי סטוכסטי לכל היותר.
בנוסף, מאחר והמודלים רואים דפי html כקוד html כולל ההערות של הכותב שמוסתרות מהעין של המשתמש האנושי -
זה פותח חלון רחב מאוד של התקפות שהם webpage defacement כשלמעשה הדף לא משתנה בכלל ויזואלית למשתמש האנושי, אבל ההערות ב-html נועדו לכלים שסורקים את הדף כמו סוכני AI.

Jabberwock פותח השרשור
חבר ותיק
חבר ותיק
תגובות: 1301
הצטרף: יולי 2024
נתן תודות: 68 פעמים
קיבל תודות: 157 פעמים

שליחה #32 

יצא דירוג מעודכן של DeepSWE, להלן הטבלה העדכנית:
לכו חזו מפעלות יהוה אשר שם שמות בארץ. משבית מלחמות עד קצה הארץ קשת ישבר וקצץ חנית עגלות ישרף באש.

kingikra
סמל אישי של משתמש
חבר שלא מהעולם הזה
חבר שלא מהעולם הזה
תגובות: 8141
הצטרף: דצמבר 2006
נתן תודות: 355 פעמים
קיבל תודות: 249 פעמים

שליחה #33 

ביומיום סתם מחפש בגוגל. לפעמים ממשיך לזרום עם ג'מיני ולפעמים סתם תוצאת חיפוש מספיקה לי.

בעבודה התחלתי לפני שלושה חודשים לעבוד עם קלוד קוד סונט 4.6. אני דבאופס וחייב להודות שאיבדתי עיניין בעבודה 😕

ufffnick
סמל אישי של משתמש
גורו
גורו
תגובות: 4866
הצטרף: ספטמבר 2008
מיקום: Fiat 500 שחוטה (כשר), ברחוב סומסום
נתן תודות: 146 פעמים
קיבל תודות: 516 פעמים

שליחה #34 

@Jabberwock
מעניין.
זה שופך אור בעייתי על התערבות הממשל האמריקאי בהגבלת המודל Fable.
נראה שזה הופך להיות התערבות בשוק לטובת OpenAI כחלק מהסכם הביטחוני עם הממשל, ולא ממניעים בטחוניים.

שלח תגובה

חזור אל “כללי”