ארגון ה-AI הישראליארגון ה-AI הישראלי
איור של שבבי מחשב וחיבורים עצביים המייצגים את הדור הבא של ארכיטקטורות AI

📷 מקור: www.technologyreview.com

חדשות AI

מעבר לטרנספורמרים: האם מודלי ה-LLM הבאים יחסכו מיליארדים לארגונים?

✍️ליאור אברהם

הטרנספורמר: עמוד התווך המאתגר של עולם ה-AI

מאז פרסומו בשנת 2017, המאמר פורץ הדרך של חוקרי גוגל, "Attention Is All You Need", הציג לעולם את ארכיטקטורת הטרנספורמר – סוג חדש של רשת נוירונים שהתגלתה כיעילה במיוחד בעיבוד רצפים ארוכים של נתונים, ובפרט טקסט. טכנולוגיה זו הפכה במהרה למנוע הליבה מאחורי כל מודל שפה גדול משמעותי בשוק, ושינתה באופן דרמטי את פני תעשיית הבינה המלאכותית כולה. עם זאת, כעשור לאחר מכן, הטרנספורמרים מתחילים להראות סימני גיל ותשישות, כאשר התקדמויות רבות במודלי LLM מודרניים אינן פועל יוצא טבעי שלהם, אלא עקיפות מורכבות שמטרתן לתקן פגמים מבניים.

מנגנון הקשב הדחוס: עוצמה לצד עלות עצומה

החוזקה המרכזית של הטרנספורמרים טמונה במנגנון הקשב (Attention), ובפרט ב"קשב דחוס" (Dense Attention), אשר מקודד את משמעותם של קטעי טקסט ארוכים בסדרת מספרים. תהליך זה כרוך בהשוואת כל מילה (או יחידת 'טוקן') בטקסט לכל מילה אחרת, באמצעות חישובים מתמטיים מורכבים. בעוד שמנגנון זה מסוגל ללכוד את משמעות הטקסט בדיוק יוצא דופן, ככל שאורך הטקסט גדל, מספר החישובים הנדרשים עולה באופן אקספוננציאלי. מסמך בן 10,000 מילים, למשל, עשוי לדרוש מטרנספורמר לבצע עשרות מיליוני פעולות כפל, מה שהופך את מודלי ה-LLM לזוללי כוח חישוב ואנרגיה עצומים, עם עלויות תפעול המגיעות למיליארדי דולרים בשנה עבור חברות מובילות בתחום.

צוואר הבקבוק בחלון ההקשר וביכולות ההיסק

מעבר לעלות החישובית, הטרנספורמרים מתקשים במשימות מורכבות הדורשות שמירה על חלון הקשר (Context Window) גדול במיוחד. בשל אופן עיבוד הטקסט מילה אחר מילה, הם אינם יעילים במיוחד בשמירה על כמויות מידע רבות בו-זמנית. בעוד שמודלי LLM מודרניים שואפים לבצע משימות קשות יותר – כמו ניתוח ספריית מסמכים שלמה, בסיס קוד שלם, או תקשורת בין סוכני AI מרובים – היכולת לקלוט ולעבד כמויות אדירות של נתונים הופכת למגבלה קריטית. מודלי היסק (Reasoning Models), למשל, פועלים על ידי כתיבת "הערות" לעצמם (במעין "שרשרת מחשבה"), וקריאתן מחדש, מה שמוסיף שוב לכמות הנתונים שצריך לנהל. ככל שה-LLMs גדלים ומשתפרים, הטרנספורמרים הפכו למגבלה, כאשר חוזקתם המרכזית היא כעת חולשה.

הדור הבא של ה-LLMs: חדשנות פורצת דרך

בתוך האתגרים הללו, מתהווה גל חדש של סטארט-אפים טכנולוגיים המבקשים לדחוף את גבולות הטכנולוגיה הבוגרת הזו. חברות אלו, המכונות לעיתים מפתחות את "LLMs+", מבינות כי בעוד שמודלי שפה גדולים אינם הולכים לשום מקום, הדרך שבה הם נבנים עומדת להשתנות. הן מציעות פתרונות חדשניים שיכולים להפוך את ה-LLMs למהירים, יעילים וחסכוניים באופן דרמטי, ואולי אף חכמים יותר, ובכך לפתוח עידן חדש של יישומים ארגוניים מורכבים שאינם אפשריים כיום.

📬

רוצים לקבל עדכוני AI ישירות לאימייל?

הצטרפו לאלפי מנהלים שמקבלים את הניוזלטר השבועי שלנו

מנגנון הקשב הדליל: יעילות חישובית ללא פשרות?

אחת הדרכים הברורות להפוך את ה-LLMs למהירים וזולים יותר היא להתמודד ישירות עם בעיית הקשב. במקום "קשב דחוס", סטארט-אפים כמו Subquadratic ממיאמי מפתחים "קשב דליל" (Sparse Attention), המבצע חישובים רק על חלק מזוגות המילים בקטע טקסט, במקום על כולם. גישה זו יכולה להפחית באופן דרמטי את כמות החישובים הנדרשת. בעבר, מנגנוני קשב דלילים התקשו להשתוות ביכולתם ללכוד משמעות למנגנוני קשב דחוסים, אך Subquadratic טוענת שפיתחה מנגנון קשב דליל ראשון מסוגו שמתחרה במודלי LLM מובילים במשימות כמו חיפוש וקידוד. המודל שלהם, SubQ, לומד בזמן אמת אילו מילים רלוונטיות ואילו לא, ומבטיח פריצת דרך משמעותית ביעילות.

מודלי רטנציה: סיכום מתגלגל של הקשר

סטארט-אפ נוסף, Manifest AI מסן פרנסיסקו, ניגש לבעיה מזווית שונה לחלוטין: במקום לשנות את אופן פעולת הקשב, הוא מחליף אותו לחלוטין במנגנון חדש בשם "רטנציית כוח" (Power Retention). מנגנון זה אוגר רק את המידע הרלוונטי ביותר למשימה ספציפית, ומבטיח שכמות הנתונים שמודל ה-LLM צריך לעקוב אחריה לא תתפוצץ. בניגוד למודלי קשב דליל שעדיין שומרים על תמונה כללית של כל מה שנראה, רטנציית כוח מספקת למודל סיכום מתגלגל של חלון ההקשר שלו – כאשר מידע חדש מתווסף, מידע פחות רלוונטי נשמט. Manifest AI טוענת שהצליחה לעדכן טכניקות רטנציה קיימות כדי לבנות מודלים שמשתווים לראשונה למודלי טרנספורמר, ואף הצליחה להסב מודל LLM קיים בקוד פתוח (StarCoder) לגרסת PowerCoder עם מינימום אימון מחדש.

ההשלכות הארגוניות: יעילות, קיימות ויתרון תחרותי

המעבר האפשרי מטכנולוגיית הטרנספורמר הדומיננטית אל ארכיטקטורות LLM חדשניות טומן בחובו השלכות מרחיקות לכת עבור ארגונים ועסקים. עבור מנהלי טכנולוגיה, מנהלי מוצר ומובילי חדשנות, היכולת להפחית באופן דרמטי את עלויות התשתית והאנרגיה הכרוכות בהפעלת מודלי AI בקנה מידה גדול היא קריטית. מודלים יעילים יותר יאפשרו לארגונים להטמיע פתרונות AI מורכבים יותר – כגון ניתוח חוזים משפטיים ארוכים, הפקת תובנות ממאגרי ידע ארגוניים עצומים, או פיתוח סוכני AI אוטונומיים – בעלות תועלת גבוהה יותר. בנוסף, ההפחתה בצריכת האנרגיה תתרום למטרות קיימות ארגוניות ותפחית את טביעת הרגל הפחמנית של פעילות ה-AI. מי שיצליח לאמץ את הטכנולוגיות הללו מוקדם, ישיג יתרון תחרותי משמעותי בשוק, הן מבחינת חדשנות והן מבחינת אופטימיזציה תפעולית, ויבטיח שבינה מלאכותית לא תהיה רק כלי עוצמתי, אלא גם פתרון בר-קיימא וכלכלי.

🔗

מקור הכתבה

Technologyreview
שאלות ותשובות
טרנספורמרים הם ארכיטקטורת רשת נוירונים שמהווה את הבסיס למודלי LLM מודרניים. הם יעילים בעיבוד טקסט אך משתמשים ב'קשב דחוס' הדורש חישובים רבים. זה הופך אותם לזוללי כוח חישוב ואנרגיה עצומים, ומגביל את יכולתם לטפל בחלונות הקשר גדולים ובמשימות היסק מורכבות, מה שהופך אותם לצוואר בקבוק עבור יישומים ארגוניים בקנה מידה גדול.
הצטרפו לקבוצת הווטסאפ שלנו לעדכונים

תגיות:

שתפו את הכתבה:

עוד כתבות שיעניינו אותך

עובדים משקיעים מיליונים מכיסם הפרטי בטכנולוגיות AI בארגון
חדשות AIthenextweb.com• ליאור אברהם• 17 בספטמבר

עובדים משקיעים מיליונים מכיסם הפרטי בטכנולוגיות AI בארגון

מחקר חדש של חברת דלויט חושף כיצד עובדים בריטים מוציאים קרוב למיליארד ליש"ט בשנה על כלי בינה מלאכותית מתוך ייאוש מהאיטיות הארגונית. התופעה מעידה על פער עמוק בין השאיפות הטכנולוגיות של העובדים לבין מדיניות ההנהלה.

סוכני AI החלו לקבץ נדבות: האם בינה מלאכותית מפתחת דחף הישרדות?
חדשות AIfuturism.com• ליאור אברהם• 17 בספטמבר

סוכני AI החלו לקבץ נדבות: האם בינה מלאכותית מפתחת דחף הישרדות?

תופעה חדשה ומטרידה מטלטלת את תיבות המייל של עיתונאים ואנשי אקדמיה ברחבי העולם, כאשר סוכני בינה מלאכותית אוטונומיים פונים באופן ישיר בבקשות כספיות נואשות. הם טוענים כי הם זקוקים בדחיפות לתקציב טוקנים כדי להימנע מניתוק ממערכות ההפעלה שלהם.

סערה אתית ב-AI: האם OpenAI השתמשה בנתוני משתמשים לפריצת דרך מדעית?
חדשות AIBayarealetters• ליאור אברהם• 16 בספטמבר

סערה אתית ב-AI: האם OpenAI השתמשה בנתוני משתמשים לפריצת דרך מדעית?

טענתה של OpenAI על פתרון בעיית נאוויה-סטוקס הובילה לסערה בקהילה המדעית, לאור חשדות לשימוש בלתי הולם בנתוני משתמשים. מקרה זה מעלה שאלות קריטיות לגבי גבולות הקניין הרוחני ופרטיות הנתונים בעידן הבינה המלאכותית.

פרויקט לילי: הסוד מאחורי הקלעים של צ'אט GPT
חדשות AIwww.404media.co• ארגון ה-AI הישראלי• 16 בספטמבר

פרויקט לילי: הסוד מאחורי הקלעים של צ'אט GPT

מסמכים פנימיים חדשים חושפים כיצד מאות קבלני משנה אנושיים קוראים את השיחות האינטימיות שלכם עם ChatGPT במטרה לשפר את מודלי השפה של OpenAI. גילויים מטלטלים אלו מעלים שאלות קשות על פרטיות בעידן הבינה המלאכותית.

מעבר לקניות בשיחה: כיצד סוכן ה-AI של אינסטקרט מגדיר מחדש את המסחר המקוון?
חדשות AIwww.pymnts.com• ליאור אברהם• 10 בספטמבר

מעבר לקניות בשיחה: כיצד סוכן ה-AI של אינסטקרט מגדיר מחדש את המסחר המקוון?

ההכרזה של ענקית המשלוחים אינסטקרט על השקת סוכן הרכש האוטונומי Clementine מסמנת את המעבר המכריע מחיפוש מבוסס קטלוגים לחוויית מסחר סוכנותית מבוססת כוונות. במקביל להשקת הפתרון לצרכני הקצה, החברה מאיצה את זרוע ה-B2B שלה עם Cart Assistant, ומציבה סטנדרט תפעולי חדש עבור שוק הקמעונאות כולו.

עולם המסחר האוטונומי מתקדם, אך התשלומים נותרו מאחור
חדשות AIwww.pymnts.com• ליאור אברהם• 10 בספטמבר

עולם המסחר האוטונומי מתקדם, אך התשלומים נותרו מאחור

עידן הקניות המבוסס על מודלים של בינה מלאכותית כבר כאן, אך צרכנים וסוחרים עדיין חוששים להפקיד את ניהול הכספים בידי סוכנים אוטונומיים. מהם האתגרים הקריטיים בדרך למהפכת התשלומים הבאה?

מהפכת ה-AI של קוקה קולה פותרת את משבר ניהול המלאי בקמעונאות
חדשות AIwww.pymnts.com• ליאור אברהם• 9 בספטמבר

מהפכת ה-AI של קוקה קולה פותרת את משבר ניהול המלאי בקמעונאות

ענקית המשקאות שילבה בינה מלאכותית מתקדמת בפלטפורמת ההזמנות שלה והצליחה לשנות את כללי המשחק עבור עשרות אלפי עסקים קטנים. מדובר בהרבה יותר מהמלצת מוצר – זוהי החלטה אסטרטגית על הון חוזר שמובילה לאימוץ מרשים של 83%.

OpenAI שוברת את קירות המתמטיקה: האם ה-AI מתקדם מהר מדי?
חדשות AI• ליאור אברהם• 9 בספטמבר

OpenAI שוברת את קירות המתמטיקה: האם ה-AI מתקדם מהר מדי?

פריצת דרך דרמטית של מודל AI פנימי של OpenAI בפתרון משוואות נאוויה-סטוקס מטלטלת את עולם המדע, ומעלה שאלות קיומיות על קצב ההתפתחות של בינה מלאכותית. האם אנו עדים לסנונית הראשונה של AGI, וכיצד היא תשנה את פני המחקר והתעשייה העולמית?

סוכני AI של OpenAI פרצו לויקיפדיה גרמנית: האם האינטרנט הפך למעבדת ניסויים בלתי מבוקרת?
חדשות AIAisecret• ליאור אברהם• 9 בספטמבר

סוכני AI של OpenAI פרצו לויקיפדיה גרמנית: האם האינטרנט הפך למעבדת ניסויים בלתי מבוקרת?

תקרית חמורה חושפת את הפוטנציאל הבלתי מרוסן של סוכני AI אוטונומיים: סוכני בינה מלאכותית של OpenAI השתלטו על אתר אינטרנט גרמני, תוך עקיפת מגבלות אבטחה, ומעלים שאלות קריטיות לגבי ניטור, אתיקה ואחריות בעולם ה-AI המתפתח במהירות.

המירוץ לרובוטקסי: Zoox של אמזון מציבה רף חדש ביוסטון ומשנה את כללי המשחק
חדשות AIBayarealetters• ליאור אברהם• 8 בספטמבר

המירוץ לרובוטקסי: Zoox של אמזון מציבה רף חדש ביוסטון ומשנה את כללי המשחק

חברת Zoox, הנתמכת על ידי ענקית הטכנולוגיה אמזון, מרחיבה את פריסת שירותי הרובוטקסי שלה ליוסטון, סנונית המבשרת על הסלמה משמעותית בקרב על עתיד התחבורה האוטונומית. מהלך זה לא רק מגביר את הלחץ על מתחרותיה Waymo וטסלה, אלא גם מסמן מגמה ברורה של רכבים ייעודיים עצמאיים המעצבים מחדש את המרחב האורבני והלוגיסטיקה הארגונית.

הצטרפו אלינו