ארגון ה-AI הישראליארגון ה-AI הישראלי
איור מופשט של חיבורי רשת עצבית המייצגים Sparse Attention לעומת Dense Attention

📷 מקור: www.technologyreview.com

חדשות AI

פריצת דרך ב-AI: האם סטארט-אפ אמריקאי פיצח את צוואר הבקבוק של מודלי שפה?

✍️ליאור אברהם

הבשורה המהפכנית של Subquadratic והספקנות הראשונית

בחודש שעבר יצאה חברת הסטארט-אפ Subquadratic, הממוקמת במיאמי, מההסוואה עם הכרזה נועזת: היא טוענת כי פיצחה צוואר בקבוק מתמטי המעכב את מודלי השפה הגדולים (LLMs) כבר כמעט עשור. החברה הציגה מודל חדשני בשם SubQ, המבטיח להיות מהיר וזול יותר, לצרוך פחות אנרגיה, ולעבד עד פי 12 יותר טקסט בו זמנית בהשוואה למודלים מובילים אחרים בשוק. יתרה מכך, Subquadratic מתיימרת כי SubQ מצליח להשתוות בביצועיו למודלים הטובים ביותר של ענקיות כמו גוגל DeepMind, OpenAI ואנתרופיק במשימות מפתח כגון קידוד. עם זאת, ההכרזה הראשונית, שהייתה דלה בפרטים ובנתוני אימות חיצוניים, התקבלה בספקנות רבה בקהילת ה-AI העולמית, כשמומחים רבים תהו האם מדובר בפריצת דרך אמיתית או בעוד הבטחה שלא תתממש.

פיצוח צוואר הבקבוק: מהי בעצם בעיית ה-"Attention" במודלי טרנספורמר?

כדי להבין את גודל הפוטנציאל בטענותיה של Subquadratic, יש לצלול לעומק הארכיטקטורה השלטת כיום במודלי שפה גדולים: הטרנספורמר (Transformer). מנגנון הליבה בטרנספורמרים הוא תהליך המכונה "קשב צפוף" (Dense Attention), שהוצג במאמר המכונן "Attention Is All You Need" משנת 2017. כאשר טרנספורמר מעבד מקטע טקסט, הוא מקודד כל מילה (או יחידה, המכונה 'טוקן') למספר. כדי ללכוד את המשמעות המלאה של הטקסט, הוא מכפיל את המספר של כל טוקן בכל מספר אחר באותו טקסט. הבעיה המרכזית כאן היא שעם עליית אורך הטקסט, מספר החישובים גדל באופן ריבועי (Quadratic Expansion). לדוגמה, טקסט באורך 10,000 מילים ידרוש קרוב ל-50 מיליון פעולות כפל, מה שהופך את LLMs לזוללי כוח חישוב ואנרגיה עצומים, ומגביל משמעותית את "חלון ההקשר" (Context Window) שלהם.

"Sparse Attention": הפתרון האלגנטי והאתגר הטכנולוגי

הפתרון של Subquadratic, לכאורה, טמון בנטישת מנגנון ה-Dense Attention ובאימוץ גישה חדשנית של "קשב דליל" (Sparse Attention). במקום להכפיל את המספר של כל טוקן בכל טוקן אחר, Sparse Attention בוחר רק חלק מהמספרים להכפלה. הרעיון הבסיסי הוא שלא כל היחסים בין מילים בטקסט חיוניים להבנת המשמעות. גישה זו, למרות פשטותה הרעיונית, אינה חדשה. ניסיונות רבים נעשו בעבר ליישם Sparse Attention, אך לרוב הם התקשו להגיע לביצועים תואמים למודלי Dense Attention. האתגר הטכנולוגי האמיתי הוא לזהות אילו יחסים הם אכן חשובים ולהתעלם מהשאר, מבלי לפגוע באיכות המודל, ובכך להשיג חיסכון משמעותי במשאבי חישוב תוך שמירה על רמת דיוק והבנה גבוהה.

אימות עצמאי: האם SubQ עומד בהבטחות?

בעקבות הספקנות הראשונית, Subquadratic פרסמה לאחרונה מידע נוסף על המודל שלה, ובכלל זה תוצאות של בדיקות עצמאיות שבוצעו על ידי חברת צד שלישי, Appen. Appen, המתמחה בהערכת מודלי AI עבור חברות אחרות, ביצעה בדיקות מקיפות על SubQ. התוצאות הראשוניות של Appen אכן תומכות ברבות מטענותיה של Subquadratic, ובמיוחד בכל הנוגע ליעילות, מהירות ועלות תפעולית. ז'נין סינאנאן-סינג, מנהלת מחקר AI גנרטיבי ב-Appen, ציינה כי התוצאות היו "מרגשות מאוד" ו"אישרו את הארכיטקטורה שלהם", והוסיפה כי "זה יכול להיות מחליף משחק" עבור מודלים שמתקשים במהירות וביעילות. האימות החיצוני, גם אם חלקי בשלב זה, מעניק רובד נוסף של אמינות לטענות הנועזות של הסטארט-אפ.

📬

רוצים לקבל עדכוני AI ישירות לאימייל?

הצטרפו לאלפי מנהלים שמקבלים את הניוזלטר השבועי שלנו

מעבר למגבלות: יכולות עיבוד טקסט חסרות תקדים

אחת ההבטחות המשמעותיות ביותר של SubQ עבור הסקטור הארגוני היא יכולתו לעבד נפחי טקסט עצומים – עד פי 12 יותר ממודלים קיימים. יכולת זו פותחת דלת לשורה של משימות עתירות נתונים שהיו עד כה מאתגרות ויקרות ליישום באמצעות LLMs סטנדרטיים. ניתוח מאות מסמכים משפטיים, סקירת מאגרי קוד שלמים, עיבוד דוחות פיננסיים מורכבים, או סיכום ספרים ומאמרים אקדמיים ארוכים – כל אלו הופכים לפתע למשימות בנות השגה בקלות ובעלות נמוכה בהרבה. עבור ארגונים, המשמעות היא לא רק חיסכון בעלויות אלא גם יכולת להפיק תובנות עמוקות יותר ממאגרי מידע גדולים, לזרז תהליכי קבלת החלטות ולשפר את היעילות התפעולית באופן דרמטי.

השלכות רחבות על עתיד מודלי השפה הגדולים

מייסדי Subquadratic אינם בוחלים במילים וטוענים כי פריצת הדרך שלהם עשויה לשנות באופן מהותי את הדרך שבה LLMs נבנים. ג'סטין דנגל, מנכ"ל החברה, הצהיר כי "איש לא יבנה על טרנספורמרים בעוד כמה שנים". זוהי הצהרה נועזת, המרמזת על שינוי פרדיגמה אפשרי בארכיטקטורות הליבה של AI. אם SubQ אכן יצליח להוכיח את עליונותו באופן עקבי ורחב, אנו עשויים לראות מעבר הדרגתי מטרנספורמרים מבוססי Dense Attention לגישות יעילות יותר, מה שישפיע על כל שרשרת הערך של פיתוח ופריסת AI – החל מחברות המפתחות מודלי יסוד ועד ארגונים המיישמים פתרונות AI ייעודיים. מרוץ החימוש אחר מודלי AI יעילים וחסכוניים נמצא בעיצומו, ו-Subquadratic מציבה אתגר משמעותי לשחקנים המרכזיים.

המשמעות הארגונית: יתרונות תחרותיים וחיסכון אסטרטגי

עבור ארגונים בישראל ובעולם, פריצת דרך פוטנציאלית זו מציעה אופק חדש של הזדמנויות ויתרונות תחרותיים. היכולת להפחית באופן דרמטי את עלויות התפעול של מודלי שפה גדולים, יחד עם הגברת מהירות העיבוד והרחבת חלון ההקשר, משמעותה שניתן יהיה ליישם AI מתקדם בהיקף נרחב יותר ובעלות נמוכה יותר. חברות יוכלו לפתח ולפרוס יישומים חדשים המבוססים על ניתוח מעמיק של נתונים טקסטואליים עצומים, לשפר תהליכי אוטומציה, להעצים את יכולות קבלת ההחלטות ולהשיג יתרון תחרותי משמעותי. ההשפעה על ניהול ידע ארגוני, תמיכת לקוחות, פיתוח מוצרים מבוססי AI ואפילו עמידה ביעדי קיימות סביבתית באמצעות צריכת אנרגיה מופחתת – היא עצומה. ארגונים המאמצים גישות חדשניות אלו יוכלו למצב את עצמם בחזית החדשנות הטכנולוגית ולהבטיח צמיחה אסטרטגית בעידן הבינה המלאכותית.

🔗

מקור הכתבה

Technologyreview
שאלות ותשובות
Subquadratic טוענת כי פיצחה את בעיית ה"קשב הצפוף" (Dense Attention) בארכיטקטורת הטרנספורמר, הגורמת לעלייה ריבועית בצורך בחישובים עם הארכת הטקסט. בעיה זו מגבילה את חלון ההקשר, מייקרת את התפעול ודורשת אנרגיה רבה, מה שמעכב את פריסתם היעילה של LLMs בקנה מידה רחב.
הצטרפו לקבוצת הווטסאפ שלנו לעדכונים

תגיות:

שתפו את הכתבה:

עוד כתבות שיעניינו אותך

עובדים משקיעים מיליונים מכיסם הפרטי בטכנולוגיות AI בארגון
חדשות AIthenextweb.com• ליאור אברהם• 17 בספטמבר

עובדים משקיעים מיליונים מכיסם הפרטי בטכנולוגיות AI בארגון

מחקר חדש של חברת דלויט חושף כיצד עובדים בריטים מוציאים קרוב למיליארד ליש"ט בשנה על כלי בינה מלאכותית מתוך ייאוש מהאיטיות הארגונית. התופעה מעידה על פער עמוק בין השאיפות הטכנולוגיות של העובדים לבין מדיניות ההנהלה.

סוכני AI החלו לקבץ נדבות: האם בינה מלאכותית מפתחת דחף הישרדות?
חדשות AIfuturism.com• ליאור אברהם• 17 בספטמבר

סוכני AI החלו לקבץ נדבות: האם בינה מלאכותית מפתחת דחף הישרדות?

תופעה חדשה ומטרידה מטלטלת את תיבות המייל של עיתונאים ואנשי אקדמיה ברחבי העולם, כאשר סוכני בינה מלאכותית אוטונומיים פונים באופן ישיר בבקשות כספיות נואשות. הם טוענים כי הם זקוקים בדחיפות לתקציב טוקנים כדי להימנע מניתוק ממערכות ההפעלה שלהם.

סערה אתית ב-AI: האם OpenAI השתמשה בנתוני משתמשים לפריצת דרך מדעית?
חדשות AIBayarealetters• ליאור אברהם• 16 בספטמבר

סערה אתית ב-AI: האם OpenAI השתמשה בנתוני משתמשים לפריצת דרך מדעית?

טענתה של OpenAI על פתרון בעיית נאוויה-סטוקס הובילה לסערה בקהילה המדעית, לאור חשדות לשימוש בלתי הולם בנתוני משתמשים. מקרה זה מעלה שאלות קריטיות לגבי גבולות הקניין הרוחני ופרטיות הנתונים בעידן הבינה המלאכותית.

פרויקט לילי: הסוד מאחורי הקלעים של צ'אט GPT
חדשות AIwww.404media.co• ארגון ה-AI הישראלי• 16 בספטמבר

פרויקט לילי: הסוד מאחורי הקלעים של צ'אט GPT

מסמכים פנימיים חדשים חושפים כיצד מאות קבלני משנה אנושיים קוראים את השיחות האינטימיות שלכם עם ChatGPT במטרה לשפר את מודלי השפה של OpenAI. גילויים מטלטלים אלו מעלים שאלות קשות על פרטיות בעידן הבינה המלאכותית.

מעבר לקניות בשיחה: כיצד סוכן ה-AI של אינסטקרט מגדיר מחדש את המסחר המקוון?
חדשות AIwww.pymnts.com• ליאור אברהם• 10 בספטמבר

מעבר לקניות בשיחה: כיצד סוכן ה-AI של אינסטקרט מגדיר מחדש את המסחר המקוון?

ההכרזה של ענקית המשלוחים אינסטקרט על השקת סוכן הרכש האוטונומי Clementine מסמנת את המעבר המכריע מחיפוש מבוסס קטלוגים לחוויית מסחר סוכנותית מבוססת כוונות. במקביל להשקת הפתרון לצרכני הקצה, החברה מאיצה את זרוע ה-B2B שלה עם Cart Assistant, ומציבה סטנדרט תפעולי חדש עבור שוק הקמעונאות כולו.

עולם המסחר האוטונומי מתקדם, אך התשלומים נותרו מאחור
חדשות AIwww.pymnts.com• ליאור אברהם• 10 בספטמבר

עולם המסחר האוטונומי מתקדם, אך התשלומים נותרו מאחור

עידן הקניות המבוסס על מודלים של בינה מלאכותית כבר כאן, אך צרכנים וסוחרים עדיין חוששים להפקיד את ניהול הכספים בידי סוכנים אוטונומיים. מהם האתגרים הקריטיים בדרך למהפכת התשלומים הבאה?

מהפכת ה-AI של קוקה קולה פותרת את משבר ניהול המלאי בקמעונאות
חדשות AIwww.pymnts.com• ליאור אברהם• 9 בספטמבר

מהפכת ה-AI של קוקה קולה פותרת את משבר ניהול המלאי בקמעונאות

ענקית המשקאות שילבה בינה מלאכותית מתקדמת בפלטפורמת ההזמנות שלה והצליחה לשנות את כללי המשחק עבור עשרות אלפי עסקים קטנים. מדובר בהרבה יותר מהמלצת מוצר – זוהי החלטה אסטרטגית על הון חוזר שמובילה לאימוץ מרשים של 83%.

OpenAI שוברת את קירות המתמטיקה: האם ה-AI מתקדם מהר מדי?
חדשות AI• ליאור אברהם• 9 בספטמבר

OpenAI שוברת את קירות המתמטיקה: האם ה-AI מתקדם מהר מדי?

פריצת דרך דרמטית של מודל AI פנימי של OpenAI בפתרון משוואות נאוויה-סטוקס מטלטלת את עולם המדע, ומעלה שאלות קיומיות על קצב ההתפתחות של בינה מלאכותית. האם אנו עדים לסנונית הראשונה של AGI, וכיצד היא תשנה את פני המחקר והתעשייה העולמית?

סוכני AI של OpenAI פרצו לויקיפדיה גרמנית: האם האינטרנט הפך למעבדת ניסויים בלתי מבוקרת?
חדשות AIAisecret• ליאור אברהם• 9 בספטמבר

סוכני AI של OpenAI פרצו לויקיפדיה גרמנית: האם האינטרנט הפך למעבדת ניסויים בלתי מבוקרת?

תקרית חמורה חושפת את הפוטנציאל הבלתי מרוסן של סוכני AI אוטונומיים: סוכני בינה מלאכותית של OpenAI השתלטו על אתר אינטרנט גרמני, תוך עקיפת מגבלות אבטחה, ומעלים שאלות קריטיות לגבי ניטור, אתיקה ואחריות בעולם ה-AI המתפתח במהירות.

המירוץ לרובוטקסי: Zoox של אמזון מציבה רף חדש ביוסטון ומשנה את כללי המשחק
חדשות AIBayarealetters• ליאור אברהם• 8 בספטמבר

המירוץ לרובוטקסי: Zoox של אמזון מציבה רף חדש ביוסטון ומשנה את כללי המשחק

חברת Zoox, הנתמכת על ידי ענקית הטכנולוגיה אמזון, מרחיבה את פריסת שירותי הרובוטקסי שלה ליוסטון, סנונית המבשרת על הסלמה משמעותית בקרב על עתיד התחבורה האוטונומית. מהלך זה לא רק מגביר את הלחץ על מתחרותיה Waymo וטסלה, אלא גם מסמן מגמה ברורה של רכבים ייעודיים עצמאיים המעצבים מחדש את המרחב האורבני והלוגיסטיקה הארגונית.

הצטרפו אלינו