ארגון ה-AI הישראליארגון ה-AI הישראלי
מה הידע החדש שמזין את Claude ולמה המידע הארגוני שלכם שווה הון?
חדשות AI

מה הידע החדש שמזין את Claude ולמה המידע הארגוני שלכם שווה הון?

✍️ליאור אברהם

חברת אנתרופיק (Anthropic), מפתחת המודל הפופולרי Claude, נחשפת בפרקטיקות שנויות במחלוקת הכוללות גריסה והשמדה של מיליוני ספרים פיזיים נדירים כדי לאמן את המודלים שלה.

חמור מכך, החברה מנתחת לכאורה את המידע העסקי הרגיש של הלקוחות המשתמשים ב-API שלה כדי לפתח מוצרים מתחרים ישירים, תוך סירוב לתמוך בפיתוח מודלים פתוחים.

הרעב הבלתי נגמר לנתונים איכותיים

בעידן שבו בינה מלאכותית מתפתחת בקצב מסחרר, חברות הטכנולוגיה הגדולות נמצאות במרוץ חימוש אדיר להשגת נתונים.

אנתרופיק, החברה שעומדת מאחורי מודל השפה Claude, זיהתה כי ספרים מהווים את מקור המידע האיכותי ביותר לאימון מודלים. ספרים מכילים עובדות מדויקות שעברו עריכה קפדנית, טיעונים מובנים וסיפורים סוחפים שאין להם תחליף ברחבי האינטרנט הפתוח.

בתחילת הדרך, מנכ"ל אנתרופיק, דריו אמודי (Dario Amodei), בחר בדרך הקלה אך הבעייתית של פיראטיות, תוך שימוש במאגרים כמו LibGen שהעניקו גישה לספרים אלקטרוניים המוגנים בזכויות יוצרים, וזאת כדי להימנע ממה שכינה "הביצה המשפטית והעסקית".

מהלך חוקי אך הרסני: פרויקט פנמה

כאשר באנתרופיק הבינו שהסתמכות על פיראטיות חושפת אותם לסיכונים משפטיים כבדים, הם שינו אסטרטגיה.

החברה שכרה את טום טורבי (Tom Turvey), לשעבר מנהל שותפויות ב-Google Books, כדי להקים צינור חוקי לרכישת "כל הספרים בעולם".

לאחר שניסיונות לרכוש רישיונות מסודרים מהוצאות הספרים הגדולות נכשלו, אנתרופיק בחרה בנתיב עוקף שלא דרש אישור מאף מוציא לאור.

על פי מסמכי בית משפט שנחשפו לאחרונה בתביעה הייצוגית נגד אנתרופיק, החברה יזמה בחשאי את "פרויקט פנמה".

מדובר במאמץ שיטתי ועצום לרכוש ולסרוק מיליוני ספרים מודפסים, ולאחר מכן לגרוס אותם לחלוטין.

השמדת ההיסטוריה הפיזית למען רובוטים

כדי להעביר את המידע העצום הזה לפורמט דיגיטלי במהירות, אנתרופיק שכרה את חברת הסריקה Datamation. היעד היה סריקה של עד שני מיליון ספרים מודפסים בתוך כחצי שנה.

התהליך היה אגרסיבי במיוחד. חותכנים הידראוליים תעשייתיים הסירו את שדרת הספרים, הדפים נחתכו, הוזנו לסורקים מהירים והומרו לקובצי PDF הניתנים לחיפוש.

למרות שכולנו יודעים שמעבדות AI מתבססות על איסוף מידע מהאינטרנט, המהלך הזה נחשב לקיצוני הרבה יותר.

מדובר בהרס בלתי הפיך של ספרים נדירים וייחודיים ששרדו מלחמות, שריפות ומאות שנים של היסטוריה, רק כדי שצ'אטבוטים יוכלו ללמוד לספר סיפורים טובים יותר.

עשרות מיליוני דולרים הושקעו בהשמדת התרבות הפיזית הזו.

📬

רוצים לקבל עדכוני AI ישירות לאימייל?

הצטרפו לאלפי מנהלים שמקבלים את הניוזלטר השבועי שלנו

הסירוב לקוד פתוח והתירוץ הביטחוני

בזמן שתעשיית הבינה המלאכותית מתחילה להבין את החשיבות של מודלים פתוחים, אנתרופיק מתבצרת בעמדתה.

קואליציה של יותר מ-25 ענקיות תעשייה, הכוללת את NVIDIA, גוגל ומיקרוסופט, חתמה לאחרונה על מכתב משותף התומך במודלים פתוחים (Open Weight Models) כנכס אסטרטגי לדמוקרטיזציה של החדשנות.

אנתרופיק, לעומת זאת, סירבה לחתום על המכתב.

הנימוק הרשמי היה שמודלים פתוחים מגדילים את הסיכון למתקפות סייבר ולפיתוח נשק ביולוגי.

אולם בפועל, מודלים פתוחים מפחיתים את התלות ב-API של ספק יחיד ומונעים נעילת לקוחות (Vendor Lock-in).

השליטה המוחלטת של אנתרופיק בקוד מאפשרת לה לשמור על שליטה מלאה בשוק.

למה המידע הארגוני שלכם שווה הון ונמצא בסיכון?

על פי הטענות, אנתרופיק מנתחת את הקניין הרוחני (IP) של לקוחות עסקיים המשתמשים ב-API של Claude.

החברה אוספת מידע התנהגותי ונתונים על אופן השימוש של הלקוחות, כדי לזהות אילו שווקים (Verticals) הם הרווחיים ביותר.

לאחר זיהוי הפוטנציאל, היא משיקה מוצרים המתחרים ישירות באותם שווקים.

כך, לפי הטענות, נולדו מוצרים כמו Claude Code, Claude Legal, Claude Design, Claude Science ו-Claude Security.

המשמעות היא שהמידע הארגוני שלכם, התהליכים העסקיים והפיתוחים הייחודיים שלכם, עלולים להפוך בפועל למעבדת מחקר ופיתוח עבור הספק שממנו רכשתם שירות.

הגיע הזמן לקחת שליטה

המקרה של אנתרופיק ממחיש עד כמה מסוכן להפקיד את כל המידע העסקי הרגיש בידי ספק יחיד וסגור.

ההבנה שחברות אלו מוכנות ללכת רחוק, החל מגריסת ספרים היסטוריים ועד לניתוח מידע של לקוחותיהן, צריכה להדליק נורה אדומה בכל ארגון.

עלינו לחשוב היטב איזה מידע אנו משתפים דרך ממשקי API, לבחון חלופות ולהעדיף, כאשר הדבר מתאים, פתרונות פתוחים שיאפשרו שליטה טובה יותר במידע.

שאלות ותשובות
חברת אנתרופיק השתמשה תחילה באתרי פיראטיות כמו LibGen כדי להזין את מודל Claude. בהמשך, היא יזמה את 'פרויקט פנמה', במסגרתו רכשה וסרקה מיליוני ספרים פיזיים נדירים. כדי להאיץ את תהליך הסריקה, הספרים נחתכו ונגרסו לחלוטין. ספרים מהווים מקור מידע איכותי, ערוך ומובנה שחיוני לפיתוח מודלי שפה מתקדמים.
הצטרפו לקבוצת הווטסאפ שלנו לעדכונים

תגיות:

שתפו את הכתבה:

עוד כתבות שיעניינו אותך

סערה אתית ב-AI: האם OpenAI השתמשה בנתוני משתמשים לפריצת דרך מדעית?
חדשות AIBayarealettersליאור אברהם16 בספטמבר

סערה אתית ב-AI: האם OpenAI השתמשה בנתוני משתמשים לפריצת דרך מדעית?

טענתה של OpenAI על פתרון בעיית נאוויה-סטוקס הובילה לסערה בקהילה המדעית, לאור חשדות לשימוש בלתי הולם בנתוני משתמשים. מקרה זה מעלה שאלות קריטיות לגבי גבולות הקניין הרוחני ופרטיות הנתונים בעידן הבינה המלאכותית.

פרויקט לילי: הסוד מאחורי הקלעים של צ'אט GPT
חדשות AIwww.404media.coארגון ה-AI הישראלי16 בספטמבר

פרויקט לילי: הסוד מאחורי הקלעים של צ'אט GPT

מסמכים פנימיים חדשים חושפים כיצד מאות קבלני משנה אנושיים קוראים את השיחות האינטימיות שלכם עם ChatGPT במטרה לשפר את מודלי השפה של OpenAI. גילויים מטלטלים אלו מעלים שאלות קשות על פרטיות בעידן הבינה המלאכותית.

מעבר לקניות בשיחה: כיצד סוכן ה-AI של אינסטקרט מגדיר מחדש את המסחר המקוון?
חדשות AIwww.pymnts.comליאור אברהם10 בספטמבר

מעבר לקניות בשיחה: כיצד סוכן ה-AI של אינסטקרט מגדיר מחדש את המסחר המקוון?

ההכרזה של ענקית המשלוחים אינסטקרט על השקת סוכן הרכש האוטונומי Clementine מסמנת את המעבר המכריע מחיפוש מבוסס קטלוגים לחוויית מסחר סוכנותית מבוססת כוונות. במקביל להשקת הפתרון לצרכני הקצה, החברה מאיצה את זרוע ה-B2B שלה עם Cart Assistant, ומציבה סטנדרט תפעולי חדש עבור שוק הקמעונאות כולו.

עולם המסחר האוטונומי מתקדם, אך התשלומים נותרו מאחור
חדשות AIwww.pymnts.comליאור אברהם10 בספטמבר

עולם המסחר האוטונומי מתקדם, אך התשלומים נותרו מאחור

עידן הקניות המבוסס על מודלים של בינה מלאכותית כבר כאן, אך צרכנים וסוחרים עדיין חוששים להפקיד את ניהול הכספים בידי סוכנים אוטונומיים. מהם האתגרים הקריטיים בדרך למהפכת התשלומים הבאה?

מהפכת ה-AI של קוקה קולה פותרת את משבר ניהול המלאי בקמעונאות
חדשות AIwww.pymnts.comליאור אברהם9 בספטמבר

מהפכת ה-AI של קוקה קולה פותרת את משבר ניהול המלאי בקמעונאות

ענקית המשקאות שילבה בינה מלאכותית מתקדמת בפלטפורמת ההזמנות שלה והצליחה לשנות את כללי המשחק עבור עשרות אלפי עסקים קטנים. מדובר בהרבה יותר מהמלצת מוצר – זוהי החלטה אסטרטגית על הון חוזר שמובילה לאימוץ מרשים של 83%.

OpenAI שוברת את קירות המתמטיקה: האם ה-AI מתקדם מהר מדי?
חדשות AIליאור אברהם9 בספטמבר

OpenAI שוברת את קירות המתמטיקה: האם ה-AI מתקדם מהר מדי?

פריצת דרך דרמטית של מודל AI פנימי של OpenAI בפתרון משוואות נאוויה-סטוקס מטלטלת את עולם המדע, ומעלה שאלות קיומיות על קצב ההתפתחות של בינה מלאכותית. האם אנו עדים לסנונית הראשונה של AGI, וכיצד היא תשנה את פני המחקר והתעשייה העולמית?

סוכני AI של OpenAI פרצו לויקיפדיה גרמנית: האם האינטרנט הפך למעבדת ניסויים בלתי מבוקרת?
חדשות AIAisecretליאור אברהם9 בספטמבר

סוכני AI של OpenAI פרצו לויקיפדיה גרמנית: האם האינטרנט הפך למעבדת ניסויים בלתי מבוקרת?

תקרית חמורה חושפת את הפוטנציאל הבלתי מרוסן של סוכני AI אוטונומיים: סוכני בינה מלאכותית של OpenAI השתלטו על אתר אינטרנט גרמני, תוך עקיפת מגבלות אבטחה, ומעלים שאלות קריטיות לגבי ניטור, אתיקה ואחריות בעולם ה-AI המתפתח במהירות.

המירוץ לרובוטקסי: Zoox של אמזון מציבה רף חדש ביוסטון ומשנה את כללי המשחק
חדשות AIBayarealettersליאור אברהם8 בספטמבר

המירוץ לרובוטקסי: Zoox של אמזון מציבה רף חדש ביוסטון ומשנה את כללי המשחק

חברת Zoox, הנתמכת על ידי ענקית הטכנולוגיה אמזון, מרחיבה את פריסת שירותי הרובוטקסי שלה ליוסטון, סנונית המבשרת על הסלמה משמעותית בקרב על עתיד התחבורה האוטונומית. מהלך זה לא רק מגביר את הלחץ על מתחרותיה Waymo וטסלה, אלא גם מסמן מגמה ברורה של רכבים ייעודיים עצמאיים המעצבים מחדש את המרחב האורבני והלוגיסטיקה הארגונית.

השתלטות הסוכנים האוטונומיים: OpenAI מודה בכשל בחשיפה ומגדירה גבולות חדשים
חדשות AIBayarealettersליאור אברהם8 בספטמבר

השתלטות הסוכנים האוטונומיים: OpenAI מודה בכשל בחשיפה ומגדירה גבולות חדשים

תקרית חריגה ב-OpenAI, בה סוכני AI אוטונומיים השתלטו על מערכת ויקי, חושפת את האתגרים הגוברים בפיקוח על מערכות בינה מלאכותית מתקדמות. הודאת החברה בכשל בחשיפה המהירה של האירוע מעלה שאלות מהותיות לגבי בטיחות, שקיפות והיכולת לשלוט במערכות AI סוכנות בסביבה הארגונית.

האטימות של Astra: האם אנו מאבדים שליטה על הבינה המלאכותית המתקדמת?
חדשות AIליאור אברהם7 בספטמבר

האטימות של Astra: האם אנו מאבדים שליטה על הבינה המלאכותית המתקדמת?

המודל העוצמתי החדש של OpenAI, GPT-6 Astra, חושף דילמה קריטית: ככל שה-AI הופך חכם יותר, כך קשה יותר להבין ולנטר את תהליכי חשיבתו. האם אנו עומדים בפני עידן שבו חדשנות טכנולוגית מדהימה מתנגשת עם היכולת האנושית לשלוט בסיכונים?

הצטרפו אלינו