אתמול, 30 בספטמבר 2026, גוגל הכריזה רשמית על Gemini 4 Argon — המודל החזק ביותר שהיא בנתה עד היום, ולפי הנתונים שהיא מציגה, הראשון שמחזיר אותה בבירור לצמרת מול OpenAI ו-Anthropic. אבל לפני שמתרגשים: נכון לעכשיו כמעט אף ארגון בישראל לא יכול להשתמש בו. Argon נפתח בשלב הראשון רק לקבוצה סגורה של מגיני סייבר, ולשאר העולם גוגל מבטיחה זמינות "בהקדם האפשרי", בלי תאריך. כתבתי כאן מה בדיוק הושק, מה המספרים אומרים, ובעיקר — מה ארגון שרוצה להיות מוכן צריך לעשות כבר השבוע.
הדברים שצריך לדעת
- מה הושק: Gemini 4 Argon, מודל ה-Frontier החדש של גוגל, שמיועד למשימות מקצועיות ארוכות ומורכבות — פיתוח תוכנה, פיננסים, משפטים וסייבר.
- מי יכול להשתמש: כרגע רק ארגוני הגנת סייבר נבחרים במסגרת תוכנית Fairwind. לקוחות API משלמים ומנויי Google AI Ultra יהיו הבאים בתור.
- כמה זה עולה: מחיר השקה של 2 דולר למיליון טוקנים בקלט ו-10 דולר בפלט, שיעלה בהמשך ל-4 ו-20 דולר.
- החידוש הטכני הבולט: עד מיליון טוקנים בפלט אחד, לעומת 64 אלף בדור הקודם — מה שמאפשר לו לייצר עבודות שלמות ולא רק תשובות.
- המסר לארגונים: זה הזמן להכין את מקרי הבוחן והמדיניות, כדי שביום שהמודל ייפתח — תהיו מוכנים להשוות ולהחליט תוך ימים ולא חודשים.
מה בדיוק גוגל השיקה
Argon הוא לא עוד עדכון גרסה. גוגל מציגה אותו כמודל שבנוי ל"עבודה ארוכת טווח": משימות שנמשכות שעות, עוברות דרך עשרות שלבים, ודורשות מהמודל לתכנן, לבצע, לבדוק את עצמו ולתקן. לפי הדיווח ב-TechCrunch, המודל מיועד לקוד, מחקר, כתיבה ועבודת הגנת סייבר, וגם לניתוח ויזואלי של וידאו ארוך וגרפים.
הנתון הטכני שהכי תפס אותי הוא מגבלת הפלט: עד מיליון טוקנים בתשובה אחת, לעומת 64 אלף בדור הקודם. חשוב לדייק כאן, כי ברשת כבר מבלבלים: מדובר בפלט ולא בחלון ההקשר. כפי שמציין Choosely, גוגל עדיין לא פרסמה מפרט רשמי לגודל הקלט. בפועל, המשמעות היא מודל שיכול להחזיר מיגרציית קוד שלמה, דוח מחקר מלא או ניתוח של מאות חוזים — בריצה אחת.
גוגל גם מספרת שהיא כבר משתמשת ב-Argon בעצמה: בהעברת בסיסי קוד גדולים מ-C/C++ ל-Rust בהיקף של עד 800 אלף שורות, ובאופטימיזציית זיכרון שפינתה לדבריה יותר מ-300 טרה-בייט בתשתיות שלה. כמו שאמר קוראי קבוקצ'וגלו, סגן נשיא בכיר ב-Google DeepMind: Argon "משנה מהיסוד את הדרך שבה אנחנו עובדים".
המספרים: איפה Argon מוביל
הנתונים הבאים מגיעים מגוגל עצמה, ולכן כדאי לקרוא אותם כטענות של היצרן עד שיגיעו מדידות עצמאיות. עדיין, הם מציירים תמונה ברורה של היכן המודל חזק:
| מדד | מה הוא בודק | התוצאה של Argon |
|---|---|---|
| DeepSWE v1.1 | הנדסת תוכנה במשימות אמיתיות | 77.9% |
| CWE-bench v1 | תיקון חולשות אבטחה בקוד | 68% (תיקו במקום הראשון) |
| AutomationBench | אוטומציה של תהליכים עסקיים | 51.3% (מקום ראשון) |
| LVBench | הבנת וידאו ארוך | 91.7% |
| Vals Index | פיננסים, קוד, משפטים ומיסוי | מוביל לפי גוגל |
לפי TechCrunch, גוגל טוענת ש-Argon עוקף בכמה מדדים את GPT-6 Astra של OpenAI ואת מודלי Fable ו-Opus של Anthropic. כתבתי כאן בעבר על GPT-6 Astra והקפיצה לסוכנים ארגוניים ועל השקת Claude Fable 5 — ולכן אני ממליץ להתייחס להשוואה הזאת בזהירות: כל אחת מהחברות בוחרת את המדדים שבהם היא נראית הכי טוב.
למה דווקא מגיני סייבר קיבלו אותו ראשונים
זה החלק הכי מעניין בעיניי בהשקה. גוגל מתארת את Argon כמודל שמסוגל לאתר, לאמת ולתקן חולשות תוכנה קריטיות באופן אוטונומי. לפי הבלוג הרשמי, חברת Wiz כבר משתמשת בו ביוזמת "Scan for Good", והוא חשף חולשות קריטיות במערכות בריאות שמודלים קודמים פספסו. במסגרת תוכנית Fairwind, ארגוני הגנה נבחרים מקבלים את המודל בלי מגבלות הסייבר שיחולו על הציבור הרחב.
גוגל גם מציינת שההפצה מתבצעת בשלבים, בתיאום עם תהליך בדיקה וולונטרי של ממשלת ארה"ב לפני שחרור. ההיגיון ברור: מודל שיודע למצוא חולשות יכול לשמש גם תוקפים, ולכן הגישה הראשונה ניתנת למי שמתקן אותן.










