דלג לתוכן הראשי
צילום: גוגל
צילום: גוגל

גוגל חשפה את המודל החזק ביותר שלה - ומה הקשר לישראל?

נתנאל שמי
נתנאל שמי

מעבדת Google DeepMind מכריזה על Gemini 4 Argon, מודל הדגל הראשון בדור הרביעי המסוגל להפיק פלט רציף של מיליון טוקנים • הפיתוח מלווה בשיתוף פעולה ישראלי עם ענקית הסייבר Wiz שאיתרה פרצות קריטיות בבתי חולים • וגם: הסיבה שהמערכת זמינה בשלב זה לקבוצת שותפים ספציפית בלבד


ענקית הטכנולוגיה גוגל מנחיתה סוף סוף את התשובה המיוחלת שלה למרוץ מודלי החזית ומכריזה רשמית על הדור הבא של הבינה המלאכותית: Gemini 4 Argon. מדובר במודל הדגל הראשון במשפחת ה-Gemini 4 שפותח במעבדת Google DeepMind, ומשלב חיבור ישיר להייטק הישראלי. לצד נתונים שוברי שיאים ופלט חסר תקדים, החברה חשפה שיתוף פעולה הדוק עם חברת הסייבר הישראלית Wiz, שרתמה את המודל לחשיפת חולשות אבטחה קריטיות בעולם האמיתי.

ג'מיני | צילום: שאטרסטוק

תוכנית Fairwind ושיתוף הפעולה הביטחוני

בניגוד להשקות קודמות שבהן גוגל שחררה מודלים לשימוש חופשי ב-AI Studio ובסמארטפונים, ארגון מושק בשלב זה אך ורק לקבוצה מצומצמת של שותפי הגנת סייבר במסגרת תוכנית מיוחדת בשם Fairwind. בנוסף, החברה פועלת תחת הליך בדיקה וולונטרי מול גורמי ביטחון וממשל בארצות הברית, הבוחנים את המודל בסביבות מבוקרות בטרם תאושר הפצתו. בגוגל מסבירים כי העוצמה של המודל בתחומי הסייבר ההתקפי וההנדסה כה חריגה, עד שהיא מחייבת פריסה זהירה והדרגתית כדי למנוע שימוש לרעה.

החידוש ההנדסי המרשים ביותר ב-Gemini 4 Argon הוא שבירת תקרת הפלט. בעוד שמודלים מתחרים והדורות הקודמים של ג'מיני הוגבלו לפלט של 64 אלף טוקנים לתשובה בודדת, ארגון מסוגל לייצר רצף חשיבה ופלט חסר תקדים של מיליון טוקנים בבת אחת – זינוק של פי 15. יכולת זו מאפשרת לסוכני AI לבצע תהליכי מחקר ממושכים, לכתוב ספריות קוד שלמות ולפתור בעיות ארגוניות עמוקות ברצף פעולה יחיד (Single Trajectory), מבלי לאבד את הקו הלוגי ומבלי להזדקק לחלוקה לפרומפטים מקוטעים.

מבחני הביצועים: עוקף את GPT-6 ואת קלוד

במבחני הביצועים שפרסמה גוגל, Argon מציג עליונות בולטת ברוב קטגוריות הפיתוח ועבודת הידע המשרדית. במבחן הנדסת התוכנה האוטונומית DeepSWE v1.1 רשם המודל ציון של 77.9% ועקף את GPT-6 Astra של OpenAI (שקיבל 74.1%) ואת Claude Opus 5.5 (74.2%). במדד ה-Vals Index המשקלל משימות פיננסים, מיסוי וקוד לפי תרומתן לתוצר, כבש המודל את הפסגה עם 68.9%, ובמבחן הסוכנים המשפטיים של Harvey השיג 19.4% – פער עצום לעומת 5.4% בלבד של מודל הדגל של סם אלטמן.

עם זאת, המודל אינו מוביל בכל הגזרות: במבחן שורת הפקודה Terminal-Bench 4.0 המודל של אנתרופיק עדיין מוביל בפער ניכר (66.4% מול 57.4%), ובמבחני הפעלת מחשב (OSWorld) מודל ה-Astra שומר על יתרון קל. בתוך גוגל עצמה, מהנדסי החברה כבר משתמשים בארגון לייעול חישובי קוונטים, לחיסכון של מאות טרה-בייט בזיכרון חוות השרתים, ולהמרת מאות אלפי שורות קוד מ-C++ לשפת Rust המאובטחת בליבת מערכת ההפעלה Fuchsia.

טבלת ההשוואה המלאה | צילום: גוגל

החיבור לחברת Wiz הישראלית ומחירי העתיד

אחת מגולות הכותרת בהשקה היא שיתוף פעולה הדוק מול ענקית אבטחת הענן הישראלית Wiz. במסגרת יוזמת Scan for Good, חוקרי Wiz רתמו את מודל ה-Argon ללא מעקות בטיחות כדי לסרוק תשתיות ציבוריות קריטיות, וחשפו פרצת אבטחה חמורה בתוכנה רפואית המשמשת בתי חולים ברחבי העולם – חולשה שמודלים קודמים החמיצו לחלוטין. במבחני חדירה עיוורים (Penetration Testing) שערכה Wiz, השיג המודל 70.9% בהצלחת תקיפת אתרים חיים ללא גישה לקוד המקור.

חברת Wiz | צילום: שאטרסטוק

בגזרת מנגנוני הבטיחות, גוגל מציגה עמידות שיא בפני מתקפות "הזרקת פקודות עקיפה" (Indirect Prompt Injection), שבהן האקרים מטמיעים קוד זדוני בתוך מסמכים או אתרים כדי לחטוף את המודל. במבחן המחמיר של מכון Gray Swan, שיעור הפריצה של ארגון עמד על 0.7% בלבד לאחר 15 ניסיונות תקיפה חוזרים, לעומת מעל 50% במודלים מתחרים. בנוסף, החברה הטמיעה מעקב הדוק אחר שרשרת החשיבה של המודל כדי לעצור סוכנים שחורגים מהמשימה המקורית.

כאשר ייפתח לשימוש רחב, המודל יוצע במחיר היכרות תחרותי של 2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט, עם הנחה של 95% לקריאות זיכרון מטמון (0.10 דולר). בשלב הבא מתכננת גוגל לפתוח את הגישה למפתחי API בתשלום ולמנויי חבילת העילית Google AI Ultra, ורק בהמשך לשלבו במוצרי הצריכה הרגילים. ההשקה המאופקת מוכיחה כי גוגל אכן פיתחה מפלצת ביצועים, אך המבחן האמיתי יהיה מתי המשתמשים הפשוטים יזכו להניח עליה את הידיים.