גוגל החלה בהפצה הדרגתית של Gemini 4 Argon, מודל הבינה המלאכותית המתקדם ביותר מתוצרתה עד כה. בשונה מהשקות קודמות של מודלים מבוססי בינה מלאכותית (AI), החברה בחרה להעניק גישה ראשונית למודל העוצמתי אך ורק לאנשי מקצוע ולארגונים בתחום הגנת הסייבר שעברו תהליך אימות, לצד צוותים פנימיים בתוך גוגל עצמה. צעד זה מציג גישה זהירה שנועדה לרתום את יכולות ה-AI לטובת מגיני הרשת ולחזק את ההגנות מפני איומים, עוד בטרם ייפתח הכלי לציבור הרחב. ההחלטה להתמקד ראשית בעולם הסייבר משקפת את המורכבות בהפצת מודלים מתקדמים במיוחד. המודל החדש מציג ביצועים העולים על אלה של המתחרים המובילים בשוק ברוב מדדי ההשוואה, תוך התמקדות ביכולות אוטונומיות לאיתור חולשות אבטחה, כתיבה מחדש של קוד ותיקון פרצות אבטחה מורכבות.
גישה מבוקרת ומנגנוני אבטחה מחמירים
הגישה למודל Argon מוגבלת כעת לחברות הלוקחות חלק בתוכנית Fairwind של גוגל. התוכנית, שהושקה בתחילת חודש ספטמבר עם המודל הקטן יותר Gemini 3.8 Flash Cyber, צירפה אליה כבר למעלה מ- 650 ארגונים, בהם חברות אבטחה מובילות כמו Palo Alto Networks ו-CrowdStrike. ארכיטקט הבינה המלאכותית הראשי בגוגל, קוראי קבוקצ'אולו, הסביר כי שחרור יכולות ברמה כזאת מחייב יישום של גישה מדורגת.
במסגרת תהליך ההשקה, גוגל משתתפת בהליך ההתנדבותי של הממשל האמריקאי לבחינת מודלים טרם שחרורם, וממשיכה לפתח מנגנוני הגנה מפני שימוש לרעה במודל למתקפות סייבר או לפיתוח נשק. בחברה מציינים כי Argon מפגין עמידות גבוהה יותר מכל מודל קודם שלה מפני מתקפות הזרקת הנחיות עקיפה (indirect prompt injection). כדי למנוע חריגה מהרשאות, המערכת כוללת רכיבי ניטור נפרדים העוקבים בזמן אמת אחר שרשרת החשיבה (chain of thought) והפעולות של המודל. רכיבים אלו מסוגלים להפסיק את פעולתו מיד אם הוא חורג מהכוונות שהגדיר המשתמש.
יתרון במבחני הביצועים והרחבת מגבלת הפלט
במבחנים שערכה גוגל עקף Argon מודלים מתחרים כמו Claude Opus 5.5 של Anthropic ו-GPT-6 Astra של OpenAI ברוב המדדים. מתוך 18 מבחני השוואה שהציגה החברה, הוביל Argon באופן מוחלט ב-12 מהם.
| מבחן ביצועים (Benchmark) | Gemini 4 Argon | Claude Opus 5.5 | GPT-6 Astra |
|---|---|---|---|
| DeepSWE v1.1 (משימות הנדסת תוכנה) | 77.9% | 74.2% | 74.1% |
| AutomationBench (תהליכים עסקיים) | 51.3% | 42.5% | לא צוין |
| CWE-bench v1 (תיקון חולשות אבטחה) | 68.0% | לא צוין | 68.0% |
במבחן DeepSWE v1.1, המודד ביצוע במשימות הנדסת תוכנה ארוכות טווח, השיג Argon ציון של 77.9%, לעומת 74.2% של Opus 5.5 ו- 74.1% של Astra. במבחן AutomationBench לאוטומציה עסקית מקצה לקצה, נרשם פער גדול אף יותר עם 51.3% לטובת Argon לעומת 42.5% ל-Opus 5.5. עם זאת, Opus 5.5 עדיין מחזיק בהובלה במבחן Terminal-Bench 4.0, בעוד Astra שומר על יתרון במבחן FrontierSWE v2.
כדי לתמוך במשימות ארוכות ומורכבות, הגדילה גוגל את מגבלת הפלט של המודל ל- 1 מיליון טוקנים (tokens) - זינוק חד לעומת מגבלה של 64,000 טוקנים בלבד במודלי Gemini קודמים.
יישום פנימי בגוגל ואיתור חולשות קריטיות
אלפי עובדים בגוגל כבר משתמשים ב-Argon באופן פעיל. סוכני AI המבוססים על המודל שולבו בפרויקטים נרחבים להמרת קוד ישן משפות C ו-C++ לשפת Rust הבטוחה יותר. השימוש נפרס החל מספריות ליבה המכילות עשרות אלפי שורות קוד, ועד לרמת ליבת מערכת ההפעלה Fuchsia (מנוע Zircon), המורכבת ממיליוני שורות קוד.
בפרויקט לפענוח וידאו בקוד פתוח (libgav1), הסוכנים שכתבו 32,000 שורות קוד קריטיות לקוד Rust בטוח. כתוצאה מכך, הרכיב פועל כעת במהירות הגבוהה פי 2.7 מהגרסה הקודמת, ללא שום שינוי בפלט הווידאו. בנוסף, סריקות שביצע המודל לאיתור בזבוז זיכרון במרכזי הנתונים של גוגל הביאו לחיסכון של מעל 300 טביבייט (tebibytes) של זיכרון.
החברות בתוכנית Fairwind והצוותים הפנימיים מורשים להשתמש בגרסה שבה הוסרו מגבלות הסייבר, מה שמאפשר למודל לאתר ולתקן חולשות תוכנה באופן עצמאי: חברת אבטחת הענן Wiz, הנמצאת בבעלות גוגל, שילבה את Argon בתוכנית הסריקה החינמית Scan for Good למציאת פרצות אבטחה בתשתיות ציבוריות. במהלך הסריקות, איתר המודל חולשה קריטית החושפת מידע רפואי אישי בתוכנה המשמשת בתי חולים ברחבי העולם - פרצה שמודלים מתקדמים קודמים לא הצליחו לזהות.
תמחור וזמינות עתידית
גוגל טרם פרסמה תאריך יעד לפתיחת הגישה למפתחים בתשלום ולמנויי Google AI Ultra. עם זאת, החברה כבר חשפה את מבנה התמחור הצפוי:
מחיר השקה: $2 למיליון טוקנים של קלט (input) ו- $10 למיליון טוקנים של פלט (output).
הנחת זיכרון מטמון: מפתחים שמשתמשים בקלט שמאוחסן בזיכרון המטמון (cached input) ייהנו מהנחה של 95%.
מחיר קבוע בהמשך: בתום תקופת ההשקה, המחירים יעלו ל- $4 לקלט ו- $20 לפלט למיליון טוקנים - תמחור זהה למחירי השוק הנוכחיים של Claude Opus 5.5.
עדכון מיום 01.10.2026
לצד הביצועים המרשימים שהציגה גוגל במבחני ההשוואה, בתוך החברה מתעוררת ספקנות בנוגע ליכולותיו של Gemini 4 Argon בפועל. על פי גורמים בגוגל בעלי גישה ישירה לפרויקט, המודל מפגין ביצועים פחות טובים כשהעובדים מפעילים אותו בעבודה המעשית, ומתקשה להתמודד עם משימות קידוד מסוימות - זאת בניגוד לתוצאות הגבוהות שהציג במבחנים הרשמיים. בעקבות זאת, בגוגל הבהירו כי הגישה למודל תורחב למנויים בתשלום רק לאחר שיבוצעו בדיקות נוספות.
למה זה חשוב לך
עבור מפתחים וחברות הייטק בישראל, השקת Argon עשויה להשפיע על בחירת כלי AI לעבודות קידוד ואבטחת מידע בעתיד הקרוב. הפער בין תוצאות המבחנים לבין הביצועים בפועל מדגיש את החשיבות של בדיקה עצמאית לפני אימוץ כלים חדשים בסביבת עבודה. בנוסף, היכולת שהוכחה באיתור פרצות קריטיות במערכות בריאות רלוונטית גם לארגוני בריאות ואבטחת מידע בישראל הבוחנים כלי AI דומים.
קראו גם: הונאת ה-GPT המזויף: האקרים מנצלים את ChatGPT להחדרת סוסים טרויאניים · OpenAI משיקה את GPT-6.1 Sol: מחיר נמוך ב-80% ממודל הדגל





