Grok 4.5 מתעלה על המתחרים: האם אילון מאסק צדק בהערכתו?
ציטוט מ מערכת האתר ב 09/07/2026, 08:17
הטכנולוגיה המתקדמת של בינה מלאכותית ממשיכה להתפתח ולשנות את פני העולם. לאחרונה, הציגה SpaceXAI את Grok 4.5, מודל חדש שנבנה על בסיס 1.5 טריליון פרמטרים בגרסת V9. אילון מאסק, הידוע בהצהרותיו הנועזות, כינה את המודל ברמה של Opus, וטען כי הוא מבצע את הפעולות מהר יותר ובעלות נמוכה יותר.
המבחן העצמאי AutomationBench-AA, שנערך על ידי Artificial Analysis, מאמת את טענותיו של מאסק. המבחן, שמכסה 657 משימות ב-40 אפליקציות מדומות כמו Gmail, Slack ו-Salesforce, בחן את יכולות המודלים של בינה מלאכותית בשוק. Grok 4.5 קיבל ציון של 51.4% בעלות של $0.34 למשימה, והוביל על פני המתחרים Claude Fable 5 ו-Claude Opus 4.8.
מדובר בהישג לא מבוטל, במיוחד לאור העובדה ש-Grok 4.5 השתמש בכ-8,000 טוקנים לפלט לכל משימה – פחות מרבע מכמות הטוקנים של Opus 4.8. היעילות הזו תורמת להבדל המשמעותי בעלות, כפי שהדגיש מאסק בהשקה. "סך השימוש בטוקנים של 0.44M לכל משימה הוא מהנמוכים ביותר בלוח," ציינו ב-Artificial Analysis.
עם זאת, המודל לא חף מבעיות. Grok 4.5 השלים 79.9% מהאובייקטיבים, אך גם רשם 0.63 הפרות לכל משימה – יותר מהמתחרים הקרובים ביותר. בתחום הפיננסי, במיוחד, הפרות כאלה עלולות לגרום לנזקים ממשיים, ולכן חברות המשתמשות בסוכנים במערכות פיננסיות חיות צריכות להיות מודעות לסיכונים.
לאור התוצאות, עולה השאלה האם Grok 4.5 הוא באמת מודל העתיד של הבינה המלאכותית. מצד אחד, העלות הנמוכה והיעילות הגבוהה הן יתרונות משמעותיים. מצד שני, ההפרות הרבות הן נקודת תורפה משמעותית. האם חברות יבחרו במודל זה בשל יתרונותיו הכלכליים, או שהן יחששו מהסיכונים הכרוכים בשימוש בו?
האם לדעתכם Grok 4.5 יוביל את המהפכה הבאה בעולם הבינה המלאכותית, או שמא המגבלות שלו יגבילו את השימוש בו? שתפו את מחשבותיכם ונסו לצפות את ההשפעות על התעשייה בעתיד הקרוב.

הטכנולוגיה המתקדמת של בינה מלאכותית ממשיכה להתפתח ולשנות את פני העולם. לאחרונה, הציגה SpaceXAI את Grok 4.5, מודל חדש שנבנה על בסיס 1.5 טריליון פרמטרים בגרסת V9. אילון מאסק, הידוע בהצהרותיו הנועזות, כינה את המודל ברמה של Opus, וטען כי הוא מבצע את הפעולות מהר יותר ובעלות נמוכה יותר.
המבחן העצמאי AutomationBench-AA, שנערך על ידי Artificial Analysis, מאמת את טענותיו של מאסק. המבחן, שמכסה 657 משימות ב-40 אפליקציות מדומות כמו Gmail, Slack ו-Salesforce, בחן את יכולות המודלים של בינה מלאכותית בשוק. Grok 4.5 קיבל ציון של 51.4% בעלות של $0.34 למשימה, והוביל על פני המתחרים Claude Fable 5 ו-Claude Opus 4.8.
מדובר בהישג לא מבוטל, במיוחד לאור העובדה ש-Grok 4.5 השתמש בכ-8,000 טוקנים לפלט לכל משימה – פחות מרבע מכמות הטוקנים של Opus 4.8. היעילות הזו תורמת להבדל המשמעותי בעלות, כפי שהדגיש מאסק בהשקה. "סך השימוש בטוקנים של 0.44M לכל משימה הוא מהנמוכים ביותר בלוח," ציינו ב-Artificial Analysis.
עם זאת, המודל לא חף מבעיות. Grok 4.5 השלים 79.9% מהאובייקטיבים, אך גם רשם 0.63 הפרות לכל משימה – יותר מהמתחרים הקרובים ביותר. בתחום הפיננסי, במיוחד, הפרות כאלה עלולות לגרום לנזקים ממשיים, ולכן חברות המשתמשות בסוכנים במערכות פיננסיות חיות צריכות להיות מודעות לסיכונים.
לאור התוצאות, עולה השאלה האם Grok 4.5 הוא באמת מודל העתיד של הבינה המלאכותית. מצד אחד, העלות הנמוכה והיעילות הגבוהה הן יתרונות משמעותיים. מצד שני, ההפרות הרבות הן נקודת תורפה משמעותית. האם חברות יבחרו במודל זה בשל יתרונותיו הכלכליים, או שהן יחששו מהסיכונים הכרוכים בשימוש בו?
האם לדעתכם Grok 4.5 יוביל את המהפכה הבאה בעולם הבינה המלאכותית, או שמא המגבלות שלו יגבילו את השימוש בו? שתפו את מחשבותיכם ונסו לצפות את ההשפעות על התעשייה בעתיד הקרוב.