שוברים את השוק - בחצי מחיר: התשובה של ChatGPT לקלוד

ענקית הבינה המלאכותית מרחיבה את משפחת מודלי הדגל ומשתקת את המתחרים • אחרי ההכרזה של אנתרופיק על Opus 5/5, סם אלטמן מציע מודלים חדשים ומהירים עם ביצועים מרסקים בעלות נמוכה ב-50%, לצד זינוק דרמטי ביכולות הקידוד ואוטומציית העבודה

שוברים את השוק - במחיר חצי | צילום: GettyImgages

OpenAI ממשיכה לשנות את כללי המשחק בשוק הטכנולוגיה, ופחות חודש לאחר השקת מודל העל GPT-6 Astra, היא מכריזה על הרחבת משפחת המודלים עם השקתם של GPT-6 Sol ו-GPT-6 Luna. המהלך נועד להנגיש את טכנולוגיית העילית של אסטרה לכל ארגון ומפתח, תוך שבירת שוק אגרסיבית המשלבת ביצועי קצה, יעילות כלכלית חסרת תקדים והפחתה דרמטית של מחירי ה-API בחצי לעומת דור הקודם.

ביצועים של ענקים - בעלות נמוכה

אף על פי שפרויקטים מורכבים במיוחד עדיין ידרשו את העוצמה המלאה של דגם האסטרה, העבודה היומיומית בארגונים מתנהלת בקלות ובתקציבים שונים. דגמי Sol ו-Luna החדשים תוכננו באותן מתודולוגיות מתקדמות, אך הם ממקדים את מאמציהם ביעילות תפעולית קיצונית.

שוברים את השוק - במחיר חצי | צילום: OpenAI

בזכות שיפורים עמוקים בטכנולוגיות אחסון מטמון ותהליכי הסקת דעות, OpenAI חותכת את מחירי ה-API של המודלים הללו ב-50% בהשוואה לתמחור של סדרת GPT-5.6:

  • GPT-6 Sol: יורד מ-4 דולר ל-2 דולר למיליון טוקנים בקלט, ומ-20 דולר ל-10 דולר בפלט.

  • GPT-6 Luna: יורד מ-0.20 דולר ל-0.10 דולר בקלט, ומ-1.20 דולר ל-0.50 דולר בפלט.

שוברים את המתחרים

במבחני הערכה מחמירים המדמים תהליכי עבודה ארגוניים אמיתיים (כגון AutomationBench ו-Agents’ Last Exam), מודל ה-Sol מוכיח עליונות מוחלטת מול המתחרים (אנתרופיק, בעיקר), ומציג תוצאות גבוהות משמעותית בשבריר מהעלות.

במבחני האוטומציה הארגונית, GPT-6 Sol ברמת מאמץ גבוהה עוקף את Claude Opus 5 תוך שהוא דורש כ-9% בלבד מעלות הביצוע של המתחרה. תחום הקידוד ופיתוח התוכנה (DeepSWE ו-FrontierCode), סוכני הקוד החדשים מסוגלים להתמודד עם משימות מורכבות, ארוכות טווח ומוכנות למיזוג בקוד מקור אמיתי, עם חיסכון עצום של עד 93%-96% בעלויות לכל משימה בהשוואה למודלים מקבילים בשוק.

מהפכה. GPT-6 Sol ו-Luna | צילום: OpenAI

סגנון תקשורת משופר וארכיטקטורת אבטחה

מעבר ליעילות הכלכלית, OpenAI הטמיעה במודלים החדשים את סגנון התקשורת המשודרג של אסטרה. התוצאה ניכרת היטב בשיחות טכניות: תשובות קצרות ומדויקות יותר, פחות ז'רגון מיותר, הימנעות מקפיצה מהירה למסקנות, ומתן מענה ישיר ופרקטי מבלי להעמיס פרטים שוליים.

לצד זאת, החברה ממשיכה לפתח תשתיות מתקדמות לניהול זיכרון מטמון עבור סוכני AI ושיחות ארוכות. מערכות ה-Caching המשופרות מספקות כעת שיפור של יותר מ-50% בהפחתת טוקנים הדורשים עיבוד מחדש, ומעניקות הנחות של עד 90% על קריאת טוקנים מאוחסנים - מה שמאפשר לסוכנים להגיב במהירות הבזק ולחסוך הון רב לתשתיות הפיתוח של הארגון.

טעינו? נתקן! אם מצאתם טעות בכתבה, נשמח שתשתפו אותנו
Load more...