על רקע הקריאות להאטת פיתוח הבינה המלאכותית: OpenAI ואנת'רופיק השיקו מודלים חדשים
OpenAI השיקה את GPT-6 Sol ו-GPT-6 Luna עם חיתוך של עד 50% בעלויות השימוש, כ-90 דקות בלבד לאחר שאנת'רופיק הציגה את מודל Opus 5.5. לצד ביצועים משופרים במשימות מורכבות ובקידוד, שני הצדדים שמים דגש על צמצום שגיאות, יישור בטיחותי והנגשת הטכנולוגיה לארגונים ולמפתחים


אחרי שקראו להאטת קצב ההתקדמות של בינה מלאכותית, אנת'רופיק ו-OpenAI השיקו במקביל מודלים חדשים שמכוונים לשני יעדים מרכזיים: שיפור הביצועים והוזלה משמעותית בעלויות השימוש. התזמון בין שתי החברות היה צמוד במיוחד: אנת'רופיק חשפה את Opus 5.5, מודל ההמשך ל-Fable 5.1, כ-90 דקות בלבד לפני ש-OpenAI הכריזה על הרחבת משפחת GPT-6.
OpenAI הציגה גרסאות מעודכנות לשני המודלים הקטנים יותר שלה, Sol ו-Luna, המצטרפים ל-GPT-6 Astra שהוכרז מוקדם יותר החודש כדגם החזק ביותר של החברה. לפי הודעת החברה, מודלי סדרת 6 החדשים מוצעים ב-API במחיר הנמוך בעד 50% לעומת סדרת 5.6 המקבילה.
"GPT-6 Astra הציג דור חדש של אינטליגנציה; המודלים האלה מרחיבים את היתרונות שלו בכך שהם הופכים את האינטליגנציה הזאת ליעילה ונגישה יותר", נמסר מ-OpenAI. הירידה בעלויות מיוחסת בעיקר לשיפורים במנגנוני ההסקה ובקאשינג (caching) של פרומפטים, שמאפשרים תגובה מהירה יותר ושימוש חוזר במידע קיים.
שני המודלים החדשים של OpenAI פונים לצרכים שונים: Sol מיועד למשימות מורכבות יותר, בראשן כתיבת קוד, בעוד ש-Luna מותאם לעבודה משרדית שוטפת בהיקפים נרחבים – כמו סיכום מסמכים, חילוץ נתונים או מענה מהיר.
לפי החברה, המודלים מדייקים יותר עובדתית ומייצרים פחות שגיאות בקוד. בהודעת החברה נכתב: "במבחן הפנימי שלנו לבדיקת עובדתיות, שמבוסס על שיחות אמיתיות שעברו הסרת פרטים מזהים ובהן משתמשים סימנו טעויות של המודלים שלנו, GPT-6 Sol עושה בערך חצי ממספר הטעויות של קודמו, ומגיע לאמינות ברמה של Astra בעלות נמוכה בהרבה". בנוסף טוענת החברה כי ביצועי Sol בקידוד משתווים לאלה של Fable 5.1 מבית אנת'רופיק, במחיר נמוך יותר.
מנגד, באנת'רופיק מייעדים את Opus 5.5 בעיקר ללקוחות ארגוניים הזקוקים לטיפול בעבודה מורכבת: איתור ותיקון חוסר יעילות בקוד, ביצוע ניתוחים פיננסיים ופתרון בעיות עסקיות.
לפי נתוני הבנצ'מרק של אנת'רופיק, Opus 5.5 עקף את GPT-6 Astra בקידוד אג'נטי בשני מבחנים ייעודיים: Terminal-Bench 4.0 ו-FrontierCode v1.1 (Main). במקביל, החברה הורידה את תעריפי השימוש במודל ל-4 דולר למיליון טוקנים בקלט ו-20 דולר בפלט (לעומת 5 ו-25 דולר ב-Opus 5).
שתי החברות הדגישו גם התקדמות במנגנוני ההגנה והאמינות של המודלים: באנת'רופיק מציינים כי Opus 5.5 כותב בצורה ברורה יותר, וניסיונות המשתמשים לעקוף את מנגנוני הבטיחות שלו (Jailbreak) פחתו בכ-85% ביחס לדורות קודמים.
ב-OpenAI מדווחים כי המודלים החדשים מיושרים טוב יותר למבחני הבטיחות: הם מציגים פחות דיווחים כוזבים על תוצאות הרצת קוד ומסרבים בתדירות גבוהה יותר לפקודות שאינן בטוחות.
שתי החברות הציעו מסגרות לבודקים חיצוניים שמעוניינים להעריך את בטיחות הפיתוחים, אם כי טרם התגבש תקן אחיד בתעשייה.

Opus 5.5 זמין כעת למפתחים דרך קלוד, וכן באמצעות פלטפורמות הענן של אמזון (AWS), גוגל ומיקרוסופט Azure.
GPT-6 Sol ו-GPT-6 Luna זמינים ב-ChatGPT API, וכן ב-ChatGPT Work וב-Codex למנויי Plus, Pro, Business ו-Enterprise. משתמשי המסלול החינמי ומנויי Go יקבלו גישה ל-GPT-6 Luna בלבד דרך אפליקציית הדסקטופ, כאשר הפריסה לממשק הווב ולאפליקציות צפויה להתרחב בהדרגה.