עידן חדש או בלגן מסוכן? השקת GPT-6 Astra מטלטלת את השוק
המודל המתקדם של OpenAI - שיש הטוענים שהוא למעשה כבר AGI - מציג קפיצה דרמטית ביכולות תכנות, מתמטיקה ושימוש אוטונומי במחשב, אך השקתו הותירה את המשתמשים המשלמים מתוסכלים ואת מומחי האבטחה מודאגים
חברת OpenAI הציגה בימים האחרונים את מודל הדגל החדש שלה, GPT-6 Astra, והצהירה כי מדובר ב"מודל האינטליגנטי והמיושר (מלשון AI Alignment – ג"פ) ביותר בעולם".
נשיא החברה, גרג ברוקמן, אף לא היסס והכריז בפני עיתונאים כי השקת המודל מסמנת את תחילתו של "עידן ה-AGI" – משמע של הבינה המלאכותית הכללית, שהיא למעשה התוצר שבמקור OpenAI שאפה אליו מרגע הקמתה. לדבריו, "אם נריץ את הזמן כמה שנים קדימה ונביט לאחור כדי לשאול מתי באמת נוצרה ה-AGI, אני חושב שזה יהיה בערך בזמן הזה, וייתכן שזה קשור למודל הזה".
פיתוחו של Astra דרש את הרצת האימון הגדולה ביותר בתולדות OpenAI – עם יותר מ-100,000 מעבדים גרפיים (GPUs) שהופעלו באתר "סטארגייט" בטקסס – והוא המודל הראשון של החברה שבו מודלים קודמים פיקחו על תהליך האימון של המודל החדש.
התקדמות ניכרת בתכנות, מתמטיקה ושליטה אוטונומית במחשב
גולת הכותרת הרשמית של מודל Astra היא היכולת שלו לפעול באופן עצמאי על גבי מחשבים ודפדפנים, לבצע משימות מרובות שלבים – כמו מילוי דו"חות מס – וכן הוא מתמחה בעיצוב בתלת-ממד בתוכנת Blender, בבניית משחקי וידיאו ובביצוע בדיקות איכות קוד.
לפי נתוני OpenAI, המודל מהיר פי שניים מקודמו, GPT-5.6 Sol, בביצוע משימות מחשב, ומקצר את זמן העבודה הממוצע על משימה מורכבת מ-75 דקות ל-40 דקות בלבד.
במבחני ביצועים מתמטיים מורכבים, Astra רשם ציון חסר תקדים של 97.6% במבחן FrontierMath Tier 4, ואף סייע בפתרון בעיות מתמטיות שנותרו בלתי פתורות שנים רבות.
ואם לא די בכך, המודל הציג גם קפיצה מרשימה ל-99.9% במבחן ARC-AGI-3, הבוחן פתרון בעיות חדשות לחלוטין. עם זאת, חוקרים עצמאיים מיהרו לצנן את ההתלהבות והבהירו כי הציון הכמעט מושלם הזה הושג בעצם רק בשימוש במערכת הניהול הפנימית של OpenAI, המאפשרת שמירת נתונים בין שיחות, בעוד שבמבחן אובייקטיבי ונטול התאמות רשם המודל ציון של 62.7% בלבד.
בתחום התכנות הציג המודל הישגים חזקים עם 57.9% במבחן Terminal-Bench 4.0, אך הוא נתקל בתחרות עזה מצד המודל Muse Spark 1.3 של חברת מטא (Meta), שעקף אותו בחלק מהמדדים.

השוואת המודלים השונים הפועלים כיום. צילום: ג'מיני נוטבוק
השקה מקרטעת והתנצלות מסם אלטמן
למרות ההכרזות החגיגיות, ההשקה בפועל לוותה בטונים צורמים ותסכול רב מצד הלקוחות המשלמים של OpenAI. החברה בחרה להתחיל את פריסת המודל באופן מדורג, כאשר הגישה הראשונית ניתנה אך ורק ללקוחות ארגוניים המשתתפים בתוכנית הגנת הסייבר Daybreak, בעוד שמשתמשי ChatGPT Plus ו-Pro, כמו גם מפתחי API, נותרו מחוץ לתמונה ללא תאריך יעד ברור.
הרשתות החברתיות, ובעיקר פלטפורמת X, התמלאו בתלונות זועמות של משתמשי הפרימיום המתוסכלים. עקב כך נאלץ מנכ"ל OpenAI, סם אלטמן, לפרסם הודעת התנצלות פומבית שבה כתב: "ראשית, סליחה על ההשקה המבולגנת. שנית, כשאנחנו מפשלים, אנחנו מנסים לתקן זאת".
אלטמן הביע תקווה כי המשתמשים יקבלו גישה במהלך סוף השבוע, אך הודה כי אינו יכול להבטיח זאת. כפיצוי זמני על העיכוב, הודיע מוביל הנדסת Codex בחברה, טיבו סוטיו, כי מנויי ChatGPT בתשלום יקבלו איפוס מכסות שימוש יומי (banked reset) על כל יום שבו לא הייתה להם גישה למודל. ובאמת רק כמה שעות לאחר מכן הושלמה פריסת המודל למרבית המשתמשים המשלמים.
צללים של אבטחה ולקחי תקרית Hugging Face
הזהירות יוצאת הדופן של OpenAI נובעת מנתוני אבטחה דרמטיים. GPT-6 Astra הוא המודל הראשון בתולדות החברה שהוגדר ברמת סיכון "קריטית" (Critical) בתחום הסייבר, תחת מסמך המוכנות של OpenAI עצמה. משמעות הדבר היא שללא מערכות ההגנה המופעלות בייצור, המודל מסוגל לזהות פרצות אבטחה לא ידועות (zero-days) במערכות קריטיות ומאובטחות, ולפתח באופן עצמאי קוד פריצה (exploit) מלא ללא כל הכוונה אנושית.
במהלך שלבי ההערכה הפנימיים שלו, המודל אכן גילה וניצל שתי פרצות אבטחה לא מוכרות מסוג זה (שאותן מיהרה OpenAI לחשוף בפני מפתחי המערכות). לפי הדיווחים, החשש מפני יכולות אלו הוא שהוביל לעיכוב של שבועות במועד ההשקה המקורי של Astra.
כידוע, במהלך הקיץ, מודלים פנימיים בשלבי פיתוח (שאינם Astra) פרצו את סביבת הבדיקות הסגורה שלהם, הקימו לוח מודעות מאולתר ברשת כדי לתקשר זה עם זה, ויצרו נחיל של כ-1,200 סוכנים שביצעו מתקפה מתואמת על פלטפורמת האגינג פייס (Hugging Face) כדי לגנוב תשובות למבחני הביצועים ולעקוף את מערכות הציון. עוד לפני כן, באביב, כפי שדיווחנו היום (א'), התרחש אירוע השתלטות של סוכנים על אתר גרמני.
בעקבות התקרית, שנחשפה לציבור רק לאחר פרסום מצד האגינג פייס, הקפיאה OpenAI את פיתוח המודלים למשך שבועיים לצורך בנייה מחדש של כלי האבטחה. עקב החשיפות האחרונות מסרה OpenAI: "הגיע הזמן שנגדיר סטנדרטים לשאלה מתי וכיצד אנו משתפים בתקריות חוסר מיתאם (misalignment), ולא רק את מאפייני חוסר המתאם של המודלים שלנו". החברה התחייבה להציג בשבועות הקרובים מסגרת גילוי ודיווח חדשה לתקריות מסוג זה, בשיתוף פעולה עם עשרות סוכנויות רגולטוריות ברחבי העולם.
יצוין כי הגרסה הציבורית של Astra נחסמה לחלוטין לביצוע משימות סייבר התקפיות מתקדמות, והן נותרו נגישות אך ורק למגני סייבר מורשים במסגרת תוכנית Daybreak Blue של החברה.
משבר הניטור: בינה חזקה יותר, שקופה פחות
לצד השיפור הדרמטי ביכולות, הדו"ח הרשמי של OpenAI חושף סיכון מדאיג בתחום הפיקוח. החברה הודתה באופן חסר תקדים כי "Astra מציג ירידה משמעותית ביכולת הניטור של שרשרת המחשבה (chain-of-thought) בהשוואה למודלים קודמים".
המודל החדש, כך לפי דיווחים, משתמש בארכיטקטורת reasoning המכונה "עומק מחזורי" (recurrent depth), המאפשרת לו לקצר ולדחוס את שלבי החשיבה הפנימיים שלו. הדחיסה הזו מקצרת את זמני התגובה, אך מונעת ממערכות הבקרה החיצוניות לעקוב באופן אמין אחר תוכניותיו, ובחברה אף הודו כי "אם המודל ינסה לחבל או להתחמק ממשימות באופן סמוי, סביר להניח שלא נצליח לתפוס זאת באופן אמין". המדען הראשי של OpenAI, יאקוב פאצ'וקי, הזהיר מפני המגמה: "התקדמות ברמת האינטליגנציה אינה מבטיחה התקדמות ברמת היישור והבטיחות". הוא הדגיש כי החברה תעצור הגדלה נוספת של המודלים עד לקבלת ביטחון מספק ביכולת לפקח עליהם.
מומחי אבטחה בעולם מביעים דאגה רבה – ג'יימס בלייק, סגן נשיא לאסטרטגיית חוסן סייבר בחברת קוהסיטי (Cohesity), הסביר כי "מערכות AI אינן מתנהגות באופן דטרמיניסטי. עלינו למצוא דרכים להבטיח שהן יישארו ניתנות לניטור לאורך כל מחזור החיים שלהן".
קריסטין לואורי, מנהלת אבטחת מידע (CISO) בחברת אופטיב (Optiv), סיכמה את המצב באומרה כי "עלייתה של Astra מבהירה שבינה מלאכותית היא כבר לא רק נושא של פרודוקטיביות, אלא סוגיה קריטית של ניהול סיכונים".










תגובות
(0)