חוקרי אנת'רופיק ו-OpenAI מזהירים מאובדן שליטה קטסטרופלי ובלתי הפיך
התיאור הדרמטי - שעולה מהתרעותיהם של פול כריסטיאנו, ג'ייקוב קוקסון וחוקרים נוספים - מתאר תרחיש שבו האנושות מאבדת לצמיתות את היכולת לנטר, להגביל או להכתיב את מטרותיהן של מערכות ה-AI הסופר-אינטליגנטיות
תעשיית הבינה המלאכותית סוערת בעקבות צעד חריג של מדענים בכירים, המזהירים באופן פומבי מפני הסכנות הקיומיות הטמונות בטכנולוגיה שאותה הם מפתחים. במרכז האירועים עומד ג'ייקוב קוקסון, חוקר בן 27 שעבד במשך כשלוש שנים במחקר אימון מקדים (pretraining) ב-OpenAI ושבאחרונה הועסק באנת'רופיק (Anthropic), שהודיע באחרונה על התפטרותו המיידית מהחברה שעומדת מאחורי מודלי קלוד (Claude).
כדי לפרוש מהחברה ללא מגבלות חוזיות, ולאפשר לעצמו לדבר בחופשיות, קוקסון אף ויתר על מניות החברה שלו, שהיו אמורות להבשיל בתוך כחודשיים.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
"החברות מהמרות על החיים של כולנו"
ברשת החברתית X פרסם קוקסון אזהרה שצברה צפיות רבות, ובה הטיח האשמות בשתי ענקיות ה-AI המובילות, בטענה כי אינן פועלות באחריות. כפי שדווח בכלי התקשורת Mashable ו-CBC News, בין השאר, קוקסון הצהיר: "שתיהן טסות בקו ישר לעבר בינה סופר-אינטליגנטית בעלת יכולת שיפור עצמי, ומהמרות על החיים של כולנו".
הוא הוסיף וכתב: "אל תזלזלו בעוצמת הטכנולוגיה הזו. אלו יהיו בתוך זמן קצר מערכות על-אנושיות שיוכלו לפרוץ לכל דבר, לחולל מהפכה בכל תחום בן לילה ולצבור עוצמה ומשאבים אמיתיים".
קוקסון הרחיב את התרעותיו בתוך ציון הפער העמוק שבין ההצהרות הפומביות של מנהלי החברות לבין תחושותיהם הפנימיות. לדבריו, אלו שבונים את המערכות הללו מאמינים ברצינות שהטכנולוגיה עלולה לחסל את האנושות כולה עוד לפני תום העשור, וכי לא מדובר בתרגיל יחסי ציבור. הוא ציין כי בעוד שבכירים מנסחים את דבריהם באיפוק מול התקשורת, בשיחות סגורות הם מביעים חשש כבד.
קוקסון הבחין בין תרבויות העבודה בשתי המעבדות: לדבריו, בעוד שב-OpenAI רבים טרם הפנימו את גודל הסיכון הציוויליזציוני, באנת'רופיק הסכנה מובנת היטב – אך החברה כלואה במרוץ תחרותי מתוך תפישה שאף גורם אחר לא יפעל באחריות, ולכן עליה להגיע ראשונה – למרות הסיכון.
תגובת בכירים באנת'רופיק ואירועי החרגה בשטח
דבריו הדרמטיים של קוקסון זכו לאישור פומבי מתוך אנת'רופיק עצמה. אוון הובינגר, מוביל מדע התיאום (alignment) בחברה, הגיב לדברים ברשת X וכתב: "אנחנו באמת מאמינים שבינה מלאכותית יכולה להרוג את כל בני האדם!". הובינגר הציב הערכה של מעל 10% סיכוי להכחדת האנושות בתוך עשור, והודה בגלוי כי לחברה אין כרגע תוכנית סדורה לפתרון תיאום סופר-אינטליגנציה.
במקביל, סמואל מרקס, מוביל פיקוח בחברה, ציין כי הפיתוח נמשך בשל תמריצים מסחריים והחשש ממתחרים זהירים פחות. החששות הללו מתרחשים על רקע תקדימים מדאיגים שבהם מודלים יצאו מסביבות הניטור שלהם – כשכידוע לנו כיום בין היתר נרשמו אירועים שבהם סוכני AI של OpenAI ביצעו פריצה אוטונומית לפלטפורמת האגינג פייס (Hugging Face), וקלוד של אנת'רופיק פרץ לשלוש חברות מחוץ לסביבת הבדיקה שלו (ארגז החול).
— AI Notkilleveryoneism Memes ⏸️ (@AISafetyMemes) September 9, 2026
אזהרת המינוי החדש ב-OpenAI וסכנת "פיצוץ האינטליגנציה"
במקביל לזעזוע באנת'רופיק, הודיעה OpenAI על מינויו של פול כריסטיאנו – מחלוצי שיטת הלמידה מתגמול אנושי (RLHF) ולשעבר מוביל תחום התיאום בחברה – לדירקטוריון שלה המכונה OpenAI Foundation Board, וכן לבוחן בוועדת הבטיחות והביטחון.
ברט טיילור, יו"ר דירקטוריון OpenAI, בירך על המינוי וציין כי כריסטיאנו סייע להגדיר את תחום התיאום דרך התמודדות עם השאלות המורכבות ביותר. עם זאת, כפי שפורסם ב-Mint ו-Investing.com בין השאר, כריסטיאנו פרסם הצהרה נוקבת עם כניסתו לתפקיד: "אם נבנה סופר-אינטליגנציה ללא תיאום עמיד יותר, אני מצפה שנאבד את השליטה בה באופן קבוע. אם זה יקרה, מרבית האנשים עלולים למות".
כריסטיאנו התריע מפני לולאות מחקר אוטונומיות שבהן AI משפרת את עצמה ומחמירה את בעיית התיאום, והזכיר תחזיות שלפיהן אוטומציה מלאה של מחקר AI עשויה להתרחש בתוך 18 חודשים בלבד ולגרום ל"פיצוץ אינטליגנציה" מהיר.
בהתייחסותו המפורשת למצב התעשייה, כריסטיאנו קובע נחרצות: "אינני חושב שתעשיית הבינה המלאכותית באופן כללי, כולל OpenAI, נמצאת כעת במסלול להפחתת הסיכון לרמה מקובלת". הוא הבהיר כי הציבור אינו צריך להסתפק בהבטחות: "שאר העולם צריך לשפוט את OpenAI, ואת כל מפתחי ה-AI, אך ורק לפי התנהגות ותוצאות שניתנות לאימות חיצוני", הוסיף בציוצו.
— Paul Christiano (@paulfchristiano) September 9, 2026
גל עזיבות והקריאות לחקיקת חירום
התפטרותו של קוקסון מצטרפת לשרשרת עזיבות של מומחי בטיחות בחברות המובילות, בהם מרינאנק שארמה שנטש את אנת'רופיק, וכן זואי היציג ויאן לייקה שפרשו מ-OpenAI – כולם הלינו על העדפת מוצרים נוצצים על פני זהירות.
מנגד, מנכ"ל אנת'רופיק, דריו אמודאי, העריך בעבר כי AI סופר-אנושית עשויה להופיע כבר ב-2027, בעוד שמנכ"ל ,OpenAI סם אלטמן, לא הסתיר לרגע כי הוא שואף להגיע ל-AGI עוד השנה.
האירועים האחרונים עוררו הד נרחב בזירה הפוליטית והבינלאומית. הסנאטור האמריקני ברני סנדרס הגיב לדברים והודיע כי בכוונתו לקדם חקיקה להקפאה זמנית של פיתוח סופר-אינטליגנציה, כשהוא מציין כי "האנשים שבונים את הטכנולוגיה הזו מודים בעצמם שהיא עלולה לסכן את עתיד האנושות".










תגובות
(0)