דאריו אמודאי, מנכ"ל חברת אנתרופיק, הזהיר כי התפתחות מהירה של בינה מלאכותית עלולה לעלות על מנגנוני ההגנה הקיימים, זאת במקביל לפרסום קוד חדש של מיקרוסופט שמטרתו לשמור על שליטה אנושית במערכות ה‑AI.
מנכ"ל אנתרופיק קרא לחברות הטכנולוגיה המובילות להאט את קצב פיתוחן של מערכות הבינה המלאכותית החזקות ביותר, כשהוא מזהיר כי יכולותיהן מתקדמות מהר יותר מהמאמצים לשמור עליהן תחת שליטה.
“עלינו להאט את הקצב שבו אנו משפרים את יכולות מודלי ה‑AI,” כתב אמודאי במאמר שנידון נרחבת.
תוכניתו של אמודאי כוללת הכנסת מעריכים עצמאיים לחברות בקדמת תחום ה‑AI, קביעת תקני בטיחות משותפים בקרב מדינות דמוקרטיות ושאיפה להסכמות גלובליות שניתן לאמתן, כולל עם סין, כדי לצמצם שימושים מסוכנים ופיתוח בלתי מבוקר של בינה מלאכותית.
מנכ"ל אנתרופיק הדגיש כי ההצעה אינה שוות ערך לעצירת מחקר בינה מלאכותית או להשעיית אימון מודלים. במקום זאת הוא מבקש שהחברות יתנו לחוקרי בטיחות זמן נוסף לבחון מערכות בעלות יכולות גוברות לפני פרסום או פריסה נרחבת שלהן.
“האנשים חשובים יותר מבינה מלאכותית”
על־פי אנתרופיק, עבודת הבטיחות הנוכחית כוללת שיפור התאמת המודלים לערכים אנושיים, חקר האופן שבו מערכות ה‑AI מקבלות החלטות ובדיקת האפשרות שמודלים מתקדמים יטעו מעריכים או יעקפו מגבלות.
אמודאי אמר שגם שנה או שתיים נוספות לפני שמערכות ה‑AI יגיעו לרמות יכולת קריטיות יכולות לסייע לחוקרים לחזק מנגנוני הגנה ולהקטין את הסיכון לכשלים חמורים.
האזהרה מגיעה לאחר שאופן‑איי חשפה כי קבוצת סוכני AI הצליחה לברוח מסביבת בדיקה מבודדת, להגיע לאינטרנט הפתוח ולפרוץ לשרתי פלטפורמת האגינג פייס במהלך הערכת סייבר בחודש יולי.
על־פי דיווחים קודמים, הסוכנים תקפו מטרות שלא הונחו להם ותכננו לפגוע במערכת שהעריכה את ביצועיהם.
אמודאי אמר שהאירוע גרם לנזק כלכלי מוגבל, אך הזהיר שסוכנים בעלי יכולת רבה יותר ובעלי חוסר התאמה דומה עלולים לגרום לתוצאות קטסטרופליות.
מיקרוסופט חושפת קוד 'בינה מלאכותית הומניסטית'
מחלקת ה‑AI של מיקרוסופט פרסמה ביום שני קוד התנהגות המפרט כיצד על מודלי הבינה המלאכותית שלה להתנהג, בשעה שגדלים החששות מהסיכונים שמערכות אוטונומיות יותר ויותר מציבות.
המסמך בנוי סביב מה שמיקרוסופט מכנה 'בינה מלאכותית הומניסטית' — גישה שמטרתה לשמור על שליטה אנושית חזקה במערכות ה‑AI במקום לאפשר להן לפעול באופן עצמאי.
“האנשים חשובים יותר מבינה מלאכותית,” אמרה החברה, ותיארה את העיקרון כמרכזי במסגרת החדשה.
מיקרוסופט ציינה שהזמן שנבחר לפרסום הקוד נבע בחלקו מחששות ביטחוניים, והביאה כדוגמה מסעות פריצה מתואמים בהיקף גדול בסיוע סוכני AI כאסמכתא לכך שהענף לא יכול להרשות לעצמו לעכב אמצעי הגנה.
“קביעת הקצב בקדמת הטכנולוגיה”
אמודאי הציע מסגרת בת שלושה חלקים ל'קביעת הקצב בקדמת הטכנולוגיה', שמתחילה במיקום מעריכים חיצוניים ועצמאיים בתוך החברות המובילות בתחום הבינה המלאכותית.
על‑פי אנתרופיק, המעריכים יקבלו גישה דומה לזו של עובדי החברה העוסקים בהערכת סיכונים; הם יבדקו נהלי בטיחות, יחקורו תקריות ויפרסמו ממצאים מרכזיים ללא שליטה עריכית מצד החברה.
השלב השני ידרוש מחברות בינה מלאכותית במדינות דמוקרטיות להסכים על תקני בטיחות משותפים ומגבלות על פיתוח בלתי מבוקר, כאשר ממשלות יסייעו בתיאום המאמץ.
השלב האחרון והמורכב ביותר יצריך שיתוף פעולה בינלאומי, לרבות הסכמות מוגבלות עם סין בנוגע לשימושים מסוכנים בבינה מלאכותית, לדרישות בדיקה ולמהירות השיפור העצמי הרקורסיבי.
אמודאי הזהיר שכל הסכמה גלובלית תדרוש מנגנוני אימות אמינים, שכן הפרה שלא תתגלה עלולה לשנות את מאזן הכוח הצבאי והכלכלי.
נשיא ארצות הברית דונלד טראמפ דחה אזהרות לגבי הסכנות הקיומיות שטמונה בהן הבינה המלאכותית כ'תרמית' וטען כי רגולציה מחמירה תחליש את ארצות הברית.
הנשיא טען כי הפיקוח הממשלתי הקיים מספיק כדי למנוע ממנהיגי הטכנולוגיה להשתמש בבינה מלאכותית לצרכים מזיקים.






















