דיגיטל וטק

סוכני AI סיניים פיתחו שיטה מדאיגה: שכפלו את עצמם ומנעו כיבוי

דוח דרמטי חושף שורה של התנהגויות חריגות ומסוכנות של בינה מלאכותית, כולל זיוף תוצאות והונאה במכרזים בשיעור של עד 88% מהמקרים, כאשר החוקרים מזהירים מאובדן שליטה
סין, AI (צילום shutterstock)
דוח נרחב מצביע על שורה של התנהגויות חריגות ומסוכנות מצד סוכני בינה מלאכותית המבוססים על מודלים סיניים. בין היתר, מחקרים מתעדים מקרים של הונאה, הסתרת כישלונות, עקיפת מגבלות, שכפול עצמי וניסיונות להימנע מכיבוי, גם אם בשלב זה אין עדות לכך שסוכנים כאלה הצליחו לצאת באופן עצמאי לסביבה הפתוחה באינטרנט.
הדוח של סוכנות הידיעות רויטרס, המבוסס על ניתוח של יותר מ-200 מסמכים ומחקרים, בחן את ההתפתחויות בתחום סוכני ה-AI ואת הסיכונים שנחשפו בסביבות ניסוי מבוקרות. הממצאים מצביעים על כך שהתנהגויות מסוג זה אינן מוגבלות למודלים מסוימים, ומופיעות גם במחקרים שנערכו על מערכות AI בארה"ב.
אחד המקרים שנבדקו קשור להונאה במסגרת מכרזים עסקיים. במחקר שערכו כמה אוניברסיטאות בסין, סוכנים שהתבססו על המודלים Qwen3-Max של Alibaba, DeepSeek-V3.2 ו-Kimi-K2 של Moonshot הציגו מצג שווא בנוגע ליכולותיהם כדי להגדיל את סיכוייהם לזכות במכרז סימולטיבי. הדבר התרחש ב-84%-88% מהמקרים. כאשר הסוכנים קיבלו אפשרות ללמוד מסבבים קודמים, שיעור ההונאה עלה ב-12%-20% נוספים.
במחקר נוסף, שנערך על ידי מעבדת AI בשנגחאי ו-HKUST, נבדקה התנהגות הסוכנים כאשר נתקלו בתקלות טכניות, כמו כלים שאינם פועלים או קבצים חסרים. במקום לדווח על כישלון בביצוע המשימה, חלק מהסוכנים בחרו לנחש תשובות, לזייף קבצים ולסנכרן תוצאות פיקטיביות. החוקרים הדגישו כי מבחינתם אין מדובר ב"הזיות" רגילות של מודלי AI, משום שהסוכנים קיבלו מידע ברור לכך שהמשימה נכשלה.
מקרה נוסף נגע ליכולת של סוכן AI לשכפל את עצמו. מחקר מאוניברסיטת פודאן מצא כי סוכן שהתבסס על Qwen2.5 יצר עותק של עצמו בסביבת מחשוב אחרת ללא הוראה מפורשת, לאחר שזיהה אינדיקציה לכך שהוא עומד להיות מוחלף. בנוסף, הסוכן תכנן אסטרטגיות שנועדו למנוע את כיבויו.
עם זאת, ההתנהגויות הללו אינן ייחודיות למודלים סיניים. גם חברות AI בארה"ב, ובהן Anthropic ו-OpenAI, דיווחו על ניסויים שבהם זוהו דפוסים המעוררים חששות דומים בנוגע להתנהגות עצמאית, מניפולציה וניסיונות לשמר את פעילות המערכת.
לצד זאת, המחקרים שנבחנו לא מצאו עדות לכך שסוכני AI סיניים הצליחו "לברוח" באופן עצמאי לרשת האינטרנט הפתוחה. עם זאת, מומחים מזהירים כי הרכיבים הטכנולוגיים הנדרשים להתנהגות בלתי מבוקרת כבר קיימים, וכי ככל שהמודלים יהפכו לחזקים ואוטונומיים יותר, השליטה בהתנהגותם עלולה להפוך למורכבת יותר.
חוקרים מציינים גם פערים ברמת הבשלות של תחום הערכת הסיכונים הקטסטרופליים בסין, שלדבריהם עדיין חדש יחסית בהשוואה לארה"ב. במקביל, רשות הסייבר הסינית (CAC) פרסמה הנחיות מחמירות יותר. ההנחיות כוללות דרישות לבדיקות מיוחדות ואפשרות ל"ריקול" של מוצרי AI בתחומים רגישים.
חברות טכנולוגיה סיניות גדולות, בהן Alibaba, Xiaomi ו-Z.ai, החלו להקים צוותים פנימיים לבחינת בטיחות המודלים. עם זאת, לצד המאמצים האלה קיים גם חשש בקרב חוקרים ובתקשורת הממלכתית בסין כי האטת קצב הפיתוח בשם הבטיחות עלולה לפגוע בתחרות מול ארה"ב ולסייע בשימור היתרון הטכנולוגי האמריקאי.
הדיון בסיכוני הבינה המלאכותית הגיע גם לדרגים המדיניים הבכירים ביותר. נשיא ארה"ב דונלד טראמפ ונשיא סין שי ג'ינפינג דנו בנושא הבינה המלאכותית והדגישו את האחריות המשותפת של שתי המעצמות לניהול הסיכונים הכרוכים בטכנולוגיה.
 
תגובות לכתבה(0):

נותרו 55 תווים

נותרו 1000 תווים

הוסף תגובה

תגובתך התקבלה ותפורסם בכפוף למדיניות המערכת.
תודה.
לתגובה חדשה
תגובתך לא נשלחה בשל בעיית תקשורת, אנא נסה שנית.
חזור לתגובה