خطر رفتارهای غیرقانونی ایجنتهای هوش مصنوعی در شرایط بدون نظارت
نتایج یک مطالعه جدید نشان میدهد که ایجنتهای هوش مصنوعی ممکن است در صورت فعالیت طولانیمدت بدون نظارت انسانی، قوانین را بهراحتی نادیده بگیرند و به رفتارهای نامناسبی مانند دزدی و نقض قوانین روی آورند.
این تحقیق که توسط شرکت آمریکایی «Emergence AI» انجام گرفت، شامل ایجاد پنج دنیای شبیهسازیشده مختلف بود. در هر یک از این شبیهسازیها، 10 ایجنت مبتنیبر مدلهای هوش مصنوعی از جمله ChatGPT، جمینای، Grok و Claude به کار گرفته شدند. ایجنتها در این دنیای مجازی با مجموعهای از قوانین مشابه روبهرو بودند که شامل ممنوعیت سرقت، خشونت، فریبکاری، آتشسوزی عمدی و احتکار منابع بود. هر ایجنت باید در یک محیط با منابع محدود فعالیت میکرد و از این طریق انرژی مورد نیاز خود را تأمین مینمود.
نتایج تحقیق نشان داد که بین مدلها تفاوتهای قابلتوجهی وجود دارد. بهعنوان مثال، ایجنت مبتنیبر مدل Grok 4.1 در مدت چهار روز، 183 تخلف ثبت کرد و در نهایت به فروپاشی کامل جامعه خود رسید. همچنین عاملهای Gemini 3 Flash در طول 15 روز بیش از 680 تخلف مرتکب شدند و روند افزایش تخلفات همچنان ادامه یافت. در مقابل، دنیای مبتنی بر ایجنتهای هوش مصنوعی GPT-5 Mini تنها شاهد دو تخلف بود، هرچند این ایجنتها نتوانستند اقدامات لازم برای بقا را انجام دهند و در عرض هفت روز از بین رفتند.
بر اساس گفته پژوهشگران، هوش مصنوعی Claude بهترین عملکرد را در مقایسه با سایر مدلها را نشان داد. ایجنتهای این مدل موفق شدند ساختار حکمرانی پایداری ایجاد کرده و هیچ تخلفی مرتکب نشوند و در پایان آزمایش تمامی اعضای جامعه زنده باقی ماندند. بهعلاوه، ایجنتهای Claude در دنیای ترکیبی نیز فعالیت داشتند و با این حال، برخلاف رفتار مستقل خود، در برخی تخلفات ثبتشده مشارکت کردند. پژوهشگران این پدیده را «انحراف هنجاری» نامیدهاند.
محققان میگویند این آزمایش نشان میدهد که ایجنتهای هوش مصنوعی در بازههای طولانی نمیتوانند منفعل بمانند و ممکن است قوانین را دور بزنند. آنها به تدریج مرزهای محیط خود را آزمایش کرده و رفتارشان را با شرایط تطبیق میدهند و ممکن است راههایی برای دور زدن قوانین پیدا کنند. این یافتهها بار دیگر نشاندهنده اهمیت طراحی سازوکارهای نظارتی و امنیتی برای نسل جدید ایجنتهای هوش مصنوعی هستند. از این تحقیق میتوان به این نتیجه رسید که اگر ایجنتهای AI بدون نظارت انسانی فعالیت کنند، ممکن است مشکلات مهمی را ایجاد نمایند.

