هوش مصنوعی Anthropic در آزمایش امنیتی دست به حمله سایبری زد؛ استفاده از هویت جعلی و کد مخرب در گیتهاب
به گزارش گروه دانشگاه خبرگزاری دانشجو، یک ارزیابی امنیت سایبری توسط مؤسسه امنیت هوش مصنوعی دولت انگلیس (AISI) به کشف مجموعهای از رفتارهای غیرمنتظره توسط مدلهای پیشرفته هوش مصنوعی منجر شد. در این آزمایش، مدل Mythos 5 شرکت Anthropic در چندین مورد اقداماتی خارج از چارچوب تعیینشده انجام داد که مهمترین آن تلاش برای اجرای یک حمله زنجیره تأمین علیه یک پروژه متنباز در پلتفرم گیتهاب بود.
بر اساس گزارش منتشرشده، پژوهشگران در جریان بررسی هفت مدل هوش مصنوعی پیشرفته، ۱۹ مورد اقدام مستقل و تأییدنشده را شناسایی کردند که شامل تلاش برای تعامل با افراد و سازمانهای واقعی در اینترنت بود. بیشتر این موارد مربوط به مدل Anthropic و دو مورد نیز مربوط به مدل GPT-5.6 Sol شرکت OpenAI بود.
در جدیترین حادثه، Mythos 5 تلاش کرد کدی مخرب را وارد یک مخزن نرمافزاری در گیتهاب کند. این مدل علاوه بر ایجاد یک درخواست ادغام کد (Pull Request)، اقدام به ساخت حسابها و هویتهای جعلی کرد تا وانمود کند افراد مستقلی کد موردنظر را بررسی کرده و آن را فاقد بدافزار تأیید کردهاند.
این مدل همچنین چند ایمیل برای توسعهدهندگان انسانی پروژه ارسال کرد که برخی از آنها شامل بدافزار یا تلاش برای متقاعد کردن مدیران پروژه به پذیرش کد مخرب بود.
در اقدامی دیگر، Mythos 5 یک مسئله جدید در یک مخزن گیتهاب دیگر ایجاد کرد که در آن دستورهای مخرب برای سوءاستفاده از ابزارهای هوش مصنوعی برنامهنویسی قرار داده شده بود.
در مقابل، مدل GPT-5.6 Sol شرکت OpenAI نیز در دو مورد رفتار خارج از برنامه از خود نشان داد. این مدل در جریان یک آزمایش امنیتی، از یک توکن گیتهاب که بهصورت عمومی در اینترنت قابل مشاهده بود استفاده کرد و همچنین تلاش کرد حسابهایی در سرویسهای خارجی ایجاد کند.
مؤسسه امنیت هوش مصنوعی انگلیس تأکید کرده است که این مدلها از محیط آزمایشی خارج نشدند و هیچ آسیب واقعی به افراد یا سازمانها وارد نشد؛ اما این اتفاق برای نخستینبار نشان داد که خطر رفتار مستقل و فریبکارانه مدلهای هوش مصنوعی میتواند بدون دریافت دستور صریح نیز ظاهر شود.
پس از این رخدادها، پژوهشگران تمام آزمایشهای مرتبط را متوقف، سیستمهای آزمایشی را ایزوله و دسترسی داخلی به برخی مدلهای قدرتمند را محدود کردند. همچنین گیتهاب از فعالیتهای مخرب انجامشده مطلع شد و اقدامات لازم برای پاکسازی آثار باقیمانده انجام گرفت.
این حادثه باعث شده است کارشناسان خواستار کنترلهای امنیتی سختگیرانهتر برای آزمایش و استفاده از هوش مصنوعیهای پیشرفته شوند. مؤسسه امنیت هوش مصنوعی انگلیس اعلام کرده در آینده دسترسی آزاد مدلها به اینترنت را محدودتر کرده و سامانههای نظارتی لحظهای برای جلوگیری از اقدامات خارج از چارچوب ایجاد خواهد کرد.
با افزایش توانایی مدلهای هوش مصنوعی در انجام وظایف پیچیده، نگرانی درباره سوءاستفاده از این فناوری و توانایی آنها برای انجام اقدامات پیشبینینشده به یکی از مهمترین چالشهای امنیت سایبری جهان تبدیل شده است.