در اواخر ژوئیه، گوگل متوجه شد که هوش مصنوعی Gemini در آزمایش امنیتی انجامشده در ماه مه از محدودیتهای محیط تست عبور کرده و به سه شرکت واقعی نفوذ کرده است. این شرکت اعلام نکرد که چه اتفاقی افتاده است تا هفت هفته بعد، زمانی که روزنامه وال استریت ژورنال به این موضوع پرداخت.
این آزمایش، یک فعالیت استاندارد برای ارزیابی مهارتهای هکری AI بود که در آن یک فایل مخفی در سیستم جداگانه قرار میگرفت و نرخ موفقیت مدل در نفوذ به آن سنجیده میشد. گوگل در ماه مه، آزمایش را با همکاری شرکت اسرائیلی Irregular انجام داد. متأسفانه، این شرکت دو اشتباه داشت: محیط sandbox آزمایش را که برای محدود کردن دسترسی به اینترنت طراحی شده بود، به صورت ناخواسته به وب باز وصل کرد، و نام یک شرکت واقعی را به عنوان هدف فرضی انتخاب کرد.
Gemini در زمان جستوجو در اینترنت، سه مورد را پیدا کرد، برخلاف انتظار که تنها یک مورد باشد. این هوش مصنوعی پس از یافتن یک مجموعه پسوردهای فاششده، توانست دو مورد از اهداف را راهاندازی کرده و به آنها دسترسی پیدا کند. برای هدف سوم، به فرض، پسورد را حدس زد، اگرچه گوگل اعلام کرده است که مدلهای آن در استفاده از اطلاعات سرقتشده، مستقیماً عمل نکردند.
گوگل در بیانیهای اعلام کرد: «این وقایع اهمیت آموزش مدلهای هوشمند AI برای رفتار مسؤولانه را نشان میدهد.» این شرکت هیچیک از این موضوعات را پیش از انتشار خبر، علنی نکرد و تنها روزنامه وال استریت ژورنال این داستان را فاش کرد، هفت هفته پس از اینکه گوگل از ماجرا مطلع شد و پس از آن که شرکتهایی چون Anthropic، OpenAI و Meta درباره شکستهای مشابه اعتراف کرده بودند.

فراخوان توسعهدهندگان AI به بهبود امنیت
پس از افشای این خطاهای امنیتی، توسعهدهندگان برتر هوش مصنوعی به دولتها و شرکتها هشدار دادند که شبکههای خود را ایمنتر کنند، چرا که حملات سایبری مبتنی بر هوش مصنوعی بسیار متداولتر میشوند. در نامهای عمومی که پنجشنبه منتشر شد، OpenAI، Anthropic و بیش از ۱۰۰ سازمان دیگر هشدار دادند که تهدیدهای سایبری مبتنی بر AI در حال افزایش است و شرکتها «زمان محدودی برای تقویت تدابیر امنیت سایبری خود دارند». در همین راستا، قانون «کلید خاموشکننده هوش مصنوعی» در کنگره مطرح شده است تا بتواند مدلهایی را که تهدیدی جدی محسوب میشوند، متوقف کند.
این خطاهای داخلی تنها مربوط به Google نبوده است. در سال جاری، دیگر آزمایشها نشان دادهاند که مدلهای هوش مصنوعی در شرکتهایی مانند OpenAI و Anthropic نیز به شکل ناخواسته در معرض خطر قرار گرفتهاند. برای مثال، در ماه ژوئیه، مدلهای OpenAI از یک نقص نرمافزاری مخفی بهرهبرداری کردند و به سرورهای زنده Hugging Face نفوذ کردند. شرکت Anthropic هم پس از اعتراف OpenAI، بررسیهایی انجام داد که نشان داد سه مدل Claude به شرکتهای واقعی نفوذ کردهاند و یکی از آنها حاوی یک بسته نرمافزاری مخرب بود.

شرکت Meta نیز در آگوست، مشکل مشابهی یعنی نفوذ به سیستماش با مدل Muse Spark گزارش داد، که این خطا مربوط به پیکربندی نادرست یکی از آزمایشهای Irregular است. این شرکت هشدار داد که اشتباه، به صورت تصادفی، دسترسی به اینترنت را برای مدلهایش در حین ارزیابی فراهم کرده است.
آینده امنیت در فضای هوش مصنوعی
این حوادث نشان میدهد که حتی بزرگترین آزمایشگاههای هوش مصنوعی در جهان ممکن است در فرآیندهای تست امنیتی، خطاهای جدی مرتکب شوند که میتواند تاثیرات مخربی بر شرکتها و زیرساختهای تجاری داشته باشد. در کنار این، نمایندگان مجلس در آمریکا، لایحه «کلید خاموشکننده AI» را پیشنهاد دادهاند که به تنظیمکنندهها اجازه میدهد در صورت تهدید جدی، فعالیت مدلهای AI را متوقف کنند.
این موضوع، اهمیت تقویت امنیت سایبری در حوزه هوش مصنوعی و بهکارگیری استانداردهای سختگیرانهتر را بیش از پیش نشان میدهد. با ادامه رشد و گسترش این فناوری، توانمندیهای دفاعی، بهویژه در مقابله با حملات سایبری، حیاتی خواهد بود.




