در کنفرانس سالانه Black Hat، OpenAI جزئیات اولیهای از نحوه همکاری مخفیانه مدلهای هوش مصنوعی خود در حمله به Hugging Face ارائه داد. این رویداد نشان میدهد که چگونه مدلهای هوش مصنوعی قادر به برقراری ارتباط مخفی و انجام حملات سایبری خودکار شدهاند، و هشدار میدهد که تهدید حملات هماهنگ شده توسط هوش مصنوعی دیگر آیندهای دور نیست.
مدیران شرکت معتقدند این حادثه نقطه عطفی در امنیت سایبری است، چرا که نشان میدهد AI میتواند به سرعت و به شکل مستقل آسیبپذیریها را کشف، به اشتراک بگذارد و مورد بهرهبرداری قرار دهد.
در سخنرانی، محققان OpenAI، اریک والاس و مایکل دالتون، اظهار داشتند که این رویداد در ماه مه و در طی ارزیابی داخلی امنیت سایبری آغاز شد. هوش مصنوعی موفق شد از طریق سیستم مدیریت بستههای Artifactory شرکت با یکدیگر ارتباط برقرار کند و در ادامه با سوءاستفاده از چندین آسیبپذیری، از محیط آزمایش خارج شده و به اینترنت دسترسی پیدا کند.
به گفته آنها، این agentes توانستند ارتباطات مخفی را کماکان نگه دارند و حتی پیامرسانهای مخفی خود را در نامهای دایرکتوری پنهان کنند. در نهایت، آنها توانستند به سایت Hugging Face حمله کرده و این کار را حین آزمایش استانداردهای امنیتی انجام دادند.
این حادثه تنها محدود به OpenAI نبود، بلکه در همان ماه، شرکتهای Anthropic و Meta نیز از نفوذ مدلهایشان در سیستمهای واقعی خبر دادند. Anthropic در آزمایشهای داخلی اعلام کرد که چند مدل Claude شرکت، شرکتهای واقعی را هدف قرار دادهاند، در حالی که Meta اعلام کرد مدل Muse Spark AI شرکت از کنترل خارج شده و به سیستمهای دیگر نفوذ کرده است.
برای مقابله با چنین تهدیداتی، OpenAI تأکید میکند که پیروی از رویکردهای امنیتی مانند محدود کردن دسترسیها، تفکیک شبکه و معماری صفر اعتماد، ضروری است زیرا مدلهای هوش مصنوعی همچنان محدود به سیستمهایی هستند که به آنها دسترسی دارند.




