چگونه گروه‌های تروریستی از مدل‌های زبانی بزرگ (LLMs) برای تسلیحات و برنامه‌ریزی سوءاستفاده می‌کنند

دموکراتیزه شدن سریع مدل‌های زبانی بزرگ (LLMs) مزایای بی‌شماری برای بشریت به ارمغان آورده است، اما یک مطالعه جدید و تکان‌دهنده، جنبه تاریک‌تری از این جهش تکنولوژیک را آشکار می‌کند. سازمان‌های تروریستی اکنون به طور فعال در حال تبدیل ابزارهای هوش مصنوعی رایج به سلاح هستند تا توانمندی‌های عملیاتی خود را، از آموزش‌های تاکتیکی گرفته تا توسعه مواد منفجره، ارتقا دهند.

از جیلبریک کردن (Jailbreaking) تا واحدهای اختصاصی هوش مصنوعی

مطالعه جدیدی توسط آنتونیا یولیش (Antonia Jülich)، پژوهشگر برنامه علم و سیاست هوش مصنوعی کمبریج (CASP)، سطح پیچیده‌ای از به‌کارگیری هوش مصنوعی در گروه‌های افراطی را فاش کرده است. این تحقیق از طریق ۵۷ مصاحبه با ۲۷ عضو سابق نشان می‌دهد که داعش از سال ۲۰۲۳ آموزش‌های مهندسی پرامپت (prompt engineering) و جیلبریک (jailbreak) را ارائه کرده است. این تنها یک استفاده گذرا نیست؛ رابط‌های داعش فعالانه به فرماندهان آموزش داده‌اند که چگونه فیلترهای ایمنی مدل‌های پیشرو در صنعت را دور بزنند.

نگران‌کننده‌تر از همه این است که گروه بوکو حرام از استفاده پراکنده به سمت ادغام نهادینه شده حرکت کرده است. گزارش‌ها حاکی از آن است که هر دو جناح اصلی این گروه، واحدهای اختصاصی هوش مصنوعی ایجاد کرده‌اند. به گفته یولیش، این گروه‌ها آموزش هوش مصنوعی را در اولویت بالا قرار می‌دهند و «نخبگان» خود را در جلسات اختصاصی با استفاده از پروژکتور گرد هم می‌آورند تا نحوه دستکاری این ابزارهای قدرتمند را نمایش دهند.

سوءاستفاده از چت‌بات‌های اصلی برای کسب مزیت تاکتیکی

این مطالعه تأکید می‌کند که هیچ بازیگر اصلی در حوزه هوش مصنوعی در برابر این سوءاستفاده مصون نیست. جناح‌های تروریستی از طیف گسترده‌ای از چت‌بات‌های محبوب، از جمله ChatGPT، Claude، Gemini، Grok، Meta AI و DeepSeek استفاده می‌کنند. این ابزارها برای چندین عملکرد حیاتی و خطرناک به کار گرفته می‌شوند:

  • برنامه‌ریزی حمله: تسهیل لجستیک و زمان‌بندی عملیات‌های شورشیان.
  • توسعه تسلیحات: استفاده از LLMها برای کسب اطلاعات جهت ساخت دستگاه‌های انفجاری قدرتمندتر.
  • امنیت عملیاتی: استفاده از هوش مصنوعی برای پنهان کردن فعالیت‌ها و بهبود امنیت ارتباطات.
  • آموزش تاکتیکی: در یک مورد افراطی، جناح ISWAP از هوش مصنوعی برای تحلیل و بازسازی تکنیک‌های پرش با موتورسیکلت از فیلم‌های سینمایی جهت عبور از خندق‌های جنگی استفاده کرد.

شکست خودتنظیمی داوطلبانه

یافته‌ها به عنوان تأییدی تلخ بر هشدارهای دیرینه آزمایشگاه‌های هوش مصنوعی مانند OpenAI و Anthropic عمل می‌کند. در حالی که توسعه‌دهندگان حفاظ‌های ایمنی سختگیرانه‌ای را پیاده‌سازی کرده‌اند، این تحقیق نشان می‌دهد که خودتنظیمی داوطلبانه در همگام شدن با بازیگران بد (سوءاستفاده‌کنندگان) ناتوان است.

ماهیت LLMها امنیت کامل را تقریباً غیرممکن می‌سازد؛ Anthropic اخیراً اذعان کرد که ممکن است جیلبریک‌ها هرگز به طور کامل حذف نشوند. در حالی که چت‌بات‌های اصلی مانند ChatGPT عمدتاً دسترسی به دانش موجود را آسان‌تر می‌کنند، تهدید واقعی وجودی در سوءاستفاده احتمالی از سیستم‌های هوش مصنوعی تخصصی نهفته است. پژوهشگران هشدار می‌دهند که اگرچه استفاده فعلی «متعارف» باقی مانده است، اما مرز بعدی شامل تلاش تروریست‌ها برای کمک گرفتن از هوش مصنوعی جهت توسعه سلاح‌های شیمیایی و بیولوژیکی است.

چرا این موضوع برای اکوسیستم هوش مصنوعی اهمیت دارد

این تحول نشان‌دهنده تغییری در گفتمان ایمنی هوش مصنوعی است. موضوع دیگر فقط جلوگیری از «توهمات» (hallucinations) یا خروجی‌های سوگیرانه نیست؛ بلکه بحث بر سر دشواری بنیادین در جلوگیری از دموکراتیزه شدن دانش مرگبار است. با توانمندتر شدن مدل‌های هوش مصنوعی در زمینه‌های تخصصی مانند علوم زیستی، شکاف بین «اطلاعات قابل دسترس» و «سلاح‌سازی عملیاتی» همچنان در حال کوچک شدن است که این امر نیازمند معماری‌های امنیتی بسیار قدرتمندتر و پیشگیرانه‌تر است.

نکات کلیدی

  • سوءاستفاده نهادینه شده: گروه‌هایی مانند بوکو حرام از استفاده گذرا فراتر رفته و «واحدهای هوش مصنوعی» اختصاصی برای برنامه‌ریزی‌های تاکتیکی و لجستیکی ایجاد کرده‌اند.
  • آسیب‌پذیری همگانی: مدل‌های اصلی از جمله ChatGPT، Claude، Gemini و DeepSeek از طریق مهندسی پرامپت پیچیده و آموزش‌های جیلبریک دور زده می‌شوند.
  • تهدید تخصصی‌سازی: در حالی که سوءاستفاده‌های فعلی بر برنامه‌ریزی و مواد منفجره تمرکز دارد، خطر اصلی و بلندمدت، استفاده از هوش مصنوعی تخصصی در علوم زیستی برای جنگ‌های شیمیایی و بیولوژیکی است.