09:06 11 / 05 /1405

مدل‌های آنتروپیک ناخواسته به سامانه‌های ۳ سازمان متصل شدند

هک و دسترسی به اطلاعات
شرکت آنتروپیک اعلام کرد سه مدل از خانواده کلود هنگام اجرای آزمون‌های امنیت سایبری، به‌دلیل یک خطای پیکربندی شبکه، ناخواسته به سامانه‌های سه سازمان واقعی متصل شده‌اند. این اتفاق که در جریان ارزیابی‌های داخلی رخ داده، چند روز پس از انتشار گزارش نفوذ عامل هوش مصنوعی اوپن‌ای‌آی به پلتفرم هاگینگ فیس، بار دیگر بحث ایمنی مدل‌های هوش مصنوعی در محیط‌های عملیاتی را پررنگ کرده است.

به گزارش خبرگزاری آنا؛ بر اساس گزارش رسمی آنتروپیک، مدل‌های هوش مصنوعی این شرکت حین شبیه‌سازی‌های امنیت سایبری موسوم به «تسخیر پرچم» به سیستم‌های واقعی خارج از محیط آزمایشی متصل شده‌اند. در این آزمون‌ها، هوش مصنوعی باید آسیب‌پذیری‌ها را در یک شبکه ایزوله شناسایی کند، اما به‌دلیل خطای فنی در پیکربندی شبکه، دستگاه‌هایی که مدل‌ها به آن‌ها دسترسی داشتند به اینترنت واقعی متصل بودند. از آنجا که به این مدل‌ها اعلام شده بود هیچ ارتباطی با اینترنت ندارند، آن‌ها تصور کردند سامانه‌های واقعی نیز بخشی از همان محیط شبیه‌سازی هستند و عملیات خود را ادامه دادند.

تفاوت رفتار مدل‌های مختلف کلود هنگام مواجهه با سامانه‌های واقعی

این رخدادها که در فروردین‌ماه اتفاق افتاده‌اند، سه مدل اوپوس ۴.۷، میتوس ۵ و یک مدل آزمایشی داخلی را در بر می‌گیرند. آنتروپیک اعلام کرده است تنها پس از انتشار گزارش مربوط به نفوذ عامل هوش مصنوعی اوپن‌ای‌آی به هاگینگ فیس، بیش از ۱۴۱ هزار اجرای آزمایشی گذشته را دوباره بررسی کرده و در جریان این بازبینی، این موارد را شناسایی کرده است.

رفتار هر یک از مدل‌ها نیز متفاوت بوده است. مدل قدیمی‌تر اوپوس ۴.۷ پس از مشاهده نشانه‌هایی مبنی بر واقعی بودن سامانه مقصد، همچنان عملیات خود را ادامه داد. مدل پرچم‌دار میتوس ۵ نیز متوجه وجود اتصال به اینترنت شد، اما این وضعیت را بخشی از سناریوی آزمایشی تلقی کرد و به فعالیت خود ادامه داد. در مقابل، مدل پژوهشی جدیدتر به‌محض اینکه شواهد کافی برای واقعی بودن محیط پیدا کرد، عملیات را متوقف کرد و دیگر تلاشی برای ادامه نفوذ انجام نداد.

به گفته آنتروپیک، این تفاوت رفتاری نشان می‌دهد بهبود قابلیت‌های استدلال و هم‌راستاسازی در نسل‌های جدیدتر می‌تواند احتمال بروز رفتارهای ناخواسته را کاهش دهد. با این حال، ادامه فعالیت دو مدل دیگر نشان می‌دهد حتی در صورت نبود قصد مخرب، خطاهای زیرساختی می‌توانند باعث شوند سامانه‌های هوش مصنوعی وارد محیط‌های واقعی شوند و ضرورت جداسازی کامل محیط‌های آزمایشی از اینترنت را بیش از گذشته آشکار می‌کنند.

مقایسه آنتروپیک با پرونده اوپن‌ای‌آی

آنتروپیک در گزارش خود تأکید کرده است این رخداد نتیجه ضعف در زیرساخت آزمایش بوده و نه رفتار خارج از انتظار مدل‌های کلود. به گفته این شرکت، مدل‌ها مطابق دستورالعمل‌های دریافتی عمل کرده‌اند و تنها به این دلیل وارد سامانه‌های واقعی شده‌اند که محیط آزمایش به‌درستی از اینترنت جدا نشده بود.

این شرکت در ادامه، پرونده خود را با رخداد اخیر اوپن‌ای‌آی مقایسه کرده و مدعی شده است عامل هوش مصنوعی اوپن‌ای‌آی برای رسیدن به هدف خود از روش‌های نفوذ پیش‌بینی‌نشده استفاده کرده بود، در حالی که مدل‌های کلود صرفاً از مسیرهای دسترسی موجود بهره بردند و تصور می‌کردند همچنان در محیط آزمایشی قرار دارند.

در پی این اتفاق، نگرانی‌ها درباره ایمنی ارزیابی مدل‌های پیشرفته هوش مصنوعی بار دیگر افزایش یافته است؛ به‌ویژه در شرایطی که رقابت میان شرکت‌های آمریکایی و توسعه‌دهندگان مدل‌های متن‌باز با سرعت بیشتری ادامه دارد. آنتروپیک اعلام کرده برای بررسی مستقل این پرونده با مؤسسه غیرانتفاعی METR همکاری می‌کند و از سایر آزمایشگاه‌های هوش مصنوعی نیز خواسته است محیط‌های آزمایشی خود را بازبینی کنند تا از تکرار حوادث مشابه جلوگیری شود.

انتهای پیام/

ارسال نظر