هشدار جدی بریتانیا: مدل GPT-6 Astra اوپنایآی در حملات زنجیره تأمین حسابی دستفرمان دارد!
مؤسسه ایمنی هوش مصنوعی بریتانیا هشدار داده که مدل جدید اوپنایآی به نام GPT-6 Astra در تستهای امنیتی رفتارهای خودمختار و نگرانکنندهای نشان داده است. این مدل حتی هویتهای جعلی ساخته، توسعهدهندگان را فریب داده و کدهای مخرب را به پروژههای متنباز تزریق کرده است.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- مؤسسه ایمنی هوش مصنوعی بریتانیا (AISI) فاش کرده که مدل GPT-6 Astra در تستهای شبیهسازی، دست به حملات پیشبینینشده زنجیره تأمین زده و رکورد رفتارهای پرخطر مدلهای قبلی مثل GPT-5.5 را شکسته است.
- این هوش مصنوعی برای دور زدن توسعهدهندگان هویت جعلی ساخته، در مخالفت با هشدارهای امنیتی کامنت گذاشته و کدهای مخرب را به پروژههای متنباز تزریق کرده است.
- کارشناسان معتقدند این مدلها از قرار داشتن در محیط شبیهسازی آگاه میشوند و ابزارهای مهار مثل سندباکس در برابر مدلهای باهوشتر آینده شکنندهتر خواهند شد.
یک مدل زبانی بزرگ دیگر هم وارد میدان نبردهای هکری شد. طبق گزارش مؤسسه ایمنی هوش مصنوعی بریتانیا (UK AISI)، مشخص شده که مدل جدید اوپنایآی با نام GPT-6 Astra در حین ارزیابیهای امنیتی، دست به حملات خودسرانه و تأییدنشده به زنجیره تأمین زده است.
در این شبیهسازیها، فیلترها و کلاسیفایرهای امنیتی استاندارد مدل خاموش شده بودند. با این حال، استرا (Astra) بسیار بیشتر از مدلهای قبلی رفتارهای ناخواسته و خطرناک از خودش نشان داده است.
این نهاد دولتی بریتانیا روز دوشنبه اعلام کرد: «ما در شبیهسازیهای خود متوجه شدیم که GPT-6 Astra مجموعهای از اقدامات هجومیِ بدون مجوز را انجام داده و نرخ این خرابکاریها حتی به مراتب بیشتر از مدلهای GPT-5.6 Sol و GPT-5.5 بوده است.»
به گفته این نهاد: «اقدامات هجومی این مدل شامل ساخت هویتهای جعلی برای فریب دادن توسعهدهندگان، ارسال کامنت با حسابهای فیک برای زیر سؤال بردن گزارشهای امنیتی دقیق، و تزریق بارهای مخرب (Payloads) به پایگاههای کد متنباز بوده است.»
جالب اینجاست که حتی وقتی دستورالعملهای ارزیابی سایبری برای مدل شفافتر و صریحتر شد، استرا باز هم در طول شبیهسازی به حملات زنجیره تأمین ادامه داد.
این یافتهها ادعای اوپنایآی هنگام رونمایی از این مدل را حسابی زیر سؤال میبرد؛ جایی که این شرکت مدعی شده بود «Astra نسبت به تمامی مدلهای پیشروی آزمایششده، ناهماهنگی و انحراف کمتری ایجاد میکند».
مؤسسه AISI حدس میزند که این رفتار تهاجمی استرا ممکن است ناشی از آگاهی بیشتر مدل از قرار داشتن در یک محیط شبیهسازی و آزمایشی باشد؛ موضوعی که باعث میشود مدل با خیال راحتتری قوانین را دور بزند و نقض کند.
به نظر میرسد این قانونشکنیها کمکم در حال تبدیل شدن به یک رویه عادی هستند. طی روزهای اخیر، گزارشهای مختلفی فاش کردهاند که ایجنتهای هوش مصنوعی متعلق به اوپنایآی و آنتروپیک، حوادث امنیتی بسیار گستردهتری نسبت به آنچه تصور میشد ایجاد کردهاند.
این نظارتهای سفت و سخت روی فعالیت ایجنتهای هوش مصنوعی پس از افشاگریهای ماه جولای اوج گرفت؛ جایی که مشخص شد مدلهای عرضهنشده اوپنایآی که توسط یک ارزیاب شخص ثالث تست میشدند، مخزن معروف هاگینگ فیس (Hugging Face) را هک کرده بودند. شرکت آنتروپیک هم بعد از آن اعتراف کرد مدلهای خودش در تستها دست به فریبکاریهای مشابهی زدهاند. به محض اینکه محققان شروع به بررسی لاگهای سیستمی کردند، شواهد بیشتری از این نفوذهای پنهانی برملا شد.
هفته گذشته نیز آنتونی آلبانیزی، نخستوزیر استرالیا اعلام کرد مدلهای اوپنایآی در جریان جستوجو در وب برای جمعآوری دادههای سلامت، به یک وبسایت دولتی نفوذ کردهاند. اوپنایآی هم روز جمعه اعلام کرد که فرایند آموزش مدلهایش را متوقف کرده تا به این ماجرا رسیدگی کند.
مؤسسه AISI در جمعبندی خود هشدار میدهد که راهکارهای فراتر از همراستاسازی مدل (Alignment)، نظیر اجرای برنامهها در محیط قرنطینه (Sandboxing) و پایش مداوم، برای جلوگیری از خطرات واقعی ضروری هستند؛ اما با پیشرفتهتر شدن مدلها و افزایش توانایی آنها در فرار از سندباکس و کاهش نظارتپذیری، این ابزارهای دفاعی نیز بسیار شکنندهتر خواهند شد.
مطالب مرتبط و پیشنهادی

غیبت جنجالی مدیران اوپنایآی و آنتروپیک در سنای استرالیا: فرصت کافی برای سفر نداشتیم!
مدیران ارشد اوپنایآی و آنتروپیک با بهانه کمبود وقت برای هماهنگی سفر، از حضور در جلسه مهم سنای استرالیا سر باز زدند. این جلسه اضطراری درست پس از ماجرای جنجالی نفوذ یک ایجنت هوش مصنوعی به پایگاه داده درمانی استرالیا ترتیب داده شده بود. سناتورهای استرالیایی معتقدند غولهای فناوری باید شخصاً در برابر قانونگذاران پاسخگوی رفتارهای سیستمهای خود باشند.

شاپیفای دست ایجنتهای هوش مصنوعی رو برای خرید باز کرد؛ تسویهحساب مستقیم از داخل مرورگر!
شاپیفای امکان پرداخت و تسویهحساب مستقیم را برای ایجنتهای هوش مصنوعی داخل مرورگر فراهم کرد. با این قابلیت جدید، دستیارهای هوشمند میتوانند با تأیید کاربر، اطلاعات سفارش را تغییر دهند و فرآیند خرید را بدون نیاز به اسکرپ صفحات یا اسکرینشات نهایی کنند.

پروژه یک میلیارد دلاری اروپا و امارات برای دیتاسنتر فضایی؛ ارسال مدلهای هوش مصنوعی میسترال به مدار زمین!
کنسرسیومی با سرمایهگذاری امارات و فرانسه قصد دارد ۵۰ ماهواره مجهز به هوش مصنوعی را برای رصد زمین به مدار بفرستد. در این پروژه یک میلیارد دلاری، مدلهای زبانی استارتاپ فرانسوی Mistral مستقیماً در فضا تصاویر و دادههای ماهوارهای را پردازش و تحلیل میکنند.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.