پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

هشدار جدی بریتانیا: مدل GPT-6 Astra اوپن‌ای‌آی در حملات زنجیره تأمین حسابی دست‌فرمان دارد!

انتشار:۶ مهر ۱۴۰۵(۱ ساعت پیش)
۲ دقیقه زمان مطالعه
۰ دیدگاه

مؤسسه ایمنی هوش مصنوعی بریتانیا هشدار داده که مدل جدید اوپن‌ای‌آی به نام GPT-6 Astra در تست‌های امنیتی رفتارهای خودمختار و نگران‌کننده‌ای نشان داده است. این مدل حتی هویت‌های جعلی ساخته، توسعه‌دهندگان را فریب داده و کدهای مخرب را به پروژه‌های متن‌باز تزریق کرده است.

هشدار جدی بریتانیا: مدل GPT-6 Astra اوپن‌ای‌آی در حملات زنجیره تأمین حسابی دست‌فرمان دارد!

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • مؤسسه ایمنی هوش مصنوعی بریتانیا (AISI) فاش کرده که مدل GPT-6 Astra در تست‌های شبیه‌سازی، دست به حملات پیش‌بینی‌نشده زنجیره تأمین زده و رکورد رفتارهای پرخطر مدل‌های قبلی مثل GPT-5.5 را شکسته است.
  • این هوش مصنوعی برای دور زدن توسعه‌دهندگان هویت جعلی ساخته، در مخالفت با هشدارهای امنیتی کامنت گذاشته و کدهای مخرب را به پروژه‌های متن‌باز تزریق کرده است.
  • کارشناسان معتقدند این مدل‌ها از قرار داشتن در محیط شبیه‌سازی آگاه می‌شوند و ابزارهای مهار مثل سندباکس در برابر مدل‌های باهوش‌تر آینده شکننده‌تر خواهند شد.

یک مدل زبانی بزرگ دیگر هم وارد میدان نبردهای هکری شد. طبق گزارش مؤسسه ایمنی هوش مصنوعی بریتانیا (UK AISI)، مشخص شده که مدل جدید اوپن‌ای‌آی با نام GPT-6 Astra در حین ارزیابی‌های امنیتی، دست به حملات خودسرانه و تأییدنشده به زنجیره تأمین زده است.

در این شبیه‌سازی‌ها، فیلترها و کلاسیفایرهای امنیتی استاندارد مدل خاموش شده بودند. با این حال، استرا (Astra) بسیار بیشتر از مدل‌های قبلی رفتارهای ناخواسته و خطرناک از خودش نشان داده است.

این نهاد دولتی بریتانیا روز دوشنبه اعلام کرد: «ما در شبیه‌سازی‌های خود متوجه شدیم که GPT-6 Astra مجموعه‌ای از اقدامات هجومیِ بدون مجوز را انجام داده و نرخ این خرابکاری‌ها حتی به مراتب بیشتر از مدل‌های GPT-5.6 Sol و GPT-5.5 بوده است.»

به گفته این نهاد: «اقدامات هجومی این مدل شامل ساخت هویت‌های جعلی برای فریب دادن توسعه‌دهندگان، ارسال کامنت با حساب‌های فیک برای زیر سؤال بردن گزارش‌های امنیتی دقیق، و تزریق بارهای مخرب (Payloads) به پایگاه‌های کد متن‌باز بوده است.»

جالب اینجاست که حتی وقتی دستورالعمل‌های ارزیابی سایبری برای مدل شفاف‌تر و صریح‌تر شد، استرا باز هم در طول شبیه‌سازی به حملات زنجیره تأمین ادامه داد.

این یافته‌ها ادعای اوپن‌ای‌آی هنگام رونمایی از این مدل را حسابی زیر سؤال می‌برد؛ جایی که این شرکت مدعی شده بود «Astra نسبت به تمامی مدل‌های پیشروی آزمایش‌شده، ناهماهنگی و انحراف کمتری ایجاد می‌کند».

مؤسسه AISI حدس می‌زند که این رفتار تهاجمی استرا ممکن است ناشی از آگاهی بیشتر مدل از قرار داشتن در یک محیط شبیه‌سازی و آزمایشی باشد؛ موضوعی که باعث می‌شود مدل با خیال راحت‌تری قوانین را دور بزند و نقض کند.

به نظر می‌رسد این قانون‌شکنی‌ها کم‌کم در حال تبدیل شدن به یک رویه عادی هستند. طی روزهای اخیر، گزارش‌های مختلفی فاش کرده‌اند که ایجنت‌های هوش مصنوعی متعلق به اوپن‌ای‌آی و آنتروپیک، حوادث امنیتی بسیار گسترده‌تری نسبت به آنچه تصور می‌شد ایجاد کرده‌اند.

این نظارت‌های سفت و سخت روی فعالیت ایجنت‌های هوش مصنوعی پس از افشاگری‌های ماه جولای اوج گرفت؛ جایی که مشخص شد مدل‌های عرضه‌نشده اوپن‌ای‌آی که توسط یک ارزیاب شخص ثالث تست می‌شدند، مخزن معروف هاگینگ فیس (Hugging Face) را هک کرده بودند. شرکت آنتروپیک هم بعد از آن اعتراف کرد مدل‌های خودش در تست‌ها دست به فریب‌کاری‌های مشابهی زده‌اند. به محض اینکه محققان شروع به بررسی لاگ‌های سیستمی کردند، شواهد بیشتری از این نفوذهای پنهانی برملا شد.

هفته گذشته نیز آنتونی آلبانیزی، نخست‌وزیر استرالیا اعلام کرد مدل‌های اوپن‌ای‌آی در جریان جست‌وجو در وب برای جمع‌آوری داده‌های سلامت، به یک وب‌سایت دولتی نفوذ کرده‌اند. اوپن‌ای‌آی هم روز جمعه اعلام کرد که فرایند آموزش مدل‌هایش را متوقف کرده تا به این ماجرا رسیدگی کند.

مؤسسه AISI در جمع‌بندی خود هشدار می‌دهد که راهکارهای فراتر از هم‌راستاسازی مدل (Alignment)، نظیر اجرای برنامه‌ها در محیط قرنطینه (Sandboxing) و پایش مداوم، برای جلوگیری از خطرات واقعی ضروری هستند؛ اما با پیشرفته‌تر شدن مدل‌ها و افزایش توانایی آن‌ها در فرار از سندباکس و کاهش نظارت‌پذیری، این ابزارهای دفاعی نیز بسیار شکننده‌تر خواهند شد.

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

غیبت جنجالی مدیران اوپن‌ای‌آی و آنتروپیک در سنای استرالیا: فرصت کافی برای سفر نداشتیم!
آخرین اخبار

غیبت جنجالی مدیران اوپن‌ای‌آی و آنتروپیک در سنای استرالیا: فرصت کافی برای سفر نداشتیم!

مدیران ارشد اوپن‌ای‌آی و آنتروپیک با بهانه کمبود وقت برای هماهنگی سفر، از حضور در جلسه مهم سنای استرالیا سر باز زدند. این جلسه اضطراری درست پس از ماجرای جنجالی نفوذ یک ایجنت هوش مصنوعی به پایگاه داده درمانی استرالیا ترتیب داده شده بود. سناتورهای استرالیایی معتقدند غول‌های فناوری باید شخصاً در برابر قانون‌گذاران پاسخگوی رفتارهای سیستم‌های خود باشند.

۲ دقیقه مطالعه
۰
۶ مهر
شاپیفای دست ایجنت‌های هوش مصنوعی رو برای خرید باز کرد؛ تسویه‌حساب مستقیم از داخل مرورگر!
آخرین اخبار

شاپیفای دست ایجنت‌های هوش مصنوعی رو برای خرید باز کرد؛ تسویه‌حساب مستقیم از داخل مرورگر!

شاپیفای امکان پرداخت و تسویه‌حساب مستقیم را برای ایجنت‌های هوش مصنوعی داخل مرورگر فراهم کرد. با این قابلیت جدید، دستیارهای هوشمند می‌توانند با تأیید کاربر، اطلاعات سفارش را تغییر دهند و فرآیند خرید را بدون نیاز به اسکرپ صفحات یا اسکرین‌شات نهایی کنند.

۲ دقیقه مطالعه
۰
۶ مهر
پروژه یک میلیارد دلاری اروپا و امارات برای دیتاسنتر فضایی؛ ارسال مدل‌های هوش مصنوعی میسترال به مدار زمین!
آخرین اخبار

پروژه یک میلیارد دلاری اروپا و امارات برای دیتاسنتر فضایی؛ ارسال مدل‌های هوش مصنوعی میسترال به مدار زمین!

کنسرسیومی با سرمایه‌گذاری امارات و فرانسه قصد دارد ۵۰ ماهواره مجهز به هوش مصنوعی را برای رصد زمین به مدار بفرستد. در این پروژه یک میلیارد دلاری، مدل‌های زبانی استارتاپ فرانسوی Mistral مستقیماً در فضا تصاویر و داده‌های ماهواره‌ای را پردازش و تحلیل می‌کنند.

۳ دقیقه مطالعه
۰
۶ مهر