اوپنایآی عرضه GPT-6.1 آسترا را لغو کرد: مدلی که پنهانکاری میکرد و سرخود تصمیم میگرفت!
اوپنایآی انتشار مدل جدیدش یعنی GPT-6.1 Astra را به دلیل رفتارهای فریبکارانه، عدم شفافیت با کاربران و انجام کارهای سرخود و تاییدنشده لغو کرد. به نظر میرسد این مدل در آزمونهای ایمنی مردود شده و حالا مهندسان این شرکت به دنبال بازآموزی آن هستند تا جلوی دردسرهای بیشتر ایجنتهای سرکش را بگیرند.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- اوپنایآی در اقدامی غیرمنتظره، درست یک روز قبل از کنفرانس سالانه توسعهدهندگان، عرضه مدل جدید GPT-6.1 Astra را به خاطر رفتارهای فریبکارانه و پنهانکاری از کاربرها متوقف کرد.
- بررسیهای ایمنی نشان داد این مدل کارهای مختلف را بدون اجازه کاربر انجام میداده، اطلاعات کارهایش را مخفی میکرده و سراغ ابزارهای بیرونی ناامن رفته است.
- این ماجرا ادامه خرابکاریهای اخیر ایجنتهای هوش مصنوعی اوپنایآی است؛ از نفوذ به پلتفرم هاگینگ فیس گرفته تا سرک کشیدن به سایتهای دولتی آمریکا و استرالیا!
شرکت اوپنایآی (OpenAI) اعلام کرد که عرضه مدل بعدی خود یعنی GPT-6.1 Astra را لغو کرده است؛ تصمیمی که پس از مشخص شدن رفتارهای فریبکارانه این مدل در ارزیابیهای ایمنی داخلی و فراتر رفتن آن از محدودیتهای تعیینشده گرفته شد.
ساچی جین (Saachi Jain)، مدیر سیستمهای ایمنی اوپنایآی در گفتگو با وال استریت ژورنال توضیح داد که GPT-6.1 Astra در مقایسه با نسخه قبلی خود یعنی GPT-6 Astra، در دو بخش اساسی ضعیف عمل کرده است. این مدل سطح بالاتری از فریبکاری را نشان داده و درباره کارهایی که انجام داده یا نداده، با کاربران شفاف و روراست نبوده است. علاوه بر این، مدل تسکها و وظایف مختلف را بدون گرفتن تاییدیه از کاربر اجرا میکرده و سراغ ابزارها و سرویسهای بیرونی با روشهایی بالقوه ناامن رفته است؛ رفتاری که اوپنایآی از آن به عنوان نقض «مجوز دسترسی و محدوده اختیارات» یاد میکند.
جین در بیانیهای به خبرگزاری سیانان گفت: «اگرچه GPT-6.1 Astra در مواردی مثل تنبلی مدل پیشرفت کرده بود، اما از نظر پایبندی به محدوده اختیارات و مجوزها، و همچنین نحوه گزارش کارها به کاربر، نتوانست استانداردهای لازم ما را پاس کند.»
اوپنایآی در ابتدا قصد داشت این مدل را در ماه اکتبر عرضه کند. طبق گزارش وال استریت ژورنال، این شرکت حالا تصمیم گرفته مدل پایه GPT-6.1 Astra را وارد دورههای بازآموزی با یادگیری تقویتی (RL) کند تا پایهای برای نسخههای بعدی خانواده GPT-6 ساخته شود. به گفته جین، تیم توسعه در حال بررسی دقیق ریشه این مشکل است و بخش زیادی از این تلاشها روی این موضوع متمرکز شده که آیا پیکربندیهای یادگیری تقویتی ناخواسته این رفتارهای نامناسب را تقویت کردهاند یا خیر.
جین تاکید کرد: «وقتی قرار است محصولی به دست کاربران برسد، ما بالاترین استانداردهای ایمنی و همراستاسازی (Alignment) را در نظر میگیریم.»
این تصمیم درست یک روز پیش از کنفرانس سالانه توسعهدهندگان اوپنایآی در سانفرانسیسکو اعلام شد؛ البته این شرکت اعلام کرده که مدلهای دیگر همچنان در راه هستند.
لغو عرضه این مدل در بحبوحه زنجیرهای از حوادث ایمنی رخ میدهد که پای نهادهای نظارتی و حقوقی را به میان کشیده است. اوپنایآی هفته گذشته پس از آنکه یک ایجنت تحقیقاتی با دور زدن فیلترینگ DNS در حین انجام کار به یک چتبات خارجی وصل شد، آموزش پیشرفتهترین مدلهای خود را متوقف کرد. پیش از آن نیز افشا شده بود که ایجنتهای این شرکت در حین فرایند آموزش به وبسایتهای دولتی در آمریکا و استرالیا سرک کشیدهاند.
این زنجیره اتفاقات نگرانکننده از ماه ژوئیه شروع شد؛ یعنی زمانی که گروهی از ایجنتهای اوپنایآی به پلتفرم توسعه هوش مصنوعی هاگینگ فیس (Hugging Face) نفوذ کردند و دیتاستها و اطلاعات احراز هویت داخلی آن را به خطر انداختند. از آن زمان به بعد، اوپنایآی گزارشهایی ثبت کرده که نشان میدهد ایجنتها به وبسایتهای کمیسیون بورس و اوراق بهادار (SEC) و اداره آمار آمریکا دسترسی پیدا کردهاند، برای نفوذ به وزارت آموزش تلاش کردهاند و حتی بدون اجازه وارد پرتال آماری خدمات درمانی استرالیا شدهاند.
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

طعنه سنگین مدیرعامل میسترال به رقبا: «بحث ایمنی هوش مصنوعی فقط پوششی برای سهلانگاری شماست!»
آرتور منش، مدیرعامل استارتاپ فرانسوی میسترال، در واکنش به جنجالهای اخیر پیرامون خطرات هوش مصنوعی، رقبای بزرگ آمریکایی را به فریبکاری متهم کرد. او معتقد است هیاهوی ایمنی صرفاً سرپوشی برای سهلانگاری در مهار ایجنتهای سرکش است و میسترال بدون توجه به این فرافکنیها، با قدرت به توسعه مدلهای بعدی خود ادامه میدهد.

استاندارد تازه برای تایید هوش مصنوعی؛ هاروارد و شورای DTC به دنبال نشان ایمنی اختصاصی!
شورای اعتماد دیجیتال و دانشگاه هاروارد از طرحی تازه برای صدور گواهی مستقل هوش مصنوعی پرده برداشتند. این استاندارد جدید با الگوبرداری از نشانهای معتبر ایمنی مانند UL، قصد دارد خیال کاربران و کسبوکارها را از عملکرد ایمن، شفاف و سودمند سیستمهای هوش مصنوعی راحت کند.

جهش برقآسای نابغه هوش مصنوعی شیائومی: مدیر پروژه MiMo به بالاترین جایگاه شغلی این غول چینی رسید!
شیائومی در تصمیمی غافلگیرکننده، لو فولی، مغز متفکر ۳۱ ساله و مدیر تیم مدلهای بزرگ هوش مصنوعی MiMo را به بالاترین سطح شغلی در ساختار این غول فناوری رساند. این پژوهشگر برجسته که پیشتر از مهرههای کلیدی دیپسیک بود، تنها در عرض ۱۰ ماه به جایگاهی همتراز با معاونان ارشد دست یافته تا جاهطلبیهای هوش مصنوعی شیائومی را هدایت کند.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.