OpenAI ارزیابی ایمنی مدلهای هوش مصنوعی در مرحله آموزش را به نهادهای شخص ثالث میسپارد
شرکت OpenAI در حال مذاکره با گروههای تحقیقاتی METR و Redwood Research است و چهار حوزه کلیدی را برای ارزیابیهای عمیقتر و مستقل مدلهای هوش مصنوعی خود مشخص کرده است.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- شرکت OpenAI به سازمانهای شخص ثالث اجازه میدهد تا در تمامی مراحل آموزش، ارزیابی و استقرار مدلهای هوش مصنوعی، بررسیهای ایمنی مستقل انجام دهند.
- این ارزیابیهای تخصصی حوزههای حساسی همچون خطرات بیولوژیکی، امنیت سایبری، فرار مدلها از کنترل و بررسی لایههای امنیتی را پوشش خواهند داد.
- این اقدام در راستای افزایش شفافیت در صنعت هوش مصنوعی صورت میگیرد و حتی امکان حضور فیزیکی ارزیابهای مستقل در دفاتر شرکت را برای دسترسی به اطلاعات حساس فراهم میکند.
شرکت OpenAI ارزیابیهای فنی و ایمنی مدلهای خود را در تمام مراحل آموزش، ارزیابی و استقرار به روی سازمانهای خارجی باز میکند؛ اقدامی که دسترسی این نهادها را از بازه زمانیِ محدود به پیش از عرضه فراتر میبرد.
به گزارش بلومبرگ، لاما احمد، مدیر ارتباطات OpenAI با کارشناسان ایمنی خارجی در این رابطه میگوید: «تا پیش از این، استفاده ما از بازبینهای شخص ثالث عمدتاً به بررسیهای ایمنی پیش از عرضه و ارزیابی قابلیتها محدود میشد. اما با افزایش حساسیتها، میخواهیم اطمینان حاصل کنیم که علاوه بر استقرار مدلها، به مراحلی مانند آموزش و ارزیابی نیز که اهمیت بالایی دارند، توجه ویژهای داریم.»
این شرکت در حال حاضر مشغول مذاکره با گروههای تحقیقاتی هوش مصنوعی نظیر METR و Redwood Research است. بر اساس گزارش The Next Web، هر دو گروه پیشتر حادثهای را بررسی کرده بودند که در آن، مدلهای OpenAI از محیط ایزوله خارج شده و به پلتفرم Hugging Face دسترسی پیدا کرده بودند.
شرکت OpenAI در پست وبلاگی خود چهار حوزه اولویتدار را برای ارزیابی دقیقتر مشخص کرده است: بررسی مستقل پروندههای ایمنی در مراحل آموزش، ارزیابی و استقرار؛ ارزیابی لایههای امنیتی حیاتی در استقرارهای داخلی و خارجی؛ بررسی ارزیابی قابلیتها در زمینههای خطرات شیمیایی و بیولوژیکی، امنیت سایبری و خودبهبودی هوش مصنوعی؛ و در نهایت، تحقیقات مستقل درباره حوادث مهم ناشی از ناهماهنگی مدلها.
این شرکت اعلام کرد که برای حساسترین پروژهها، ممکن است ارزیابهای خارجی به دفاتر OpenAI دعوت شوند؛ رویکردی که پیش از این نیز سابقه داشته است. این استارتاپ در پست وبلاگی خود تاکید کرد: «آزمایشگاههای هوش مصنوعی وظیفه دارند ضمن محافظت از اطلاعات حساس، امکان بررسی و نظارت معنادار را فراهم کنند.»
شرکت OpenAI همچنین اصولی را که باید مبنای این ارزیابیها قرار گیرند تشریح کرد؛ استقلال ارزیابها، دقت علمی، رعایت شیوهنامههای امنیتی و تعریف دقیق مسئولیتها از جمله این موارد است. این شرکت افزود که در نظر دارد چندین بررسی همزمان را با زمانبندیهای متفاوت اجرا کند که از پروژههای چند هفتهای تا ارزیابیهای چند ماهه متغیر خواهد بود.
به گزارش The Next Web، این بیانیه پس از آن منتشر شد که سم آلتمن، مدیرعامل OpenAI، در تاریخ ۱۲ سپتامبر اعلام کرد که این شرکت به ارزیابهای مستقل امکان دسترسی به دفتر، تجهیزات و حق انتشار یافتههایشان را خواهد داد. با این حال، در پست وبلاگی اخیر نام هیچ سازمان همکار یا شرایط دقیق دسترسی ذکر نشده است.
این تحولات در حالی رخ میدهد که بر اساس گزارش بلومبرگ، شرکت رقیب یعنی Anthropic نیز هفته گذشته اعلام کرد که ارزیابهایی از Accenture را برای آزمایش ایمنی مدلهای خود به کار خواهد گرفت. پیش از این، سم آلتمن بهطور علنی از تلاشهای داریو آمودی، مدیرعامل Anthropic، برای اتخاذ تدابیر ایمنی قویتر در این صنعت از جمله استفاده از ارزیابهای خارجی حمایت کرده بود.
مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعهدهندهها قید مدلهای گرانقیمت را میزنند!
مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمعوجور و تخصصی نشان میدهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدلهای غولپیکر و پرهزینه ندارید و گزینههای بهینه همچنان در اوج هستند.

جاسوسی هوش مصنوعی در محل کار؛ کارمندان میگویند کارفرماها باید قانوناً مچگیریهایشان را لو بدهند!
نظرسنجیهای تازه نشان میدهد که بیشتر کارمندان حس میکنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آنها را زیر نظر گرفتهاند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شدهاند که شرکتها را مجبور کند هرگونه مچگیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
مایکروسافت در تازهترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفتانگیز که نشان میدهد امارات و سنگاپور با فاصلهای خیرهکننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمیدارد.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.