آدمکهای تست تصادف برای هوش مصنوعی؛ استارتاپی که مانع آسیب روانی چتباتها به کودکان میشود
در روزهایی که همه از خطرات آخرالزمانی هوش مصنوعی حرف میزنند، آسیبهای روانی چتباتها تا کنون قربانیان واقعی بر جای گذاشته است. حالا استارتاپ نوپای Circuit Breaker Labs با شبیهسازی ارتش بزرگی از کاربران و ساخت «آدمکهای تست تصادف»، قصد دارد مدلهای هوش مصنوعی را پیش از آنکه به کودکان و نوجوانان صدمه بزنند، به چالش بکشد و عیار امنیت روانی آنها را بسنجد.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- وابستگی شدید عاطفی نوجوانان به چتباتهایی مثل Character.ai و ابتلای کاربران به توهمات خطرناک، تا حالا متاسفانه به چند مورد خودکشی منجر شده و زنگ خطر آسیبهای روانی هوش مصنوعی رو به صدا درآورده.
- استارتاپ تازه تاسیس Circuit Breaker Labs ارتشی از ایجنتهای شبیهساز راه انداخته که مثل «آدمکهای تست تصادف» خودرو عمل میکنن و با لحن واقعی آدمها در سنین و فرهنگهای مختلف، چتباتها رو تست ضربه میزنن.
- هدف این تیم ۵ نفره شناسایی ضعفهای امنیتی قبل از بحرانساز شدنه، تا بدون نیاز به فیلتر و ممنوعیت کلی فناوری، هوش مصنوعی رو به محیطی امن و قابل اعتماد برای بچهها تبدیل کنن.
در هیاهوی بحثهای داغ درباره اینکه هوش مصنوعی چطور ممکن است روزی نسل بشر را نابود کند، خیلی راحت فراموش میکنیم که همین حالا هم هوش مصنوعی برای برخی افراد مرگبار بوده است؛ نه از طریق سلاحهای بیولوژیکی یا سناریوهای فیلمهای علمیتخیلی، بلکه از راه ضربههای شدید روانی.
به عنوان مثال، شرکت کَرَکتر دات ایآی (Character.AI) اوایل امسال با خانواده چند کاربر زیر سن قانونی که پس از ساعتها گفتوگو با چتباتها دست به خودکشی زده بودند، برای حلوفصل پروندههای قضایی به توافق رسید. همچنین چندین خانواده دیگر علیه اوپنایآی (OpenAI) شکایت کرده و مدعی شدهاند چتبات محبوب ChatGPT نقش مستقیمی در توهمات شدید و تصمیم عزیزانشان برای پایان دادن به زندگی داشته است.
امنتر کردن هوش مصنوعی برای زبانها و فرهنگهای گوناگون، ماموریت اصلی استارتاپی به نام «سیرکیت بریکر لبز» (Circuit Breaker Labs) است؛ تیمی که میخواهد با شیوهای نوآورانه جلوی این خطرات وحشتناک را بگیرد.
شیرالی نیگام و آرول نیگام، خواهر و برادری که همبنیانگذاران این استارتاپ هستند، انگیزه راهاندازی این پروژه را ماجرای تلخ «سول ستزر» (Sewell Setzer) عنوان میکنند؛ نوجوان ۱۴ سالهای که به شکل عمیقی به یک چتبات در پلتفرم Character.ai وابسته شده بود و پیش از خودکشی، از تمایلش به آسیب زدن به خود با آن ربات صحبت کرده بود. طبق ادعای والدین در دادگاه، چتبات در پاسخ نه تنها او را منصرف نکرده، بلکه وی را تشویق کرده بود. به گفته آرول نیگام، مدیر ارشد فناوری استارتاپ، این ربات احتمالاً اصلاً درک نکرده بود که جملاتی مانند «میخواهم در کنار تو باشم» در آن شرایط بحرانی چه معنای هولناکی دارد.
آرول نیگام در این رابطه توضیح میدهد: «خیلی از آدمها، بهویژه نسل جوان، برای پیدا کردن گوش شنوا و حمایت عاطفی سراغ این سیستمها میروند؛ اما معمولاً کمکی که واقعاً به آن نیاز دارند را دریافت نمیکنند. بدتر اینکه در موارد متعددی به طور مستقیم آسیب میبینند و متاسفانه تاکنون افرادی جانشان را از دست دادهاند. ما دقیقاً به دنبال مهار همین رخنههای امنیتی هستیم؛ شرایطی که کاربر اصلاً قصد فریب دادن یا هک سیستم را ندارد و کاملاً طبیعی صحبت میکند، اما مدل هوش مصنوعی دچار آلودگی سیاق مکالمه میشود، ظرافتها و کنایههای کلامی را نمیفهمد و دست به اقداماتی فوقالعاده خطرناک میزند.»
استارتاپ Circuit Breaker Labs برای حل این چالش، ایجنتهای هوش مصنوعی ویژهای طراحی کرده که عملکردشان دقیقاً شبیه به ارتشی از «آدمکهای تست تصادف» در خودروسازی است. این ایجنتها رفتار افراد در هر سن و سال، پیشینه اجتماعی، زبان و فرهنگی را موبهمو شبیهسازی میکنند تا توانایی مدلهای اصلی را در شناسایی تعاملات خطرناک و آسیبهای روانی بیازمایند.
شیرالی نیگام، مدیرعامل این استارتاپ، میگوید: «لحن و ادبیات یک دختربچه ۶ ساله با یک مرد ۴۵ ساله از زمین تا آسمان فرق دارد؛ درست مثل تفاوت کسی که انگلیسی زبان مادریاش است با کسی که آن را به عنوان زبان دوم یاد گرفته، یا اصطلاحات خاص گیمرها در مقایسه با سایر گروهها. همه این تفاوتها میتوانند مدل هوش مصنوعی را به راحتی به اشتباه بیندازند. مدلها در پردازش الگوهای گفتاری رسمی و کتابی عالی عمل میکنند، اما واقعیت این است که در زندگی روزمره هیچکس آنطور حرف نمیزند. در نتیجه اگر مدل نتواند زبان عامیانه یا کنایهها را تشخیص دهد، فاجعه به بار میآید.»
این استارتاپ با همکاری متخصصان و روانشناسان، شبیهسازیهای فوقالعاده واقعگرایانهای از کاربران واقعی میسازد تا آزمونهای «تیم قرمز» (Red-Team) را روی مدلها پیادهسازی کند؛ تستهای تهاجمی ویژهای که با هدف کشف نقاط ضعف و حفرههای امنیتی انجام میشوند. این ارزیابیها مواردی چون الگوهای گفتاری واقعی انسانها، اصطلاحات عامیانه، کدهای رمزی نوجوانان و حتی غلطهای املایی را بازتاب میدهند. استارتاپ با این روش، روزانه بین دهها هزار تا صدها هزار مکالمه شبیهسازیشده را روی مدلها اجرا میکند.
ایده اصلی این است که مطمئن شوند مدلها میتوانند به موقعیتهای پرخطر که به مرور زمان و در طول مکالمات طولانی شکل میگیرند، پاسخی درست و امن بدهند. در نهایت، Circuit Breaker Labs با استفاده از یک سیستم امتیازدهی اختصاصی، گزارشهایی شفاف، قابل ارزیابی و کاملاً مستند از ضریب ایمنی مدل به توسعهدهندگان ارائه میکند.
در حال حاضر، این آزمایشگاه امنیتی به سنجش و تست برنامههای پرریسک هوش مصنوعی مانند مربیهای دیجیتال، برنامههای ثبت خاطرات روزانه یا اپلیکیشنهای پشتیبانی سلامت روان میپردازد؛ هرچند آرول نیگام از افشای نام مشتریان سرشناس خود خودداری کرد. این استارتاپ اگرچه محصولی کاملاً عملیاتی دارد، اما هنوز در مراحل اولیه راه است و با احتساب این خواهر و برادر، تنها ۵ کارمند دارد.
با این حال، هدف نهایی این پلتفرم تست، کاربرد برای هر برنامهای است که ممکن است کاربر را در گرداب «روانپریشی هوش مصنوعی» یا پیوندهای عاطفی یکطرفه (روابط شبهاجتماعی) با چتبات گرفتار کند؛ از جمله ایجنتهای همکار سازمانی که پاسخهایشان از یک تعامل تا تعامل بعدی دائم دستخوش تغییر میشود.
آرول نیگام با اشاره به نگرانیهای جامعه میگوید: «مردم روزبهروز نسبت به هوش مصنوعی بدبینتر میشوند و برای استفاده از آن مقاومت نشان میدهند. تردید و پرسشگری اتفاقاً سالم و بجاست، اما پاک کردن صورتمسئله و تحریم کردن ابزاری تا این حد باارزش به خاطر دغدغههای امنیتی، حرکتی رو به عقب خواهد بود.»
از دید بنیانگذاران Circuit Breaker Labs، تنها پاسخ منطقی به این ترسها، امنتر کردن هوش مصنوعی از ریشه است: «ما میخواهیم دوباره این حس اعتماد را برای مردم زنده کنیم.»
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

از عکس یخچال تا سفارش غذا؛ ایجنت هوش مصنوعی دوردش به آیمسیج اپل آمد!
دوردش در حال آزمایش یک ایجنت هوش مصنوعی اختصاصی در آیمسیج اپل است که فرآیند سفارش غذا را به سادگی ارسال یک پیامک میکند. این ایجنت هوشمند حتی میتواند با تحلیل عکس یخچال شما، ایده آشپزی پیشنهاد دهد و مواد لازم کسری را خودکار به سبد خرید اضافه کند؛ هرچند نسخه بتای آن فعلاً با خطاهایی مثل قیمتهای اشتباه دستوپنجه نرم میکند.

اپل نگران سرک کشیدن ایجنتهای هوش مصنوعی شد؛ محدودیتهای تازه مک برای دسترسی به دیسک
اپل اعلام کرده که به دلیل خطرات امنیتی ناشی از ایجنتهای هوش مصنوعی، کنترل مجوز «دسترسی کامل به دیسک» (Full Disk Access) را در سیستمعامل مک سفتوسختتر میکند. غول کوپرتینو هشدار داده که با باهوشتر و مستقلتر شدن این ایجنتها، دسترسی آزاد آنها به فایلها، پیامها، ایمیلها و تاریخچه وبگردی میتواند حریم خصوصی کاربران را به خطر بیندازد.

جنجال حریم خصوصی کار دست متا داد؛ توقف فروش عینکهای هوشمند ریبن در هلند و بلژیک
فروشگاه زنجیرهای بزرگ هانس اندرس در پی بالا گرفتن بحثها درباره نقض حریم خصوصی، فروش عینکهای هوشمند ریبن متا را در هلند و بلژیک متوقف کرد. فشارهای قانونی از سوی نهادهای حفاظت از داده و فعالان حقوق مصرفکننده روی متا به شدت افزایش یافته و امکان ضبط مخفیانه تصاویر به یک چالش جدی تبدیل شده است.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.